OpenAI и Broadcom представили Jalapeño - первый кастомный AI-ускоритель для инференса больших языковых моделей. Разработка от ранних схем до готовности к производству заняла 9 месяцев - рекорд для полупроводниковой индустрии, где циклы обычно измеряются годами. Снижение стоимости инференса оценивается примерно в 50%.
Jalapeño - это Application-Specific Integrated Circuit (ASIC), то есть чип, заточенный под узкий круг задач. В отличие от GPU Nvidia, которые могут обрабатывать много типов нагрузок, ASIC оптимизирован для конкретной работы. В случае Jalapeño - для обслуживания LLM: ChatGPT, Codex, API и будущих агентных продуктов.
Ключевые цифры
- 9 месяцев - от схем до готовности к производству
- около 50% - снижение стоимости инференса
- GPT-5.3-Codex-Spark - первая модель, протестированная на чипе
- Конец 2026 года - начало развёртывания в дата-центрах
Почему OpenAI строит свой чип
OpenAI тратит колоссальные суммы на вычисления. Аудированные финансовые документы показали: в 2025 году операционные расходы компании достигли 34 млрд долларов при выручке 13,07 млрд. Основная статья - compute. R&D-затраты составили 19,18 млрд долларов (56% всех расходов). OpenAI также заплатила Microsoft более 10,59 млрд за R&D и вычислительную инфраструктуру.
Собственный чип - попытка сделать юнит-экономику более устойчивой. Broadcom отвечает за кремниевую реализацию и сетевые технологии (включая Tomahawk-коммутаторы), Celestica - за интеграцию в стойки и системы.
9 месяцев вместо лет
Скорость разработки объясняется глубокой ко-дизайновой интеграцией софта и харда. OpenAI использовала собственные модели для ускорения проектирования чипа - по данным источников, предыдущие поколения моделей помогали оптимизировать архитектуру.
«Производительность на ватт выглядит невероятно», - Грег Брокман, президент и сооснователь OpenAI, в интервью CNBC.
Jalapeño спроектирован с чистого листа под современные LLM. Вместо адаптации широких ускорителей под свои нужды OpenAI построила архитектуру, которая минимизирует лишние перемещения данных и лучше согласует вычислительные, памятьные и сетевые ресурсы.
Что это значит для бизнеса
Собственный чип OpenAI - сигнал для всего рынка AI. Если раньше компании были привязаны к GPU Nvidia, то теперь появляется альтернатива. Для бизнеса, который использует ChatGPT API или планирует строить собственные AI-решения, это означает потенциальное снижение стоимости инференса в долгосрочной перспективе.
Для предпринимателей во Владивостоке и на Дальнем Востоке тренд очевиден: стоимость AI-вычислений будет снижаться, делая автоматизацию бизнеса доступнее. Новости openai - одни из самых важных для тех, кто строит стратегию внедрения искусственного интеллекта. Когда инференс дешевеет в разы, открываются сценарии, которые вчера были нерентабельны.