OpenAI и Broadcom представили Jalapeño - первый кастомный AI-ускоритель для инференса больших языковых моделей. Разработка от ранних схем до готовности к производству заняла 9 месяцев - рекорд для полупроводниковой индустрии, где циклы обычно измеряются годами. Снижение стоимости инференса оценивается примерно в 50%.

Jalapeño - это Application-Specific Integrated Circuit (ASIC), то есть чип, заточенный под узкий круг задач. В отличие от GPU Nvidia, которые могут обрабатывать много типов нагрузок, ASIC оптимизирован для конкретной работы. В случае Jalapeño - для обслуживания LLM: ChatGPT, Codex, API и будущих агентных продуктов.

Ключевые цифры

  • 9 месяцев - от схем до готовности к производству
  • около 50% - снижение стоимости инференса
  • GPT-5.3-Codex-Spark - первая модель, протестированная на чипе
  • Конец 2026 года - начало развёртывания в дата-центрах

Почему OpenAI строит свой чип

OpenAI тратит колоссальные суммы на вычисления. Аудированные финансовые документы показали: в 2025 году операционные расходы компании достигли 34 млрд долларов при выручке 13,07 млрд. Основная статья - compute. R&D-затраты составили 19,18 млрд долларов (56% всех расходов). OpenAI также заплатила Microsoft более 10,59 млрд за R&D и вычислительную инфраструктуру.

Собственный чип - попытка сделать юнит-экономику более устойчивой. Broadcom отвечает за кремниевую реализацию и сетевые технологии (включая Tomahawk-коммутаторы), Celestica - за интеграцию в стойки и системы.

9 месяцев вместо лет

Скорость разработки объясняется глубокой ко-дизайновой интеграцией софта и харда. OpenAI использовала собственные модели для ускорения проектирования чипа - по данным источников, предыдущие поколения моделей помогали оптимизировать архитектуру.

«Производительность на ватт выглядит невероятно», - Грег Брокман, президент и сооснователь OpenAI, в интервью CNBC.

Jalapeño спроектирован с чистого листа под современные LLM. Вместо адаптации широких ускорителей под свои нужды OpenAI построила архитектуру, которая минимизирует лишние перемещения данных и лучше согласует вычислительные, памятьные и сетевые ресурсы.

Что это значит для бизнеса

Собственный чип OpenAI - сигнал для всего рынка AI. Если раньше компании были привязаны к GPU Nvidia, то теперь появляется альтернатива. Для бизнеса, который использует ChatGPT API или планирует строить собственные AI-решения, это означает потенциальное снижение стоимости инференса в долгосрочной перспективе.

Для предпринимателей во Владивостоке и на Дальнем Востоке тренд очевиден: стоимость AI-вычислений будет снижаться, делая автоматизацию бизнеса доступнее. Новости openai - одни из самых важных для тех, кто строит стратегию внедрения искусственного интеллекта. Когда инференс дешевеет в разы, открываются сценарии, которые вчера были нерентабельны.