OpenAI впервые показала реальные замеры чипа Jalapeño, и они обошли Nvidia Blackwell по работе на ватт и по задержке. Днём раньше SpaceXAI объявила, что отправит ИИ-стойки на орбиту на год раньше плана. Обе новости приехали с Hot Chips 2026, и обе отвечают на одну проблему: агенты.
В понедельник Nvidia сообщила, что SpaceXAI ставит отдельные CPU Vera под агентные задачи Grok, став вторым после Meta гиперскейлером, который берёт Vera вне целых стоек. Маск сразу подкинул дату: космическая Vera Rubin NVL72 уйдёт на орбиту в четвёртом квартале 2027 года, а масштаб наберут к 2028-му. Это на год раньше, чем намечала сама SpaceX.
Во вторник OpenAI опубликовала первые реальные замеры Jalapeño. Собранный с Broadcom чип анонсировали ещё в октябре 2025-го, но без данных. Теперь цифры на столе: на бенчмарке InferenceX от SemiAnalysis с моделями GPT-OSS 120B, DeepSeek R1 670B и Kimi K2.5 1T против системы на Nvidia Blackwell чип делает в 1,5-1,9 раза больше работы на ватт, режет сквозную задержку в 1,7-3,6 раза и в 2,1-4,1 раза быстрее справляется с интерактивными задачами. Паспортный TDP 700 ватт, но в тестах он ужимался ниже 550.
Архитектура бьёт в места, где вывод обычно буксует: ускоряет фазу prefill и обмен данными, а состояние модели вместе с KV-кэшем держит локально, не гоняя по сети. Глава железного направления OpenAI Ричард Хо назвал это заметным шагом вперёд. Есть и красивая петля: старые модели OpenAI помогали проектировать и запускать чип, а нынешние уже оптимизируют его и пишут под него код.
Две честные оговорки. Сравнение идёт с нынешним Blackwell, тогда как массовый Jalapeño выйдет в 2027-м, когда Nvidia уже отгрузит Rubin. И цифры публикует сама OpenAI, хотя гонка на стороннем бенчмарке, планка серьёзно выше большинства вендорских графиков.
Спутник Starmind AI1 несёт 120 киловатт вычислительной нагрузки с пиком 150, а корпус шире Boeing 747. Задача тут противоречит интуиции: в космосе компьютеру опасно жарко, ведь воздух не уносит тепло. Земную стойку NVL72 остужает вода, а орбитальная должна сбросить всё тепло через радиаторы, пережить радиацию и вибрации запуска и остаться без ремонта.
Связь простая: агенты. CPU Vera появился потому, что агент утаскивает работу с GPU. Между вызовами модели он оркестрирует инструменты, выполняет код, гоняет симуляции. Если это ползёт, GPU простаивают. Jalapeño даёт прирост именно на интерактивных задачах, ведь агент делает много шагов подряд, а задержка каждого складывается на всей цепочке.
OpenAI ответила вертикальной интеграцией: свои модели, софт, чипы, память и сеть. SpaceXAI сменила саму среду, там, где безлимитное солнце и вакуум для сброса тепла. Оба пути дорогие и оба не доказаны. Пока компании во Владивостоке и на Дальнем Востоке присматриваются к агентам, производители железа уже решают, как кормить их вычислениями.