OpenAI анонсировала семейство GPT-5.6 - три модели вместо одной: Sol, Terra и Luna. Sol обходит Claude Mythos 5 на TerminalBench (91,91%), Terra держит баланс цены и качества, а Luna стоит всего 1 доллар за миллион входных токенов. Но есть нюанс: доступ к моделям пока получили только 20 организаций - по требованию правительства США.
26 июня OpenAI объявила о запуске ограниченного предварительного доступа к новому семейству фронтьерных моделей GPT-5.6. В нём три варианта, каждый под свои задачи.
Sol - для самых сложных проблем: комплексный кодинг, исследования в области безопасности, продвинутые агентские рабочие процессы. Terra - для высоконагруженных бизнес-задач: поддержка клиентов, внутренние инструменты, анализ документов. Luna - для быстрой и дешёвой повседневной работы: суммаризация, черновики, рутинная автоматизация.
Пока модели доступны узкому кругу из примерно 20 организаций. OpenAI согласовала планы релиза с правительством США, следуя указу президента Трампа от 2 июня 2026 года о бенчмаркинге и оценке безопасности новых AI-моделей. Полноценный релиз обещают «в ближайшие недели».
Sol, Terra, Luna: чем отличаются
Новая система наименований уходит от «nano» и «mini», которые OpenAI использовала для GPT-5. По словам источников, модели не так уж различаются по размеру или сырому интеллекту - они просто спроектированы под разные сценарии использования.
- Sol - флагман. 5 долларов / 30 долларов за млн токенов (in/out). TerminalBench 2.1: 91,91% (ультра-режим). Agents Last Exam: 50,9% (code mode).
- Terra - бизнес-уровень. 2,50 долларов / 15 долларов за млн токенов. Надёжные результаты в промышленных масштабах.
- Luna - лёгкая и быстрая. 1 доллар / 6 долларов за млн токенов. Производительность на уровне GPT-5.5 на многих тестах.
OpenAI классифицирует все три модели - не только Sol - как «высокий» уровень риска для кибер- и биолого-химических возможностей. Это значит, что даже дешёвые Luna и Terra несут новые регуляторные обязательства для компаний, использующих их в чувствительных сценариях.
Технические изменения: глубже, быстрее, с субагентами
Ключевое изменение в GPT-5.6 - модели дают больше времени и структуры для сложных задач во время инференса. OpenAI добавила новый максимальный режим рассуждения для Sol - ultra mode, который использует субагентов для разделения и ускорения сложных проектов.
На TerminalBench 2.1 (тест командной строки) Sol в ультра-режиме набрал 91,91% - выше, чем Claude Mythos 5 (88%) и GPT-5.5 (83,4%). На Agent's Last Exam Sol - единственная модель, преодолевшая отметку в 50% выполнения задач (50,9% в code mode). Даже лёгкая Luna чуть обогнала флагман предыдущего поколения.
Предиктивное кеширование и Cerebras
GPT-5.6 API вводит обновлённый протокол кеширования промптов. Разработчики могут устанавливать явные точки кеш-брейка с гарантированным минимальным временем жизни кеша в 30 минут. Первая запись кеша стоит 1,25x стандартной ставки, последующие чтения - со скидкой 90%.
Кроме того, с июля GPT-5.6 Sol запускается на оборудовании Cerebras - до 750 токенов в секунду. Это критично для приложений реального времени, где latency - главный барьер.
Безопасность: тройной контроль и ложные срабатывания
Openai потратила около 700 000 A100e GPU-часов только на автоматический red-teaming GPT-5.6. Компания внедрила многоуровневый стек защиты, работающий в реальном времени:
- Отказы на уровне модели - GPT-5.6 отклоняет запрещённые киберзапросы, включая попытки jailbreak
- Мониторинг в реальном времени - отдельные детекторы проверяют генерации на кибер- и биологические риски
- Экран на основе активаций - для Sol и Terra мониторинг внутренних сигналов модели во время инференса, поток может быть приостановлен
Важный момент: OpenAI признаёт ложные срабатывания. Легитимная защитная работа (code review, поиск уязвимостей) использует те же примитивы, что и атаки. Постоянные срабатывания могут запустить автоматическую проверку аккаунта - компания уже ведёт переговоры о контролируемых клиентом отключениях защиты.
Геополитика релиза
Openai не скрывает напряжения в официальном анонсе: «Мы не считаем, что такой процесс государственного контроля должен стать долгосрочным стандартом. Он не даёт лучшим инструментам добраться до пользователей, разработчиков, предприятий и глобальных партнёров, которые в них нуждаются».
Тем не менее, решение ограничить доступ продиктовано прямым указом: после того как правительство США ввело экспортный контроль против Anthropic (из-за jailbreak'ов Claude Fable 5), OpenAI решила не рисковать.
Что это значит для бизнеса
Для предприятий, которые выбирают новости openai и новости chatgpt, картина двойственная. С одной стороны, новые модели Sol и Terra ставят рекорды производительности. С другой - доступ к ним ограничен, а три уровня ценообразования усложняют выбор.
Luna при цене 1 доллар за миллион входных токенов даёт производительность уровня GPT-5.5 на многих задачах - это самый доступный вход в экосистему OpenAI, если не нужны максимальные возможности рассуждения.
Для бизнеса во Владивостоке и на Дальнем Востоке тренд прозрачен: чем больше моделей выходит на рынок с разными ценами, тем легче выбрать оптимальное решение для внедрения нейросетей для бизнеса без переплаты. Внедрение искусственного интеллекта становится доступнее, но регуляторные риски растут.