OpenAI объявила о снижении цен на две модели из серии GPT-5.6. Luna, самая младшая и быстрая, подешевела на 80%: с 7 до 1,40 доллара за миллион токенов (вход плюс выход). Terra, средняя, - на 20%, до 14 долларов. Для флагмана Sol появился платный Fast-режим с двойной пропускной способностью.
Решение укладывается в общий тренд. Несколько дней назад Anthropic выпустила Claude Opus 5 по цене Opus 4.8, а Google выкатила Gemini 3.6 Flash и 3.5 Flash-Lite с упором на дешёвый инференс и экономию токенов. OpenAI отвечает прямым срезом цен и скоростью.
Сам Альтман объявил об изменениях в X коротко: «Крупное снижение цен сегодня».
Новые цены OpenAI (за миллион токенов, вход + выход):
- Luna: 0,20 + 1,20 = 1,40 доллара (было 7)
- Terra: 2 + 12 = 14 долларов (было 17,50)
- Sol Standard: 5 + 30 = 35 долларов (без изменений)
- Sol Fast: 10 + 60 = 70 долларов, до 2,5 раза больше пропускной способности
- Конкуренты: Gemini 3.5 Flash-Lite 2,80, Gemini 3.6 Flash 9 долларов
Luna ушла в бюджетный сегмент
Когда OpenAI выводила серию GPT-5.6, Luna стоила 1 доллар за миллион входных токенов и 6 долларов за выходные, вместе 7. Теперь полная цена 1,40 доллара. Это ниже, чем у Gemini 3.5 Flash-Lite (2,80 доллара), и намного ниже Gemini 3.6 Flash (9 долларов). Свои же GPT-5.4 и Terra Luna обходит с большим отрывом.
Самой дешёвой на рынке она всё равно не стала. Xiaomi MiMo-V2.5 Flash стоит 0,40 доллара за миллион токенов, flash-модель DeepSeek - 0,42. Но теперь фронтьерная модель OpenAI играет в том же сегменте, где раньше жили только маленькие модели от Google, Xiaomi, DeepSeek и MiniMax.
Terra после среза на 20% вышла на 14 долларов и сравнялась с Gemini 3.1 Pro Preview. Заодно она в 13 раз дешевле собственной GPT-5.4 при той же производительности, на что обратил внимание Ник Данз из Krea AI.
Sol Fast ушёл в другую сторону: 70 долларов за миллион токенов, самая дорогая конфигурация на рынке. OpenAI сознательно берёт премию за низкую задержку, а не снижает базовую цену флагмана. Fast-режим даёт до 2,5 раза больше пропускной способности без изменения самой модели.
Три стратегии против одной метрики
Google сделала ставку на экономику агентов: меньше токенов, меньше шагов рассуждения, меньше вызовов инструментов. По данным Artificial Analysis, Gemini 3.6 Flash тратит на 17% меньше выходных токенов, чем 3.5 Flash, а на длинных инженерных задачах экономия доходит до 65%.
Anthropic пошла другим путём: Opus 5 стоит как Opus 4.8 (5 долларов за вход, 25 за выход), но заметно умнее. Плюс появилась регулировка усилий - разработчик сам решает, сколько тратить на рассуждение.
OpenAI режет цену токена напрямую. Стартап Cognition прокомментировал: GPT-5.6 «сидит на кривой цена/производительность», и модели серии ушли в зону лучшего соотношения интеллекта и цены на рынке.
Все три подхода бьют в одну метрику: полную стоимость производственной задачи, а не цену отдельного токена. Это важный сдвиг: провайдеры больше не соревнуются за доступ к моделям, они соревнуются за экономику их работы.
Что это значит для бизнеса
Снижение цен на API напрямую удешевляет автоматизацию бизнеса. То, что месяц назад выглядело дорогим экспериментом, теперь укладывается в операционные бюджеты. Особенно заметна разница в высоконагруженных задачах: кодинг-агенты, обработка документов, внутренний поиск, автоматизированные процессы.
Для компаний во Владивостоке и на Дальнем Востоке это повод пересчитать экономику проектов. Внедрение искусственного интеллекта стало доступнее, а автоматизация бизнеса с помощью ИИ в задачах с большим объёмом токенов теперь сходится по деньгам быстрее.
Считать при этом надо полную стоимость задачи: токены плюс время плюс доработки. OpenAI режет цену токена, Google - число токенов, Anthropic - цену за единицу способности. Выигрывает тот, кто считает по своей метрике, а не по рекламному прайсу.