OpenAI объявила о снижении цен на две модели из серии GPT-5.6. Luna, самая младшая и быстрая, подешевела на 80%: с 7 до 1,40 доллара за миллион токенов (вход плюс выход). Terra, средняя, - на 20%, до 14 долларов. Для флагмана Sol появился платный Fast-режим с двойной пропускной способностью.

Решение укладывается в общий тренд. Несколько дней назад Anthropic выпустила Claude Opus 5 по цене Opus 4.8, а Google выкатила Gemini 3.6 Flash и 3.5 Flash-Lite с упором на дешёвый инференс и экономию токенов. OpenAI отвечает прямым срезом цен и скоростью.

Сам Альтман объявил об изменениях в X коротко: «Крупное снижение цен сегодня».

Новые цены OpenAI (за миллион токенов, вход + выход):

  • Luna: 0,20 + 1,20 = 1,40 доллара (было 7)
  • Terra: 2 + 12 = 14 долларов (было 17,50)
  • Sol Standard: 5 + 30 = 35 долларов (без изменений)
  • Sol Fast: 10 + 60 = 70 долларов, до 2,5 раза больше пропускной способности
  • Конкуренты: Gemini 3.5 Flash-Lite 2,80, Gemini 3.6 Flash 9 долларов

Luna ушла в бюджетный сегмент

Когда OpenAI выводила серию GPT-5.6, Luna стоила 1 доллар за миллион входных токенов и 6 долларов за выходные, вместе 7. Теперь полная цена 1,40 доллара. Это ниже, чем у Gemini 3.5 Flash-Lite (2,80 доллара), и намного ниже Gemini 3.6 Flash (9 долларов). Свои же GPT-5.4 и Terra Luna обходит с большим отрывом.

Самой дешёвой на рынке она всё равно не стала. Xiaomi MiMo-V2.5 Flash стоит 0,40 доллара за миллион токенов, flash-модель DeepSeek - 0,42. Но теперь фронтьерная модель OpenAI играет в том же сегменте, где раньше жили только маленькие модели от Google, Xiaomi, DeepSeek и MiniMax.

Terra после среза на 20% вышла на 14 долларов и сравнялась с Gemini 3.1 Pro Preview. Заодно она в 13 раз дешевле собственной GPT-5.4 при той же производительности, на что обратил внимание Ник Данз из Krea AI.

Sol Fast ушёл в другую сторону: 70 долларов за миллион токенов, самая дорогая конфигурация на рынке. OpenAI сознательно берёт премию за низкую задержку, а не снижает базовую цену флагмана. Fast-режим даёт до 2,5 раза больше пропускной способности без изменения самой модели.

Три стратегии против одной метрики

Google сделала ставку на экономику агентов: меньше токенов, меньше шагов рассуждения, меньше вызовов инструментов. По данным Artificial Analysis, Gemini 3.6 Flash тратит на 17% меньше выходных токенов, чем 3.5 Flash, а на длинных инженерных задачах экономия доходит до 65%.

Anthropic пошла другим путём: Opus 5 стоит как Opus 4.8 (5 долларов за вход, 25 за выход), но заметно умнее. Плюс появилась регулировка усилий - разработчик сам решает, сколько тратить на рассуждение.

OpenAI режет цену токена напрямую. Стартап Cognition прокомментировал: GPT-5.6 «сидит на кривой цена/производительность», и модели серии ушли в зону лучшего соотношения интеллекта и цены на рынке.

Все три подхода бьют в одну метрику: полную стоимость производственной задачи, а не цену отдельного токена. Это важный сдвиг: провайдеры больше не соревнуются за доступ к моделям, они соревнуются за экономику их работы.

Что это значит для бизнеса

Снижение цен на API напрямую удешевляет автоматизацию бизнеса. То, что месяц назад выглядело дорогим экспериментом, теперь укладывается в операционные бюджеты. Особенно заметна разница в высоконагруженных задачах: кодинг-агенты, обработка документов, внутренний поиск, автоматизированные процессы.

Для компаний во Владивостоке и на Дальнем Востоке это повод пересчитать экономику проектов. Внедрение искусственного интеллекта стало доступнее, а автоматизация бизнеса с помощью ИИ в задачах с большим объёмом токенов теперь сходится по деньгам быстрее.

Считать при этом надо полную стоимость задачи: токены плюс время плюс доработки. OpenAI режет цену токена, Google - число токенов, Anthropic - цену за единицу способности. Выигрывает тот, кто считает по своей метрике, а не по рекламному прайсу.