Google DeepMind выпустила три новых модели, которые меняют экономику AI-агентов. Gemini 3.6 Flash, 3.5 Flash-Lite и 3.5 Flash Cyber потребляют на 17-65% меньше токенов на инженерных задачах по сравнению с предыдущей версией. Flash-Lite стоит от 0,30 долларов за миллион входных токенов и выдаёт 350 токенов в секунду - это вдвое быстрее предшественника.
Заявление Google простое: AI-агенты - это будущее, но они жрут слишком много токенов. Решение - не просто снизить цены, а научить модель тратить меньше вычислительных шагов на ту же задачу. Gemini 3.6 Flash на DeepSWE - бенчмарке длинных инженерных задач - сократила расход токенов на 65% по сравнению с Gemini 3.5 Flash.
Ключевые цифры:
- Gemini 3.6 Flash: 1,50 долларов / 7,50 долларов за млн токенов (вход/выход)
- Gemini 3.5 Flash-Lite: 0,30 долларов / 2,50 долларов - самая быстрая модель Google
- Скорость Flash-Lite: 350 выходных токенов в секунду
- DeepSWE: 49% против 37% у Gemini 3.5 Flash
- MLE-Bench: 63,9% против 49,7%
- Контекст: до 1 млн токенов, выход до 64 000 токенов
Три модели под разные задачи
Google разделила новинки на три продукта. Gemini 3.6 Flash - рабочая лошадка для сложного кода, анализа данных и мультимодальных задач. Модель исполняет миграции кода через мульти-агентную оркестрацию с меньшей задержкой и лучшим качеством, помогает разрабатывать текстурные экстракторы для 3D-пайплайнов.
Gemini 3.5 Flash-Lite заточена на пропускную способность. Она обрабатывает 350 токенов в секунду - вдвое быстрее Gemini 3.1 Flash-Lite. Это выбор для агентного поиска и массовой обработки документов, где важна минимальная задержка. Разработчики могут настроить уровень «мышления»: минимальный для высокообъёмных задач или продвинутый для сложных подзадач.
Gemini 3.5 Flash Cyber - специализированная модель для кибербезопасности. Она работает в связке с агентом Google CodeMender: несколько копий модели параллельно ищут уязвимости и собирают единый отчёт. По бенчмарку CyberGym модель приближается к Mythos от Anthropic - и Google подчёркивает, что цена за токен ниже, чем у более крупных моделей.
Flash-модели Google - как флот экономичных гибридных фургонов вместо прожорливых товарных поездов. Те же перевозки, втрое меньше топлива.
Что стоит за снижением токенов
Если ранние большие языковые модели были похожи на прожорливые товарные поезда, способные тащить невероятные грузы при огромных затратах, то новые Flash-модели - это парк экономичных гибридных фургонов. Экономия достигается не только ценой за токен, но и тем, что модель тратит меньше шагов рассуждения и меньше вызовов инструментов на одну задачу.
Внутренние изменения Google не раскрывает, но в документации модель характеризуется как «требующая меньше шагов рассуждения для многошаговых рабочих процессов» с пониженной «многословностью». Технические характеристики: 1 млн токенов контекста, 64 000 токенов максимум на выход, дата отсечки знаний - март 2026 года.
Где Gemini 3.5 Pro?
В релизе заметно отсутствие флагманской Gemini 3.5 Pro. Предыдущая Pro-модель, Gemini 3.1 Pro, вышла в феврале 2026. С тех пор OpenAI и Anthropic выпустили несколько поколений флагманских обновлений. Инженер Google Логан Килпатрик ответил на X: «Gemini 3.5 Pro сейчас тестируется с партнёрами, мы сделаем её широко доступной, как только она будет готова».
При этом Google подтвердила, что предобучение Gemini 4 уже началось. Анонс намекает: компания делает ставку на эффективность Flash-линейки, пока флагманская модель дозревает.
Что это значит для бизнеса
Для компаний во Владивостоке и на Дальнем Востоке, которые внедряют AI-агентов или автоматизируют бизнес-процессы, новые Flash-модели Google - это прямой путь к снижению затрат. Когда автоматизация бизнес-процессов с помощью AI упирается в стоимость каждого запроса, модель, которая тратит на 65% меньше токенов на ту же задачу, кардинально меняет экономику.
Внедрение искусственного интеллекта перестаёт быть вопросом «достаточно ли у нас бюджета на токены». Flash-Lite по 0,30 долларов за миллион токенов на входе - это уровень, при котором AI-агенты становятся доступны не только корпорациям с миллионными бюджетами, но и среднему бизнесу во Владивостоке.