24 июля Anthropic выпустила Opus 5 - четвёртую модель компании за два месяца. Цены те же, что у Opus 4.8: 5 долларов за миллион входных токенов и 25 долларов за миллион выходных. Но ключевое в другом: Anthropic не утверждает, что это их самая умная модель. Fable 5 всё ещё держит этот титул. Компания заявляет, что Opus 5 приближается к Fable 5 вдвое дешевле. И что это важнее.
Claude Opus 5 уже работает на всех платформах Anthropic и доступен как claude-opus-5 через API. Это новая модель по умолчанию на Claude Max и самая мощная, до которой могут добраться подписчики Claude Pro. Запуск стал четвёртым релизом компании за полтора месяца после Mythos 5, Fable 5 и Sonnet 5. Весь релиз читается как ставка на то, что гонка AI перестала быть про передний край и стала про то, что можно позволить себе гонять круглые сутки.
Бенчмарки: где Opus 5 обходит Fable 5
Начнём с теста, который Anthropic ставит на первое место. Frontier-Bench v0.1 - агентный бенчмарк терминального кодинга. Opus 5 набрал 43,3%. Opus 4.8 набирал 18,7%. Это больше чем вдвое. И это выше Fable 5 с его 33,7% - при меньшей стоимости за задачу.
Frontier-Bench v0.1: Opus 5 - 43,3%\nOpus 4.8 - 18,7% (выше вдвое)\nFable 5 - 33,7% (Opus 5 выше при меньшей цене)
Остальные цифры подтверждают картину. На ARC-AGI 3 - тесте, который проверяет, как модель решает задачи, которых не видела раньше - Opus 5 набрал втрое больше любой другой модели. На OSWorld 2.0 (тест на умение работать с компьютером) он бьёт лучший результат Fable 5, тратя чуть больше трети его стоимости. На CursorBench 3.2 на максимальном усилии отстаёт от пика Fable 5 меньше чем на полпроцента - снова вдвое дешевле за задачу.
Ключевой факт: единственная область, где Opus 5 не лидирует - кибербезопасность. Там впереди Mythos 5. И это сделано намеренно: Anthropic сознательно не обучала Opus 5 на кибер-задачах.
Новый элемент управления - настройка effort. Можно переключать модель между низким, средним и высоким уровнем, меняя интеллект на скорость и расход токенов. Anthropic строит свои графики вокруг производительности при заданной стоимости, а не вокруг пиковой производительности. Это честно показывает, как компания хочет, чтобы модель оценивали.
Opus 5 построил Minecraft и обошёл Fable 5
Самые убедительные доказательства пришли не из лаборатории Anthropic, а от разработчиков, которые тестировали модель до официального анонса. Opus 5 утёк раньше времени, появившись в Cursor и в каталоге Google Vertex. Разработчики несколько дней гоняли его, пока Anthropic молчала.
Демо, которое разлетелось быстрее всего, сделал @xikhar: модель построила реплику Minecraft. Блоки разбивались с правильной физикой, свет отбрасывал реальные тени на поверхности. Затем он сделал SVG-контроллер PS5, где отражения на джойстиках и тачпаде выглядели ближе к промо-рендеру, чем к векторной графике.
Разработчик @chetaslua дал одинаковый промпт (рогатка, запускающая снаряды в городскую стену) Opus 5 и Fable 5. Fable 5 сделал цельную сцену за один проход, но с деталями вышло хуже: палатки отрисовались плоскими цветными блоками, трава колыхаться отказалась, панели параметров натяжения и веса стрелы пропали. Opus 5 сохранил всё. Он сказал, что никогда не видел такого уровня детализации от модели Opus. Некоторые тестеры в шутку назвали это Fable 6.
Честный разбор: методология, нюансы и механизм fallback
Каждая цифра выше - от Anthropic. Независимой верификации пока нет. Детали методологии важнее обычного. В тестах Frontier-Bench, когда классификатор безопасности отказывал Opus 5 или Fable 5, запрос падал на Opus 4.8. То есть headline-сравнение включает помощь другой модели. Anthropic раскрыла это, а не спрятала - это плюс, но деталь, которая меняет то, как читать таблицу.
В этом же механизме спрятана полезная фича. Когда Opus 5 отклоняет запрос по соображениям безопасности, API молча переключается на другую модель, чтобы вы получили ответ, а не ошибку. Полезно в продакшне. И немного странно: классификатор, а не вы решаете, какая модель отвечает на ваш запрос. Anthropic говорит, что защиты Opus 5 совпадают с Opus 4.8 в большинстве областей, с усилением на кибербезопасности.
Что это значит для бизнеса
Посмотрите, что произошло за месяц. OpenAI строила презентацию GPT-5.6 вокруг эффективности токенов. Anthropic запускает флагман, чья главная фича - делать вдвое больше работы за те же деньги. Китайские лаборатории выкатывают open-weight модели с производительностью, близкой к переднему краю, за десятую часть западных цен. Никто больше не пытается выиграть спор сырой мощностью. Все выигрывают стоимостью за выполненную задачу.
Для компаний, которые реально внедряют AI, этот сдвиг - хорошие новости. Вопрос больше не в том, можете ли вы позволить себе лучшую модель. Вопрос в том, какая модель закончит вашу конкретную задачу за наименьшие деньги. А это вопрос, на который можно ответить только своими тестами.
Для бизнеса во Владивостоке и на Дальнем Востоке это снижает порог входа. Нейросети для бизнеса становятся доступнее, а возврат на инвестиции - быстрее. Внедрение искусственного интеллекта теперь не требует подписки на самый дорогой API. Opus 5 даёт почти флагманский уровень за вдвое меньший чек. Если ваша компания откладывала автоматизацию с помощью ИИ из-за стоимости API - сейчас время пересчитать.
Anthropic подала заявку на IPO в июне. Барабан эффективности будет бить только громче.