В среду Anthropic вернула Claude Fable 5 после 18-дневного экспортного запрета. К исходу первого же дня разработчики заметили: показатели кодинга обвалились вдвое. Дебаггинг упал с 86 до 26 баллов, рефакторинг сократился примерно на 50%. Сообщество мгновенно сделало вывод: модель «нерфнули».

На самом деле всё сложнее. Anthropic не ослабляла Fable 5. Она добавила агрессивный классификатор безопасности, который ловит запросы, похожие на те, что привели к блокировке модели правительством США. Когда классификатор срабатывает, Fable 5 просто не отвечает - система перенаправляет запрос на старую модель Opus 4.8 без уведомления пользователя.

Что случилось с Fable 5

  • 86 → 26 баллов - падение дебаггинга по BridgeBench
  • 99%+ - точность блокировки оригинального джейлбрейка
  • Opus 4.8 - модель, которая отвечает вместо Fable 5 при срабатывании фильтра
  • 18 дней - длился экспортный запрет на модель

Как работает новый классификатор

Fable 5 запустили 9 июня. Через три дня Минторг США ввёл экспортные ограничения: исследователи нашли джейлбрейки, способные генерировать эксплойт-код. Anthropic не могла проверять пользователей по странам в реальном времени, поэтому сняла модель по всему миру.

Когда ограничения сняли на этой неделе, у Anthropic была одна задача: чтобы блокировка больше не повторилась. Решение - гораздо более строгий классификатор безопасности перед Fable 5. Компания утверждает, что он блокирует исходную технику джейлбрейка с точностью более 99%. Проблема в том, что он ловит и обычные запросы по кодингу, дебаггингу и безопасности.

«Разработчики думают, что общаются с Fable 5, а во многих задачах по кодингу на самом деле разговаривают с другой моделью», - объясняет ситуацию один из инженеров Anthropic на условиях анонимности.

Поэтому бенчмарки по кодингу рухнули. Флагманская модель не ослабла. Пользователи просто реже до неё доходят.

Новая реальность для frontier AI

Эта ситуация - срез того, что ждёт индустрию. Задача теперь не только в том, чтобы построить самую умную модель, но и в том, чтобы сохранить к ней доступ.

У Anthropic два конкурирующих риска. Ослабишь защиту - регуляторы вмешаются снова. Затянешь слишком сильно - разработчики платят за модель, к которой не могут добраться. Сейчас компания выбрала осторожность.

Этот компромисс касается не только одной компании. По мере того как frontier-модели всё сильнее привязываются к национальной безопасности, качество продукта определяют не только бенчмарки или количество параметров. Его определяют политики безопасности, фильтры и правительственные ограничения вокруг модели.

Самая умная модель в мире мало полезна, если перед каждым запросом вас перенаправляют куда-то ещё.

Важный нюанс: что говорят бенчмарки

Вирусный график, который разошёлся по соцсетям, принадлежит BridgeBench - тестовому набору самого сообщества BridgeMind. Крупные независимые лидерборды вроде LMArena и Artificial Analysis пока не опубликовали свежих оценок после возвращения Fable 5. Это значит, что драматичные цифры - сигнал, а не окончательное доказательство.

Стоит разделить две идеи, которые сейчас смешивают. Когда говорят «нерфнули» - подразумевают, что Anthropic ослабила саму модель. Доказательств этому нет. Каждое сообщение о падении производительности ссылается на новую систему маршрутизации перед моделью, а не на саму модель.

Хотя у сообщества есть причины для скепсиса: когда Fable 5 только запустили в июне, Anthropic уже незаметно снижала её производительность на AI-исследовательских задачах, а потом откатывала изменения после возмущений.

Что это значит для бизнеса

Для компаний, которые уже используют Claude API или планируют внедрение, ситуация с Fable 5 - практический сигнал. Любая новая модель ии, даже самая мощная, может оказаться недоступной в любой момент из-за регуляторных рисков.

Во Владивостоке и на Дальнем Востоке этот тренд особенно важен. Безопасность ии и доступ к frontier-моделям становятся факторами, которые нужно закладывать в стратегию автоматизации бизнеса. Если бизнес строится на одной модели, внезапная блокировка или перенаправление запросов могут нарушить процессы.

Ии в бизнесе новости последних недель показывают: стратегия должна быть мультимодельной. Alibaba с Qwen, DeepSeek с V3, Mistral с Large - все эти модели доступны без экспортных ограничений. Комбинация нескольких моделей снижает регуляторный риск и даёт больше контроля.

Когда Anthropic будет смягчать ложные срабатывания классификатора - пока неясно. Но то, что мы видим сегодня, - это начало эры, где доступ к модели значит не меньше, чем её возможности.