Вчера Sakana AI запустила Fugu - мультиагентную оркестрационную систему, которая выдаёт результат уровня топовых AI-моделей через один OpenAI-совместимый API. И сделала это в самый подходящий момент: 12 июня Anthropic по требованию правительства США отозвала публичный доступ к Claude Mythos 5 и Claude Fable 5. Fugu обходит Fable 5 на LiveCodeBench (93.2 против 89.8), хотя в его пуле нет самой Fable - она недоступна из-за экспортного контроля.
Fugu (по-японски «рыба-фугу») построен на идее, которую CEO Sakana Дэвид Ха (бывший Google Brain) сформулировал так: «Полагаться на модель одной компании для национальной инфраструктуры - огромный риск. Как показали недавние экспортные ограничения, доступ к топ-моделям может исчезнуть за ночь. Коллективный интеллект - практическая страховка от этой концентрации власти».
«Fugu динамически оркестрирует лучшие модели мира для сложных задач. Мы доказываем, что хорошо организованный пул сменяемых агентов может сравниться с ограниченными frontier-моделями вроде Fable и Mythos»
Ключевые цифры Fugu
- 93.2 - Fugu Ultra на LiveCodeBench против 89.8 у Claude Fable 5
- 95.5 - Fugu на GPQA-D (Diamond) против 94.6 у Claude Mythos Preview
- 73.7 - Fugu Ultra на SWE-Bench Pro против 58.6 у GPT-5.5
- 5 долларов - цена Fugu Ultra за 1M входных токенов (против 10 у Fable 5)
Как работает Fugu
Fugu не пытается выполнить всё сам. Он разбивает задачу, делегирует подзадачи пулу экспертных foundation-моделей, проверяет их работу и синтезирует финальный результат. И да, Fugu - это сам по себе LLM, обученный вызывать другие LLM, включая самого себя рекурсивно.
Система построена на двух исследовательских работах Sakana 2026 года: TRINITY и Conductor. Она автономно управляет жизненным циклом выбора моделей и верификации, используя обученные стратегии координации - не хардкодные воркфлоу. Для конечного пользователя весь этот мультиагентный рой полностью абстрагирован за стандартным API-ендпоинтом.
Два варианта: Fugu и Fugu Ultra
Sakana предлагает две версии. Fugu - высокоскоростная, с низкой задержкой. Оптимизирована для повседневных задач, чат-ботов и сред разработки вроде Codex. Fugu Ultra - флагманский уровень для сложных задач: AI-исследования, кибербезопасность, многошаговые патентные расследования. В Fugu Ultra пул экспертов глубже, и, по заявлению Sakana, он сравнивается с лидирующими монолитными моделями на научных бенчмарках.
Цены: стандартный Fugu - динамическая ставка на основе конкретных моделей, Fugu Ultra - фиксированная: 5 долларов за миллион входных токенов, 30 долларов за миллион выходных. Для сравнения: Claude Fable 5 стоит 10/50 долларов соответственно.
Где Fugu выигрывает, а где - нет
На тестах кодинга и агентных задач коллективный интеллект показывает преимущество. SWE-Bench Pro: Fugu Ultra (73.7) значительно обходит Claude Opus 4.8 (69.2) и GPT-5.5 (58.6). Но на узких задачах, где нужна «грубая сила» одной модели, Fugu иногда отстаёт. На SWE-Bench Pro Fable 5 (80.0) всё ещё впереди - но Fable сейчас недоступна из-за экспортного контроля. Humanity's Last Exam: Fugu Ultra (50.0) едва обходит Opus 4.8 (49.8), но уступает Fable 5 (53.3).
Стоит отметить: Fugu не серебряная пуля. Он не доступен в ЕС и ЕЭЗ, пока Sakana не приведёт свою чёрную коробку маршрутизации в соответствие с GDPR. Фактически, единственный регион, где Fugu можно использовать для enterprise-задач, - это США, Азия и остальной мир без ЕС.
Практическое сравнение: Fugu против Claude Opus 4.8
Владелец креативного агентства Mark Santos (@markksantos) провёл тест: попросил Fugu Ultra и Claude Opus 4.8 написать клон игры Crossy Road на Three.js. Результаты показательны. Fugu Ultra справился за 22 минуты, используя около 89 000 токенов (примерно 7,32 доллара). Финальная игра страдала от мелких логических ошибок - перевёрнутые повороты, странные углы камеры. Claude Opus 4.8 потратил 79 минут, сжёг около 940 000 токенов (почти 38 долларов) и застрял в цикле повторных попыток, потребовав вмешательства человека. Но результат по качеству и функциональности был выше.
Вывод Сантоса: «По функциональности, качеству и дизайну Opus выиграл. По скорости и стоимости - Fugu».
Что это значит для бизнеса
Fugu - это ответ на проблему, которую Anthropic создала 12 июня, когда отозвала Claude Fable 5. Если ваш бизнес полагается на единственного провайдера AI-моделей, вы рискуете остаться без доступа за ночь. Оркестраторы вроде Fugu - коммерческая страховка. Они не просто маршрутизируют запросы, а динамически распределяют нагрузку между пулом моделей.
Для компаний во Владивостоке и на Дальнем Востоке, которые задумываются об автоматизации с помощью ИИ, урок прост: будущее не за одной моделью, а за их оркестрацией. Внедрение искусственного интеллекта в бизнес-процессы должно учитывать, что доступ к конкретной модели может измениться. Гибкость и вендор-независимость - не опция, а требование к архитектуре.
Open source модели, open weights модели и коммерческие API - всё это кирпичики, из которых можно собрать устойчивую AI-инфраструктуру. Fugu показывает, как это сделать за один API-ендпоинт.