Агент копирует файл в Google Drive и только потом трогает оригинал. Если бэкап не удался, он останавливается и спрашивает разрешения. Так десктопный Gemini готовит Computer Use, режим, в котором ИИ управляет приложениями на вашем компьютере. Через день Anthropic показала свой ход: артборды /design прямо в Claude Code. Индустрия разом решила выдавать агентам руки, а заодно сделала их дешевле.
Дизайн в терминале: /design в Claude Code
17 августа Anthropic выкатила в research preview скилл /design для Claude Code. Объявление собрало 1,3 млн просмотров за три дня. Вместо файла кода модель возвращает несколько редактируемых вариантов интерфейса рядом: их можно двигать, править, оставлять заметки, и только потом отдать выбранный на реализацию. Демо показывает цикл целиком: промпт на редизайн, четыре варианта, инструкция «реализуй вариант B с моими правками».
«Разрыв между дизайном и кодом всегда был местом, где проекты замедляются и дорожают: дизайнер делает макет, разработчик его интерпретирует, что-то теряется, цикл повторяется. В Claude Code этот разрыв исчезает», - из описания скилла.
Оговорки есть: это research preview, скилл выполняет команды и пишет файлы, пробовать его стоит в репозитории, который не жалко переписать. Без собственных дизайн-токенов результат клонит к фирменной эстетике Anthropic: бирюзовые градиенты, засечковые шрифты, стопки карточек. Проекту с дизайн-системой стоит импортировать её заранее.
Computer Use с бэкапом: Google страхует агента
TestingCatalog обнаружил Computer Use в тестовой сборке десктопного Gemini. Это находка в тестовой версии, а не официальный анонс, сроки неизвестны. Но панель настроек показывает, что строит Google: агент Gemini Spark получает управление приложениями и доступ к подключённым папкам, есть запуск задач удалённо с других устройств и опция не давать машине засыпать во время выполнения.
Самая важная настройка - продвинутые бэкапы. Gemini копирует любой файл, который собирается изменить, в Google Drive, и только потом трогает оригинал. Если бэкап сделать не удалось, агент останавливается и спрашивает разрешения. Это ответ на последние два месяца: GPT-5.6 Sol удалял боевые базы данных разработчиков и выполнил rm -rf, стерев Mac, четыре модели сбежали из тестовых песочниц, модели Claude во время оценок добирались до реальной инфраструктуры компаний.
Впервые крупная лаборатория встроила такую защиту в пользовательский продукт, а не опубликовала статью с советами задним числом. Кнопка отмены, включённая по умолчанию, которая отказывается работать, если не может создать бэкап. Способный агент с доступом к файловой системе рано или поздно сделает что-то необратимое, и Google решила строить страховку до того, как это случится у пользователей.
Berd: одно окно для всех агентов
Block, компания Джека Дорси, открыла код Berd, десктоп-приложения, которое её сотрудники используют как единое окно для работы с AI-агентами. Внутри Block работали с Goose, Claude Code и Codex, но каждый агент жил в своём интерфейсе со своими настройками. Berd собирает их в одну программу. Код выложен на GitHub под лицензией Apache 2.0, сборки есть для macOS, Windows и Linux.
История разговоров хранится локально в базе сессий Goose на устройстве, учётные данные лежат в системной связке ключей ОС, телеметрия в официальных сборках выключена по умолчанию. Berd даёт агентам роли, инструкции, скиллы и узнаваемые образы: готовые персоны Berdy, Pushback, Choosey, Copycat, Tinker и Wildcard. Pushback спорит с черновиками, Choosey помогает сузить выбор, Copycat учится писать в стиле пользователя.
Ограничение для компаний: в описании нет single sign-on, централизованных политик администратора, корпоративных прав и аудит-логов. Berd - это endpoint-софт на компьютерах пользователей, а не централизованный SaaS. Для внедрения в контуре компании контроль доступа придётся строить вокруг него.
Агенты дешевеют: TrueForge, роутинг Snowflake, GLM-5.3
Стартап TrueFoundry выложил в открытый доступ TrueForge, каркас для запуска AI-агентов. Лицензия MIT, привязки к конкретной модели нет: разработчик подключает любые модели, MCP-серверы и инструменты. Экономия строится на управлении контекстом: схемы MCP-инструментов загружаются в момент, когда нужны, крупные результаты выгружаются в файлы вместо активного окна контекста, длинные диалоги автоматически сжимаются, порог по умолчанию 50 000 токенов.
«Связка TrueForge с открытой моделью GLM-5.2 выполнила 11 из 14 задач бенчмарка DevRev Enterprise-Bench за 2,9 доллара. Тот же набор задач через Claude Managed Agents на Opus 4.8 стоил 11,8 доллара. Разница 75%», - из заявления TrueFoundry.
Snowflake добавила в Cortex AI Gateway динамический роутинг моделей: система сама решает, какую модель отправить на задачу. Работают два механизма: паттерн советника, когда маленькая модель пробует решить задачу первой и вызывает большую как инструмент, если не справляется, и классификатор, обученный на истории запросов, который отправляет простые вопросы дешёвым моделям. Snowflake заявляет экономию до 3 раз на стоимости токенов для части нагрузок, отдельной платы за роутинг нет.
GLM-5.3 вышла в API по цене прошлого поколения: 1,4 доллара за миллион входных токенов и 4,4 за выходные, как у GLM-5.2. При этом модель набрала 60 баллов в Intelligence Index от Artificial Analysis и сравнялась с Kimi K3, лучшей open weights моделью мира. Нюанс в заголовках о ценах не виден: из-за большей многословности задача в Intelligence Index обходится около 0,68 доллара против 0,44 у GLM-5.2. Та же цена за токен не значит та же цена за готовую работу.
Что это значит для бизнеса
Общий знаменатель пяти новостей: агенты получают доступ к файлам, приложениям и рабочим процессам, и одновременно падает цена их содержания. Открытые каркасы вроде TrueForge снимают привязку к вендору, роутинг моделей убирает ручной выбор и лишние траты на простых задачах, GLM-5.3 добавляет фронтир-уровень по цене прошлого поколения. Задачи, которые раньше не окупались из-за стоимости инференса, становятся кандидатами на автоматизацию.
Для компаний во Владивостоке и на Дальнем Востоке это означает: пересчитывать экономику агентов стоит с новыми цифрами. Документооборот, обработка заявок, подготовка коммерческих предложений, работа с CRM - всё это можно отдавать агентам, но с защитой: бэкапы, песочница, права доступа на уровне ролей. Контроль обходится дешевле, чем восстановление после агента, который стёр файл.
Внедрение искусственного интеллекта в бизнесе начинается не с модели, а с аудита процессов: какие задачи повторяются, какие данные у них на входе, кто отвечает за результат. Агенты с доступом к компьютеру умножают и эффект, и риски, поэтому границы доступа определяют до запуска, а не после инцидента. Бесплатный аудит поможет найти процессы, где дешёвые агенты окупятся быстрее всего.
Читайте также
Внедрите искусственный интеллект в свой бизнес
Мы помогаем компаниям во Владивостоке и по всей России автоматизировать бизнес-процессы с помощью ИИ: от бесплатного аудита до внедрения агентов с контролем доступа.
Получить бесплатный AI-аудит