Кратко

  • Meta выпустила Muse Code (бета), терминального кодинг-агента на базе Muse Spark 1.2, своей обновлённой модели для кодинга. Он доступен уже сейчас через Meta Model API и установочный скрипт curl.
  • Агент координирует постоянные фоновые субагенты и ведёт журнал событий с точным воспроизведением, так что после сбоя он возобновляет работу ровно с того места, где остановился.
  • На собственных графиках Meta Muse Spark 1.2 уступает Opus 5 от Anthropic по всем показанным бенчмаркам кодинга, но превосходит Codex от OpenAI и Antigravity от Google по большинству из них.

Meta — последний технологический гигант, выпустивший кодинг-агента, в гонке за конкуренцию с ведущими ИИ-гигантами Anthropic и OpenAI.

«Мы рады выпустить Muse Code (бета), терминального кодинг-агента на базе Muse Spark 1.2, нашей новейшей модели», — написали в компании в официальном анонсе. «Это наш следующий шаг к передовому рубежу, с более крупными и гораздо более capable моделями на подходе».

Как агентный инструмент для кодинга, Muse Code создан для разработки ПО в больших репозиториях. По словам Meta, он «берёт на себя сложные задачи разработки ПО в больших репозиториях: планирование изменений, написание кода и проверку результатов. Он может координировать несколько постоянных субагентов для каждой задачи, решая сложные проблемы быстрее, точнее и с меньшим вмешательством».

Деталь, которая выделяется, — это среда выполнения. Muse Code записывает каждый вызов модели, запуск инструмента, одобрение и правку в локальный журнал событий, который служит единственным источником истины. «Этот единый источник истины делает среду выполнения точно воспроизводимой и безопасной для перезапуска: после сбоя агент может возобновить работу точно с того места, где остановился», — сказали в Meta. Для длительных задач это функция, которая важнее сырой скорости — и это та часть, которую конкуренты не сделали своим преимуществом.

Он также поставляется с навыками по умолчанию. Команда "/plan" превращает задачу в план с одобрением, а "/grill" проверяет этот план на прочность, пока он не выдержит, и "/goal" работает над успешным достижением цели, аналогично тому, что делает Hermes. Meta заявила, что обучала Muse Spark 1.2 совместно с Muse Code, чтобы основная LLM и агент работали в синергии.

Бенчмарки и подвох

Muse Spark 1.2 — это обновление Muse Spark 1.1, ориентированное на кодинг. Meta сообщила, что она «значительно увеличила вычислительные мощности для обучения на задачах кодинга, расширив разнообразие среды обучения, что дало улучшения в генерации кода, сложной отладке и сквозных рабочих процессах разработчика». Графики говорят ясно.

На Terminal-Bench 2.1 Muse Spark 1.2 с Muse Code набрал 82,9%, уступив Claude Code на Opus 5 с 86,7%, но опередив GPT-5.6 Terra на Codex (81,8%) и Grok Build (81,6%).

DeepSWE 1.1, который измеряет возможности агентного кодирования, был ближе: 59,3% для Muse против 65,0% для Opus 5 и 64,8% для Codex. На внутреннем бенчмарке кодирования Meta Muse достиг 70,6% против 79,4% у Opus 5.

Графики ускорения меняют порядок. При более чем 1000 вызовах инструментов Opus 5 показал наибольший прирост по сравнению с базовым уровнем (около 74–75%), а Muse Spark 1.2 оказался в середине с примерно 61–69% в зависимости от запуска. Meta утверждает, что агент продолжает улучшаться по мере накопления вызовов инструментов — это поведение, которое вы ожидаете от кодера с длинным горизонтом.

Самые интересные демонстрации — это длинные горизонты и мультимодальность. В ходе стресс-тестирования Meta заявила, что Muse Code «итеративно оптимизировал GPU-ядра на более чем 1000 вызовах инструментов (до 24 часов) на GPU Nvidia Hopper». Это означает, что он мог улучшаться со временем.

Есть также аспект визуального кодирования. В одной демонстрации пользователь загружает в терминал видеооблет дома в формате mp4, и Muse Code «интерпретирует видео и создает визуально насыщенный веб-сайт с возможностью бронирования». Чтение необработанного видео в работающее веб-приложение — это мультимодальная концепция, которую Meta продвигает во всей линейке Muse.

Смотрите ветку запуска:

Поле уже переполнено

Тем не менее, Meta опоздала на битву. Codex от OpenAI уже запускает параллельные облачные агенты; DeepSeek создал собственного конкурента Claude Code, а агентные инструменты, такие как Hermes или OpenClaw, уже являются хорошими заменами с большими возможностями. Преимущество Muse Code — это безопасная от сбоев среда выполнения и дизайн субагентов, а не превосходство в бенчмарках.

Риск для агентного кодирования обычный: агент, который возобновляет работу после сбоя и продолжает вызывать инструменты в течение 24 часов, является мощным и непредсказуемым. Meta делает ставку на то, что разработчики хотят такой автономии, и она уже доступна.

Muse Code доступен для тестирования после установки, введя эту команду:
curl -fsSL https://dev.meta.ai/install.sh | bash