
Meta є останнім технологічним гігантом, який випустив агент кодування, змагаючись з провідними гігантами штучного інтелекту Anthropic та OpenAI.
"Ми раді випустити Muse Code (бета), термінальний агент кодування на базі Muse Spark 1.2, нашої новітньої моделі", — написала компанія в офіційному оголошенні. "Це наш наступний крок до передових рубежів, з більшими та значно потужнішими моделями, що вже на підході".
Як агентний інструмент кодування, Muse Code створений для розробки програмного забезпечення у великих репозиторіях. За даними Meta, він "бере на себе складні завдання з розробки програмного забезпечення у великих репозиторіях: планування змін, написання коду та перевірка результатів. Він може координувати декілька постійних підагентів для кожного завдання, вирішуючи складні проблеми швидше, точніше та з меншим втручанням".
Деталь, яка виділяється, – це середовище виконання. Muse Code записує кожен виклик моделі, запуск інструменту, схвалення та редагування до локального журналу подій, який діє як єдине джерело істини. "Це єдине джерело істини робить середовище виконання точним для відтворення та стійким до перезапуску: після збою агент може відновити роботу точно там, де він зупинився", — заявила Meta. Для тривалих завдань саме ця функція є важливішою, ніж чиста швидкість — і це та частина, яку конкуренти не зробили своєю перевагою.
Він також постачається зі стандартними навичками. Команда "/plan" перетворює завдання на план, що вимагає схвалення, тоді як "/grill" проводить стрес-тести цього плану, доки він не витримає, а "/goal" працює над успішним завершенням мети, подібно до того, як це робить Hermes. Meta заявила, що вона спільно навчала Muse Spark 1.2 з Muse Code, щоб основна LLM та агент працювали разом у синергії.
Muse Spark 1.2 – це оновлення Muse Spark 1.1, орієнтоване на кодування. Meta заявила, що "значно збільшила обчислювальні ресурси для навчання на завданнях кодування, розширивши різноманітність середовищ навчання, що призвело до покращення генерації коду, складного налагодження та наскрізних робочих процесів розробників". Діаграми чітко показують це.
На Terminal-Bench 2.1 Muse Spark 1.2 з Muse Code набрав 82,9%, поступаючись Claude Code на Opus 5 з 86,7%, але випереджаючи GPT-5.6 Terra на Codex (81,8%) та Grok Build (81,6%).
DeepSWE 1.1, який вимірює можливості агентного кодування, показав ближчі результати: 59,3% для Muse проти 65,0% для Opus 5 та 64,8% для Codex. На внутрішньому тесті кодування Meta, Muse досяг 70,6% проти 79,4% у Opus 5.
Діаграми прискорення змінюють порядок. За понад 1000 викликів інструментів, Opus 5 показав найбільший приріст порівняно з базовим рівнем (близько 74–75%), а Muse Spark 1.2 був у середині з приблизно 61–69% залежно від запуску. Мета Meta полягає в тому, що агент продовжує покращуватися в міру накопичення викликів інструментів, що є бажаною поведінкою для кодера, що працює над довгостроковими завданнями.
Найцікавішими демонстраціями є довгострокові та мультимодальні. Під час стрес-тестування Meta заявила, що Muse Code "ітеративно оптимізував ядра GPU за понад 1000 викликів інструментів (до 24 годин) на GPU Nvidia Hopper". Це означає, що він зміг покращуватися з часом.
Також є аспект візуального кодування. В одній демонстрації користувач завантажує в термінал відео прольоту будинку у форматі mp4, а Muse Code "інтерпретує відео та створює візуально насичений веб-сайт з можливостями бронювання". Перетворення необробленого відео в працюючий веб-додаток – це мультимодальна пропозиція, яку Meta робить для всієї лінійки Muse.
Дивіться тему запуску:
Here’s an example of Muse Code’s multimodal visual coding capabilities. In this demo, the user inputs a fly-through video of a home into the terminal as an mp4 file. Muse Code interprets the video and produces a visually rich website with booking capabilities. pic.twitter.com/3CAfIMYmAB
— AI at Meta (@AIatMeta) August 5, 2026
Втім, Meta запізнилася на боротьбу. Codex від OpenAI вже запускає паралельні хмарні агенти; DeepSeek створила власного конкурента Claude Code, а агентні інструменти, такі як Hermes або OpenClaw, вже є хорошими замінниками з більшими можливостями. Перевагою Muse Code є стійке до збоїв середовище виконання та дизайн підагентів, а не перевага в бенчмарках.
Ризик є звичайним для агентного кодування: агент, який відновлює роботу після збою та продовжує викликати інструменти протягом 24 годин, є потужним, але непередбачуваним. Meta робить ставку на те, що розробники хочуть такої автономності, і випускає його зараз.
Muse Code доступний для тестування після встановлення, ввівши таку команду:
curl -fsSL https://dev.meta.ai/install.sh | bash





