AcasăCentrul de știri LBank
Meta lansează agentul de programare AI Muse: iată cum se compară cu Claude Code și Codex
muse-code-meta-ai-coding-agent-claude-codex
Meta lansează agentul de programare AI Muse: iată cum se compară cu Claude Code și Codex
Noul agent al Meta rulează în terminalul tău, coordonează subagenți și supraviețuiește blocărilor — dar, în benchmarkurile care contează, rămâne în urmă.
2026-08-05 Sursă:decrypt.co

Pe scurt

  • Meta a lansat Muse Code (beta), un agent de codare terminal bazat pe Muse Spark 1.2, modelul său actualizat de codare. Este disponibil acum prin Meta Model API și un script de instalare curl.
  • Agentul coordonează subagenți persistenti în fundal și păstrează un jurnal de evenimente exact pentru reluare, astfel încât o eroare să reia exact de unde s-a oprit.
  • Conform propriilor grafice ale Meta, Muse Spark 1.2 se află în urma Opus 5 de la Anthropic la fiecare benchmark de codare prezentat, în timp ce depășește Codex de la OpenAI și Antigravity de la Google în majoritatea cazurilor.

Meta este cel mai recent gigant tehnologic care a lansat un agent de codare, grăbindu-se să concureze cu giganții AI de top Anthropic și OpenAI.

"Suntem încântați să lansăm Muse Code (beta), un agent de codare terminal bazat pe Muse Spark 1.2, cel mai nou model al nostru", a scris compania într-un anunț oficial. "Acesta marchează următorul nostru pas spre frontieră, cu modele mult mai mari și mai capabile în curs de dezvoltare."

Ca instrument de codare agentic, Muse Code este construit pentru ingineria software pe depozite mari. Conform Meta, acesta "își asumă sarcini complexe de inginerie software pe depozite mari: planificarea modificărilor, scrierea codului și validarea rezultatelor. Poate coordona mai mulți subagenți persistenți pentru fiecare sarcină, rezolvând probleme dificile mai rapid, mai precis și cu mai puțină intervenție."

Detaliul care iese în evidență este timpul de execuție. Muse Code înregistrează fiecare apel de model, rulare de instrument, aprobare și editare într-un jurnal de evenimente local care acționează ca o singură sursă de adevăr. "Această singură sursă de adevăr face timpul de execuție exact pentru reluare și sigur la repornire: după o eroare, agentul poate relua exact de unde s-a oprit", a declarat Meta. Pentru sarcinile de lungă durată, aceasta este caracteristica care contează mai mult decât viteza brută – și este partea pe care concurenții nu au transformat-o într-un punct de vânzare.

De asemenea, vine cu abilități implicite. Comanda "/plan" transformă o sarcină într-un plan cu aprobare, în timp ce "/grill" testează intens planul până când acesta este solid, iar "/goal" lucrează pentru finalizarea cu succes a obiectivului, similar cu ceea ce face Hermes. Meta a declarat că a antrenat Muse Spark 1.2 împreună cu Muse Code, astfel încât LLM-ul de bază și agentul să lucreze împreună în sinergie.

Benchmark-urile, și capcanele

Muse Spark 1.2 este o actualizare axată pe codare a Muse Spark 1.1. Meta a declarat că a "scalată semnificativ calculul de antrenament pentru sarcini de codare, extinzând în același timp diversitatea mediului de antrenament, oferind îmbunătățiri în generarea de cod, depanarea complexă și fluxurile de lucru complete pentru dezvoltatori." Graficele spun o poveste clară.

Pe Terminal-Bench 2.1, Muse Spark 1.2 cu Muse Code a obținut 82.9%, în urma Claude Code pe Opus 5 cu 86.7%, dar înaintea GPT-5.6 Terra pe Codex (81.8%) și Grok Build (81.6%).

DeepSWE 1.1, care măsoară capacitățile de codare agentică, a fost mai aproape: 59.3% pentru Muse față de 65.0% pentru Opus 5 și 64.8% pentru Codex. Pe bancul de testare intern de codare al Meta, Muse a atins 70.6% față de 79.4% al Opus 5.

Graficele de accelerare inversează ordinea. Peste 1.000 de apeluri de instrumente, Opus 5 a înregistrat cel mai mare câștig față de referință (aproximativ 74–75%), Muse Spark 1.2 fiind la mijlocul clasamentului cu aproximativ 61–69% în funcție de rulare. Punctul lui Meta este că agentul continuă să se îmbunătățească pe măsură ce se acumulează apeluri de instrumente, comportamentul dorit de la un coder cu orizont lung.

Cele mai interesante demonstrații sunt cele cu orizont lung și multimodale. În testarea de stres, Meta a declarat că Muse Code "a optimizat iterativ nucleele GPU pe parcursul a peste 1.000 de apeluri de instrumente (până la 24 de ore) pe GPU-uri Nvidia Hopper." Aceasta înseamnă că a reușit să se îmbunătățească în timp.

Există și un aspect de codare vizuală. Într-o demonstrație, un utilizator introduce un videoclip de prezentare a unei case în terminal ca fișier mp4, iar Muse Code "interpretează videoclipul și produce un site web bogat vizual cu capabilități de rezervare." Transformarea unui videoclip brut într-o aplicație web funcțională este propunerea multimodală pe care Meta a făcut-o pentru întreaga linie Muse.

Vezi firul de lansare:

Here’s an example of Muse Code’s multimodal visual coding capabilities. In this demo, the user inputs a fly-through video of a home into the terminal as an mp4 file. Muse Code interprets the video and produces a visually rich website with booking capabilities. pic.twitter.com/3CAfIMYmAB

— AI at Meta (@AIatMeta) August 5, 2026

Piața este deja aglomerată

Acestea fiind spuse, Meta intră târziu în luptă. Codex de la OpenAI rulează deja agenți cloud paraleli; DeepSeek și-a construit propriul rival pentru Claude Code, iar instrumente agentice precum Hermes sau OpenClaw sunt deja alternative bune cu mai multe capabilități. Avantajul Muse Code este timpul de execuție sigur la erori și designul subagentului, nu supremația în benchmark-uri.

Riscul este cel obișnuit pentru codarea agentică: un agent care reia după o eroare și continuă să apeleze instrumente timp de 24 de ore este puternic și imprevizibil. Meta pariază că dezvoltatorii își doresc această autonomie și o lansează acum.

Muse Code este disponibil pentru testare la instalare, introducând această comandă:
curl -fsSL https://dev.meta.ai/install.sh | bash