
ميتا هي أحدث عملاق تقني يطلق وكيل برمجة، في سباق للتنافس مع عمالقة الذكاء الاصطناعي الرائدة مثل Anthropic و OpenAI.
كتبت الشركة في إعلان رسمي: "نحن متحمسون لإطلاق Muse Code (نسخة تجريبية)، وهو وكيل برمجة طرفي مدعوم بـ Muse Spark 1.2، أحدث نماذجنا". "يمثل هذا خطوتنا التالية نحو الريادة، مع نماذج أكبر وأكثر قدرة قادمة."
باعتباره أداة برمجة وكيلة، تم تصميم Muse Code للهندسة البرمجية عبر المستودعات الكبيرة. وفقًا لميتا، فإنه "يتولى مهام الهندسة البرمجية المعقدة عبر المستودعات الكبيرة: تخطيط التغييرات، كتابة التعليمات البرمجية، والتحقق من النتائج. يمكنه تنسيق العديد من الوكلاء الفرعيين المستمرين لكل مهمة، مما يحل المشكلات الصعبة بشكل أسرع وأكثر دقة وبتدخل أقل."
التفصيل الذي يبرز هو وقت التشغيل. يسجل Muse Code كل استدعاء نموذج، وتشغيل أداة، وموافقة، وتعديل في سجل أحداث محلي يعمل كمصدر وحيد للحقيقة. قالت ميتا: "هذا المصدر الوحيد للحقيقة يجعل وقت التشغيل دقيقًا في إعادة التشغيل وآمنًا للاستئناف: بعد الانهيار، يمكن للوكيل الاستئناف بالضبط من حيث توقف". بالنسبة للمهام طويلة الأمد، هذه هي الميزة التي تهم أكثر من السرعة الخام — وهو الجزء الذي لم يجعله المنافسون نقطة بيع.
يأتي أيضًا بمهارات افتراضية. يحول الأمر "/plan" المهمة إلى خطة تتطلب موافقة، بينما يقوم "/grill" باختبار إجهاد تلك الخطة حتى تصمد، ويعمل "/goal" على تحقيق الهدف بنجاح مشابه لما يفعله Hermes. قالت ميتا إنها دربت Muse Spark 1.2 بالاشتراك مع Muse Code بحيث يعمل نموذج اللغة الكبير الأساسي والوكيل معًا بتآزر.
Muse Spark 1.2 هو تحديث يركز على البرمجة لـ Muse Spark 1.1. وقالت ميتا إنه "قام بزيادة كبيرة في حوسبة التدريب على مهام البرمجة مع توسيع تنوع بيئة التدريب، مما يوفر تحسينات في توليد التعليمات البرمجية، وتصحيح الأخطاء المعقد، وسير عمل المطور من البداية إلى النهاية". تحكي الرسوم البيانية قصة واضحة.
على Terminal-Bench 2.1، سجل Muse Spark 1.2 مع Muse Code نسبة 82.9%، متخلفًا عن Claude Code على Opus 5 بنسبة 86.7% ولكنه متفوق على GPT-5.6 Terra على Codex (81.8%) و Grok Build (81.6%).
DeepSWE 1.1، الذي يقيس قدرات البرمجة الوكيلة، كان أقرب: 59.3% لـ Muse مقابل 65.0% لـ Opus 5 و 64.8% لـ Codex. على مقاعد اختبار البرمجة الداخلية لميتا، حقق Muse نسبة 70.6% مقابل 79.4% لـ Opus 5.
رسوم بيانية التسريع تعكس الترتيب. على مدار أكثر من 1000 استدعاء أداة، حقق Opus 5 أكبر مكسب مقابل خط الأساس (حوالي 74-75%)، بينما كان Muse Spark 1.2 في منتصف الترتيب بحوالي 61-69% اعتمادًا على التشغيل. وجهة نظر ميتا هي أن الوكيل يستمر في التحسن مع تراكم استدعاءات الأدوات، وهو السلوك الذي تريده من مبرمج طويل الأفق.
أكثر العروض التوضيحية إثارة للاهتمام هي طويلة الأفق ومتعددة الوسائط. في اختبارات الإجهاد، قالت ميتا إن Muse Code "عمل على تحسين نواة GPU بشكل متكرر على مدار أكثر من 1000 استدعاء أداة (حتى 24 ساعة) على وحدات معالجة الرسوميات Nvidia Hopper". وهذا يعني أنه كان قادرًا على التحسن بمرور الوقت.
هناك أيضًا زاوية برمجة مرئية. في أحد العروض التوضيحية، يقوم المستخدم بإسقاط فيديو تجوال لمنزل في الطرفية كملف mp4، ويقوم Muse Code "بتفسير الفيديو وإنشاء موقع ويب غني بصريًا مع إمكانيات الحجز". تحويل الفيديو الخام إلى تطبيق ويب عامل هو العرض الترويجي متعدد الوسائط الذي تقدمه ميتا عبر خط Muse.
شاهد سلسلة الإطلاق:
Here’s an example of Muse Code’s multimodal visual coding capabilities. In this demo, the user inputs a fly-through video of a home into the terminal as an mp4 file. Muse Code interprets the video and produces a visually rich website with booking capabilities. pic.twitter.com/3CAfIMYmAB
— AI at Meta (@AIatMeta) August 5, 2026
ومع ذلك، فإن ميتا متأخرة في هذه المعركة. يعمل Codex من OpenAI بالفعل بوكلاء سحابيين متوازيين؛ وقد بنى DeepSeek منافسه الخاص لـ Claude Code وأدوات وكيلة مثل Hermes أو OpenClaw هي بالفعل بدائل جيدة ذات قدرات أكبر. ميزة Muse Code هي وقت التشغيل الآمن من الأعطال وتصميم الوكلاء الفرعيين، وليس تفوق المعيار.
الخطر هو الخطر المعتاد للبرمجة الوكيلة: وكيل يستأنف العمل بعد الانهيار ويستمر في استدعاء الأدوات لمدة 24 ساعة قوي وغير متوقع. ميتا تراهن على أن المطورين يريدون هذا الاستقلالية، وهي تطلقه الآن.
Muse Code متاح للاختبار عند التثبيت بإدخال هذا الأمر:
curl -fsSL https://dev.meta.ai/install.sh | bash