Muse Spark 1.3: نموذج Meta الحدودي للبرمجة والعمل الوكيلي، شرح مفصّل
الإصدار الرابع من Muse Spark خلال خمسة أشهر يبلغ الحدود الأمامية — بأعلى معيار للعمل الوكيلي، وأسعار ثابتة، ونسخة استدلال قصوى في معاينة محدودة.

Muse Spark 1.3 هو نموذج Meta الحدودي الجديد للبرمجة والعمل الوكيلي، صدر في الثاني من سبتمبر 2026 — وهو الإصدار الرابع من Muse Spark خلال خمسة أشهر. أبرز ما فيه: تحتل نسخته العليا مرتبةً تلي Claude مباشرةً على مؤشر الذكاء الرائد، ويسجّل المرتبة الأولى على معيار رئيسي للعمل الوكيلي، ويحقق ذلك بأدنى تكلفة لكل مهمة بين نماذج فئته. إليك ما تغيّر مقارنةً بـ Muse Spark 1.2، والنسختان المتاحتان، والمعايير، والأسعار، وأين يناسب بناة الوكلاء الذكيين.
ما هو Muse Spark 1.3؟
Muse Spark 1.3 نموذج استدلالي من Meta، مُضبَّط للبرمجة طويلة الأمد وسير العمل الوكيلي. يقبل مدخلات نصية وصورية ومرئية، ونافذة سياقه مليون رمز (token)، ومتاح في Muse Code وواجهة برمجة نماذج Meta منذ يوم الإطلاق.
تصف Meta النموذج بأنه مبني للحفاظ على العمل لفترات أطول من خلال التعاون مع المستخدم وإدارة سير عمل متعددة في خيط محادثة واحد طويل. عملياً، يعني ذلك طرح أسئلة توضيحية عند غموض التعليمات، وطلب المساعدة عند التعثّر، والتأكيد قبل اتخاذ إجراءات ذات عواقب — سلوك مصمَّم للوكلاء الذين يعملون لفترات طويلة لا للمحادثات الفردية.
قال رئيس Meta AI ألكسندر وانغ لـ Axios إن التحديث "تنافسي جداً مع النماذج الحدودية" ويمهّد الطريق لمنتجات كالوكلاء الشخصيين الذين يعملون نيابةً عنك. جاء الإطلاق في الأسبوع ذاته الذي صدر فيه Gemini 3.8 Flash من Google وClaude Fable 5.1 من Anthropic — أيام مزدحمة بإصدارات النماذج.
النسختان: xhigh مقابل max
يُشحَن Muse Spark 1.3 في صورة نموذجين بميزانيتَي استدلال مختلفتين:
- Muse Spark 1.3 (xhigh) — متاح الآن في Muse Code والواجهة البرمجية.
- Muse Spark 1.3 (max) — نسخة أعلى جهداً في معاينة محدودة لشركاء Meta، ستُطرح بشكل أوسع بعد اختبارات سلامة إضافية.
الفرق بينهما هو مقدار التفكير الذي يبذله كل منهما. على مؤشر الذكاء من Artificial Analysis، تسجّل xhigh 61 وmax تسجّل 62. تبلغ نسخة max أرقامها الأعلى بإنفاق أكثر — نحو 62% استدلالاً إضافياً على أحد تقييمات العمل الوكيلي و28% على آخر مقارنةً بـ xhigh. إن أردت أفضل نتيجة وتحمّلت تكلفة الرموز، فـ max هي الهدف؛ وإن أردت أفضل توازن بين الأداء والسعر المتاح اليوم، فـ xhigh هي الخيار.
المعايير: أين يبلغ Muse Spark 1.3 الحدود الأمامية
على مؤشر الذكاء من Artificial Analysis، يدخل Muse Spark 1.3 (xhigh) بنتيجة 61 — بزيادة 4 نقاط عن Muse Spark 1.2 (57) و8 نقاط عن Muse Spark 1.1 (53). يتعادل مع GPT-5.6 Sol (max) وGrok 4.6 (high). أما نسخة max بنتيجة 62 فلا تتأخر إلا عن Claude Fable 5.1 وClaude Opus 5 في قمة المؤشر.
معظم المكاسب تأتي من المهام الوكيلية والعلمية، لا من المعرفة الخام.
| المعيار | Muse Spark 1.2 | 1.3 (xhigh) | 1.3 (max) |
|---|---|---|---|
| Tau3-Bench Banking | 35% | 47% | 52% |
| Terminal-Bench 2.1 | 80% | 85% | 86% |
| GDPval-AA v2 (Elo) | 1,615 | 1,709 | 1,754 |
| CritPt (علمي) | 18% | 26% | ~25% |
| GPQA Diamond | 90% | 94% | 94% |
المصدر: Artificial Analysis، 2 سبتمبر 2026.
اللافت هو Tau3-Bench Banking: نتيجة نسخة max البالغة 52% هي المرتبة الأولى بين جميع النماذج، والقفزة من 12 إلى 17 نقطة فوق Muse Spark 1.2 هي المحرّك الأكبر لتحسّن المؤشر. ارتفع الاستدلال العلمي على نطاق واسع، بقيادة مكسب 8 نقاط في CritPt لنسخة xhigh.
التراجعات التي لم تُبرزها Meta
تراجع معياران مقارنةً بـ Muse Spark 1.2. انخفضت كلتا النسختين 4 نقاط على AA-LCR (من 83% إلى 79%)، وتراجع AA-Omniscience (Accuracy) 3 نقاط لـ xhigh ونقطة واحدة لـ max. وفقاً لـ Artificial Analysis، يأتي تراجع الشمولية من ارتفاع معدل الامتناع عن الإجابة — أي رفض النموذج الإجابة عند عدم التأكد — مما خفّض أيضاً معدل الهلوسة. هذا يُعدّ ميزةً للعمل الوكيلي: نموذج يقول "لا أعرف" بدلاً من التخمين بثقة أكثر أماناً لتكليفه بمهمة طويلة وذات عواقب.
تقول Meta إنها دربت Muse Spark 1.3 ليكون أكثر وعياً بما يعرفه وما لا يعرفه، وليُشير عند بلوغه حائطاً بدلاً من اختلاق نتيجة — وهو ما يتسق مع سلوك الامتناع هذا.
الأسعار: أرخص نموذج حدودي تكلفةً لكل مهمة
الأسعار لم تتغيّر عن Muse Spark 1.2: 1.25 دولار لكل مليون رمز إدخال و4.25 دولار لكل مليون رمز إخراج، مع خصم على الذاكرة المؤقتة (cache) بـ 0.15 دولار لكل مليون. وصف وانغ الأسعار بأنها "عدوانية".
المقارنة الأهم هي التكلفة لكل مهمة. تقيس Artificial Analysis Muse Spark 1.3 (xhigh) بـ 0.55 دولار لكل مهمة على مؤشر الذكاء — أدنى تكلفة بين أي نموذج يسجّل 59 أو أعلى. نظراؤه المباشرون عند 61 يكلّفون أكثر بكثير: Grok 4.6 (high) بـ 0.94 دولار وGPT-5.6 Sol (max) بـ 0.95 دولار، بفارق يزيد على 70%. لم تُعلن Meta بعد عن أسعار نسخة max.
تحفّظ واحد: ارتفعت التكلفة لكل مهمة مقارنةً بـ Muse Spark 1.2 (0.40 دولار)، لأن النموذج الجديد يستهلك نحو 57% رموز إدخال أكثر لكل مهمة وكيلية. إنه أرخص من نظرائه، لكن ليس أرخص من سلفه.
ما الذي تغيّر في البرمجة
تقول Meta إن Muse Spark 1.3 دُرِّب على مهام برمجة أطول أمداً وأكثر قابلية للاستخدام في العمل الهندسي الفعلي. مقارنةً بـ Muse Spark 1.2، يأخذ عدداً أقل من الجولات حيث لا تكون ضرورية، وأقل إسهاباً، وأسلوب برمجة أنظف. في مقارنات المهندسين الداخلية لدى Meta، استخدم نحو 20% أقل من استدعاءات الأدوات و25% أقل من الرموز — كفاءة تتراكم عبر تشغيل وكيل طويل.
تُفيد Meta أيضاً بتحسينات سلامة ذات صلة بالوكلاء: مقاومة أقوى لحقن التعليمات (prompt injection) والمدخلات العدائية، وتحسين معايرة الإجراءات التي لا يمكن التراجع عنها قبل المضي فيها.
كيف يقارن ببقية النماذج
يُفهَم Muse Spark 1.3 (xhigh) على أنه الخيار الأمثل من حيث القيمة عند حافة الحدود الأمامية: متعادل مع GPT-5.6 Sol (max) وGrok 4.6 (high) على المؤشر، ومتقدّم عليهما في التكلفة لكل مهمة، ومتصدّر الميدان في مهام البنوك الوكيلية. يتأخر عن Claude Fable 5.1 (66) وClaude Opus 5 (63) على المؤشر الإجمالي — فإن أردت النموذج الأقوى مطلقاً بصرف النظر عن السعر، فـ Claude لا يزال في المقدمة؛ وإن أردت أداءً وكيلياً حدودياً بأدنى تكلفة، فـ Muse Spark 1.3 هو الخيار البارز.
للمقارنة المباشرة بين إصدارات هذا الأسبوع، راجع مقارنة Muse Spark 1.3 مقابل Gemini 3.8 Flash مقابل Claude Fable 5.1.
ما التالي
تقول Meta إن خارطة طريقها تشمل نماذج أكبر وإصدار Muse Spark بأوزان مفتوحة. يأتي ذلك في أعقاب Muse Glimmer، النموذج مفتوح الأوزان بـ 30 مليار معامل المُقطَّر من Muse Spark الذي شحنته Meta في أغسطس — لذا يبدو أن عائلة الأوزان المفتوحة ستواصل النمو. أشار وانغ أيضاً إلى أن السلامة من أهم الموضوعات الداخلية حالياً، مشيراً إلى أن Meta تطوّر نماذج أكثر قوة.
الخلاصة
Muse Spark 1.3 هو Meta تبلغ الحدود الأمامية في العمل الوكيلي والبرمجة بسعر تنافسي حقيقي. نسخة xhigh متاحة اليوم وتقدّم أدنى تكلفة لكل مهمة بين أي نموذج في فئتها الذكية؛ ونسخة max تقترب من قمة المؤشر خلف Claude مباشرةً. التحفظات الصادقة: المعايير مبكّرة، وارتفعت التكلفة لكل مهمة مقارنةً بـ 1.2، وتراجع تقييمان طفيفاً. لكن إن كنت تبني وكلاء وتهتم بالموثوقية طويلة الأمد مقابل كل دولار، فهو يستحق مكانه على قائمتك المختصرة.
ضع Muse Spark 1.3 في الخدمة ضمن قوة عمل ذكاء اصطناعي
نموذج حدودي كـ Muse Spark 1.3 لا يُثبت جدارته إلا حين يُدمَج في سير عمل حقيقية — أدوات وملفات ومراجعة كود وخطط متعددة الخطوات — لا في نافذة محادثة. Eigent تطبيق سطح مكتب تعاوني مفتوح المصدر يُشغّل قوة عمل من وكلاء ذكاء اصطناعي متعددين محلياً وهو محايد تجاه النماذج، بحيث يمكنك توجيه النموذج المناسب لكل مهمة والحفاظ على العمل الحساس على جهازك. اطّلع على كيفية قيام الوكلاء بـمراجعة طلبات السحب على GitHub من البداية إلى النهاية، ثم نزّل Eigent لتجربته.
الأسئلة الشائعة
ما هو Muse Spark 1.3؟
Muse Spark 1.3 هو نموذج الاستدلال الحدودي من Meta للبرمجة والعمل الوكيلي، صدر في الثاني من سبتمبر 2026. يدعم مدخلات نصية وصورية ومرئية بنافذة سياق مليون رمز، ومتاح في Muse Code وواجهة برمجة نماذج Meta. وهو الإصدار الرابع من Muse Spark خلال خمسة أشهر.
ما الفرق بين Muse Spark 1.3 xhigh وmax؟
يختلفان في ميزانية الاستدلال. Muse Spark 1.3 (xhigh) متاح الآن ويسجّل 61 على مؤشر الذكاء من Artificial Analysis. Muse Spark 1.3 (max) نسخة أعلى جهداً في معاينة محدودة تسجّل 62 بإنفاق رموز استدلال أكثر بشكل ملحوظ، وستُطرح بشكل أوسع بعد اختبارات سلامة إضافية.
كم يكلّف Muse Spark 1.3؟
أسعار نسخة xhigh لم تتغيّر عن Muse Spark 1.2: 1.25 دولار لكل مليون رمز إدخال و4.25 دولار لكل مليون رمز إخراج، مع ذاكرة مؤقتة بـ 0.15 دولار لكل مليون. تقيسه Artificial Analysis بـ 0.55 دولار لكل مهمة على مؤشر الذكاء — الأدنى بين أي نموذج يسجّل 59 أو أعلى. لم تُعلَن أسعار نسخة max بعد.
هل Muse Spark 1.3 أفضل من Muse Spark 1.2؟
نعم في معظم المهام. اكتسبت نسخة xhigh 4 نقاط على المؤشر وحققت قفزات كبيرة على معايير العمل الوكيلي — ارتفع Tau3-Bench Banking من 35% إلى 47%، وTerminal-Bench 2.1 من 80% إلى 85%. تراجع تقييمان طفيفاً (AA-LCR وAA-Omniscience)، وارتفعت التكلفة لكل مهمة لأنه يستخدم رموز إدخال أكثر.
كيف يقارن Muse Spark 1.3 بـ Claude وGPT؟
يتعادل Muse Spark 1.3 (xhigh) مع GPT-5.6 Sol (max) وGrok 4.6 (high) عند 61 على مؤشر الذكاء بتكلفة أقل بكثير لكل مهمة. نسخة max عند 62 لا تتأخر إلا عن Claude Fable 5.1 (66) وClaude Opus 5 (63). Claude لا يزال يتصدّر المؤشر الإجمالي؛ Muse Spark يتصدّر في التكلفة لكل مهمة وفي تقييم Tau3-Bench Banking الوكيلي.
هل سيصدر Muse Spark 1.3 بأوزان مفتوحة؟
أعلنت Meta أن إصدار Muse Spark بأوزان مفتوحة ضمن خارطة طريقها، في أعقاب نموذج Muse Glimmer مفتوح الأوزان بـ 30 مليار معامل الذي شحنته في أغسطس. لم يُعلَن عن تاريخ محدد لأوزان Muse Spark 1.3 المفتوحة.
Recent Posts

Claude Fable 5.1 و Mythos 5.1: ما الجديد، شرح مفصّل
شرح Claude Fable 5.1 و Mythos 5.1: نفس النموذج في مستويين من الضمانات، مع معايير أداء جديدة، وتخفيض في التكلفة بنسبة 25 إلى 45 بالمئة تقريبًا، وتفاصيل الوصول.

Gemini 3.8 Flash: المستجدات في البرمجة ووكلاء الذكاء الاصطناعي
يُقدّم Gemini 3.8 Flash مكاسب كبيرة في البرمجة والاستدلال الوكيل بنفس السعر المنخفض، إضافةً إلى متغيّر جديد هو 3.8 Flash Cyber. اكتشف المعايير والأسعار وكيفية استخدامه.

GPT-6 Astra: ما الذي يفعله نموذج OpenAI الجديد فعلاً
GPT-6 Astra هو نموذج OpenAI الرائد الجديد. إليك ما يفعله، وكيف يُقيَّم، وما يكلفه، والتحفظات الكامنة وراء عناوين الذكاء الاصطناعي العام.