logo
  • البيئات
  • الشركات
  • الأسعار
Blogs
القطاع|Jul 31, 2026

DeepSeek V4 Flash يصبح رسمياً: معايير أداء الوكلاء تتفوق على V4 Pro Preview

نفس البنية، نفس السعر، أوزان معاد تدريبها — النموذج الاقتصادي يتفوق الآن على النموذج الرائد في مرحلة المعاينة، مع دعم أصلي لـ Responses API وCodex

EigentEigent
Share to
DeepSeek V4 Flash يصبح رسمياً: معايير أداء الوكلاء تتفوق على V4 Pro Preview
  • ما الذي تغيّر فعلاً
  • أرقام معايير الأداء
  • لماذا يهم "نفس الحجم، وكيل أفضل"
  • دعم Responses API وCodex
  • ما يعنيه هذا لمكدسك التقني
  • افعل هذا مع قوة عمل الذكاء الاصطناعي الخاصة بك
  • الأسئلة الشائعة
Automate Everything with
AI Workforce on Desktop
Download Eigent

أطلق DeepSeek للتو النسخة الرسمية من واجهة برمجة تطبيقات V4 Flash في النسخة التجريبية العامة — والخبر الرئيسي ليس نموذجاً جديداً، بل إعادة تدريب. يحتفظ الإصدار المُعلَّم بـ DeepSeek-V4-Flash-0731 بنفس البنية والحجم والسعر تماماً كما في مرحلة المعاينة، لكن نتائج معايير أداء الوكلاء تتجاوز الآن بفارق كبير V4-Pro-Preview، النموذج الأكبر والأغلى في نفس العائلة. كما يضيف دعماً أصلياً لـ Responses API وتكيّفاً مع Codex. إذا كنت تستدعي deepseek-v4-flash بالفعل، فإن النموذج الذي يعمل خلف واجهة برمجة التطبيقات الخاصة بك أصبح أفضل بشكل ملحوظ دون أي تكلفة إضافية.

ما الذي تغيّر فعلاً

وفقاً لسجل التغييرات الرسمي لواجهة برمجة تطبيقات DeepSeek، أصبحت واجهة برمجة تطبيقات V4 Flash الرسمية متاحة الآن في النسخة التجريبية العامة، وطريقة الاستدعاء لم تتغير — تضبط اسم النموذج على deepseek-v4-flash تماماً كما كنت تفعل خلال مرحلة المعاينة. (سجل تغييرات DeepSeek)

ثلاثة حقائق تُحدّد هذا الإصدار:

  • إنها إعادة تدريب، وليس نموذجاً جديداً. يؤكد DeepSeek أن V4-Flash-0731 يحتفظ بنفس البنية والحجم كـ V4-Flash-Preview، وقد خضع فقط لإعادة التدريب اللاحق. أوزان جديدة على نفس الهيكل — ولهذا السبب يُعدّ التكامل تغييراً مباشراً دون الحاجة لإعادة كتابة الكود. (سجل تغييرات DeepSeek)
  • أرقام الوكلاء هي القصة الحقيقية. يصف DeepSeek "قدرات وكلاء محسّنة بشكل ملحوظ"، مع نتائج معايير أداء تتجاوز بفارق كبير V4-Pro-Preview. يستهدف هذا التحسين التنفيذ المستقل واستدعاء الأدوات في المهام المعقدة. (سجل تغييرات DeepSeek)
  • هذا مخصص لواجهة برمجة التطبيقات فقط، في الوقت الحالي. ينطبق التحسين فقط على واجهة برمجة تطبيقات V4 Flash. واجهة برمجة تطبيقات V4 Pro والنماذج على تطبيق DeepSeek وموقعه الإلكتروني لم تتغير، ويقول DeepSeek إن الإصدار الرسمي من V4 Pro سيتبع قريباً. (سجل تغييرات DeepSeek)

الإشارة الاستراتيجية هي ما يلفت الانتباه. طوال معظم جيل V4 كان التسلسل الهرمي بسيطاً: Pro قوي، وFlash رخيص وأضعف. تقلب إعادة التدريب هذه تلك القصة بالنسبة لأعباء العمل الوكيلية — النموذج الخفيف يُسجّل الآن أرقاماً تتجاوز النموذج الرائد في مرحلة المعاينة. (TechNode)

أرقام معايير الأداء

نشر DeepSeek جدول معايير أداء كاملاً مع إصدار 0731. هذه هي النتائج الرسمية المُبلَّغ عنها ذاتياً من سجل التغييرات:

معيار الأداءV4-Flash-0731
Terminal Bench 2.182.7
NL2Repo54.2
Cybergym76.7
DeepSWE54.4
Toolathlon (موثّق)70.3
Agent Last Exam25.2
Automation Bench (عام)25.1
DSBench-FullStack68.7
DSBench-Hard59.6

المصدر: سجل تغييرات واجهة برمجة تطبيقات DeepSeek. DSBench-FullStack وDSBench-Hard هما مجموعتا اختبار داخليتان لـ DeepSeek — مجموعة تطوير متكامل للمكدس الكامل ومجموعة وكيل برمجة صعبة، على التوالي.

تحفّظان قبل أن تستنتج الكثير من عبارة "يتفوق على V4 Pro Preview":

  • المقارنة ليست متكافئة تماماً. يُسجّل V4-Flash-0731 نتيجة 82.7 على Terminal Bench 2.1، بينما الرقم المُستشهد به لـ V4-Pro-Preview في التغطيات (67.9) هو على Terminal Bench 2.0 — إصداران مختلفان من مجموعة الاختبار، لذا فإن المقارنة المباشرة ليست عادلة تماماً. (36Kr)
  • مهام وكيل الكود استخدمت إطار عمل محدداً. يُشير DeepSeek إلى أن معايير أداء وكيل الكود العامة جرى تشغيلها باستخدام "DeepSeek Harness minimal mode" (غير مُصدَر بعد) بأقصى جهد، وtop-p 0.95، ودرجة حرارة 1.0. أرقامك في بيئة الإنتاج تعتمد على إطار العمل الخاص بك. (سجل تغييرات DeepSeek)

ومع ذلك، الحجم ملحوظ: نموذج بـ ~13 مليار معامل نشط يُحقق نتائج وكلاء في هذا النطاق يُظهر مدى التأثير الذي يمكن أن يُحدثه التدريب اللاحق وحده. (36Kr)

لماذا يهم "نفس الحجم، وكيل أفضل"

V4 Flash هو نموذج MoE بـ 284 مليار معامل مع ~13 مليار معامل نشط، مقارنةً بـ V4 Pro الذي يبلغ 1.6 تريليون معامل إجمالي / ~49 مليار نشط. يتشاركان نافذة سياق بمليون رمز. كان الهدف الكامل من Flash هو الإنتاجية والتكلفة — كنت تتنازل عن بعض القدرة مقابل السرعة. (للاطلاع على المواصفات الكاملة، راجع دليل DeepSeek V4 Pro لدينا.)

من خلال رفع أداء الوكلاء دون تغيير عدد المعاملات، يستهدف DeepSeek نقطة الألم الدقيقة التي تصطدم بها معظم الفرق في بيئة الإنتاج: يريدون أتمتة منخفضة التكلفة وعالية التزامن لكنهم لا يستطيعون تحمّل تشغيل نموذج رائد بـ 1.6 تريليون معامل على كل خطوة وكيل. نموذج أرخص يتعامل بشكل جيد مع استدعاء الأدوات والتنفيذ متعدد الخطوات يُغيّر اقتصاديات تشغيل الوكلاء على نطاق واسع. (BigGo Finance)

بالنسبة لأي شخص يبني خطوط أنابيب وكلاء، الاستنتاج العملي هو قرار توجيه: يمكن الآن لمزيد من خطوات الوكيل اليومية أن تعتمد افتراضياً على Flash، مع التصعيد إلى نموذج أثقل محجوز للفروع الصعبة حقاً.

دعم Responses API وCodex

النصف الآخر من هذا الإصدار يُخفّض حاجز التكامل. يدعم V4 Flash الرسمي تنسيق Responses API بشكل أصلي وهو مُكيَّف خصيصاً لـ Codex. (سجل تغييرات DeepSeek)

هذا مهم لأن Responses API هو التنسيق الذي تتوقعه أدوات OpenAI الوكيلية الأحدث — بما في ذلك Codex. الدعم الأصلي يعني أن الفرق المرتبطة بالفعل بسير عمل بأسلوب Codex يمكنها توجيهه إلى deepseek-v4-flash بتغييرات في الإعدادات بدلاً من إعادة الكتابة. يقول DeepSeek إن الهدف هو تخفيض الحاجز أمام تبني المطورين، وتفاصيل الإعداد موجودة في وثائق واجهة برمجة التطبيقات. (BigGo Finance)

إلى جانب حقيقة أن واجهة برمجة تطبيقات V4 يمكن الوصول إليها بالفعل من خلال كل من واجهة ChatCompletions بأسلوب OpenAI وواجهات بأسلوب Anthropic، يُحسّن DeepSeek بوضوح التوافق المباشر عبر أنظمة الوكلاء الرئيسية. (سجل تغييرات DeepSeek)

ما يعنيه هذا لمكدسك التقني

إذا كنت تبني على DeepSeek، إليك الملخص المختصر:

  • هل أنت على النسخة التجريبية بالفعل؟ تحصل على التحسين دون أي تغييرات في الكود — نفس اسم النموذج، نفس السعر، سلوك وكيل أفضل. أعد تشغيل تقييماتك للتأكد من ظهور التحسين في مهامك أنت، وليس فقط في معايير الأداء المنشورة.
  • هل تشغّل سير عمل بأسلوب Codex؟ أصبح V4 Flash الآن مرشحاً حقيقياً كخلفية أرخص، بفضل دعم Responses API الأصلي والتكيّف مع Codex.
  • هل تنتظر V4 Pro؟ يقول DeepSeek إن الإصدار الرسمي من Pro قادم قريباً؛ إعادة تدريب Flash هذه هي معاينة لمكاسب التدريب اللاحق التي ستراها على الأرجح هناك أيضاً.
  • تعامل مع معايير أداء البائعين كمؤشرات اتجاه. النتائج مُبلَّغ عنها ذاتياً، بعض المجموعات داخلية، وعدم تطابق إصدار Terminal Bench يعني أن صياغة "يتفوق على Pro Preview" تحتاج إلى تحفّظ حتى تصل التقييمات المستقلة.

افعل هذا مع قوة عمل الذكاء الاصطناعي الخاصة بك

نموذج يصبح أرخص وأفضل في آنٍ واحد هو السبب بالضبط الذي يجعل منصة وكلاء مستقلة عن النموذج تستحق الاستثمار — تريد إدراج أفضل نموذج لكل خطوة دون إعادة هيكلة. Eigent هو تطبيق سطح مكتب متعدد الوكلاء مفتوح المصدر بنمط "Cowork" يُنسّق نماذج متخصصة عبر سير عمل حقيقية، حتى تتمكن من توجيه خطوات الوكيل الروتينية إلى نموذج سريع ورخيص مثل V4 Flash وتصعيد الفروع الصعبة في مكان آخر. إذا كنت تُعدّ مهام برمجة وكيلية، اطّلع على كيفية تعامل Eigent مع سير العمل مثل مراجعة طلبات السحب على GitHub، أو حمّل Eigent لبناء قوة عمل الذكاء الاصطناعي الخاصة بك محلياً.

الأسئلة الشائعة

ما هو DeepSeek V4 Flash؟

DeepSeek V4 Flash هو المتغير الخفيف من عائلة نماذج V4 الخاصة بـ DeepSeek — نموذج Mixture-of-Experts بـ 284 مليار معامل مع ~13 مليار معامل نشط ونافذة سياق بمليون رمز، مُحسَّن لأعباء العمل السريعة ومنخفضة التكلفة وعالية الإنتاجية. واجهة برمجة التطبيقات الرسمية (إصدار 0731) متاحة الآن في النسخة التجريبية العامة.

ما الذي تغيّر في إصدار V4 Flash الرسمي؟

يحتفظ إصدار 0731 بنفس البنية والحجم والسعر كمرحلة المعاينة، لكنه خضع لإعادة التدريب اللاحق، مما أدى إلى نتائج معايير أداء وكلاء أقوى بشكل ملحوظ. كما يضيف دعماً أصلياً لـ Responses API وتكيّفاً مع Codex. طريقة الاستدعاء لم تتغير — لا تزال تضبط اسم النموذج على deepseek-v4-flash.

هل تتفوق معايير أداء V4 Flash فعلاً على V4 Pro Preview؟

نتائج الوكلاء المُبلَّغ عنها ذاتياً من DeepSeek تتجاوز V4-Pro-Preview في عدة معايير أداء. لكن المقارنة ليست متكافئة تماماً — على سبيل المثال، نتيجة Flash على Terminal Bench 2.1 بينما النتيجة المُستشهد بها لـ Pro Preview على Terminal Bench 2.0. تعامل مع الأرقام كمؤشرات اتجاه حتى تؤكدها تقييمات مستقلة.

هل يعمل V4 Flash مع Codex؟

نعم. يدعم V4 Flash الرسمي تنسيق Responses API بشكل أصلي وهو مُكيَّف خصيصاً لـ Codex، لذا يمكن لسير العمل بأسلوب Codex استخدامه كخلفية بتغييرات في الإعدادات بدلاً من إعادة الكتابة.

هل سيحصل V4 Pro على نفس التحسين؟

ليس بعد. ينطبق هذا التحديث فقط على واجهة برمجة تطبيقات V4 Flash. واجهة برمجة تطبيقات V4 Pro ونماذج تطبيق DeepSeek والويب لم تتغير، وإن كان DeepSeek يقول إن الإصدار الرسمي من V4 Pro سيتبع قريباً.

Recent Posts

قدرات Grok 4.6 وحالات الاستخدام الفعلية لوكلاء الذكاء الاصطناعي
القطاعAug 12, 2026

قدرات Grok 4.6 وحالات الاستخدام الفعلية لوكلاء الذكاء الاصطناعي

نظرة عملية على قدرات Grok 4.6 وحالات استخدامه: الوكلاء طويلو الأمد، والبرمجة، والعمل المرئي، إضافةً إلى كيفية استخدامه ضمن قوة عمل متعددة الوكلاء.

EigentEigent
Grok 4.6 مقابل Grok 4.5 وGPT-5.6 Sol وFable 5: ما الذي يتغير فعلاً
القطاعAug 12, 2026

Grok 4.6 مقابل Grok 4.5 وGPT-5.6 Sol وFable 5: ما الذي يتغير فعلاً

Grok 4.6 مقابل Grok 4.5 وGPT-5.6 Sol وFable 5: ما الذي أكدته xAI فعلاً، وما الذي لا يزال مجرد تكهنات، والمعيار الحقيقي الذي يجب أن يتجاوزه هذا التحديث القائم على ما بعد التدريب فحسب.

EigentEigent
Grok Bot: زملاء الذكاء الاصطناعي من SpaceXAI الذين ينجزون عملاً حقيقياً
القطاعAug 11, 2026

Grok Bot: زملاء الذكاء الاصطناعي من SpaceXAI الذين ينجزون عملاً حقيقياً

Grok Bot هو وكيل الذكاء الاصطناعي الجديد من SpaceXAI وCursor—زملاء يسجلون الدخول إلى أدواتك وينهون العمل الحقيقي. ما الذي يفعله، ومن يمكنه استخدامه، وكيف يقارن بالمنافسين.

EigentEigent
Automate everything with AI workforce on desktop
Download Eigent

جرّب Eigent اليوم

حمّل تطبيق سطح المكتب مفتوح المصدر وابدأ الأتمتة بقوة عمل ذكاء اصطناعي على جهازك.

تنزيل Eigent
Eigent

احصل على أحدث التحديثات والدروس حول أتمتة Workforce بالذكاء الاصطناعي.

المنتجEigentالبيئاتالأسعارالمؤسسات
استكشافالحلولحالات الاستخدامالمهاراتالإضافاتالمدونة
المطورونالوثائقGitHubCAMEL-AIصندوق المصدر المفتوحشريك
تنزيلللإصدار مفتوح المصدر
الشركةمن نحنالعلامة التجاريةالوظائفشروط الاستخدامسياسة الخصوصيةالأمان والثقةسياسة ملفات تعريف الارتباطسياسة الاسترداد والتجربة

جميع الحقوق محفوظة © 2026 EIGENT UK LTD

تم إصدار النسخة الجديدة من Eigent 1.0!download