نماذج ومنصات الذكاء الاصطناعي

DeepSeek تطلق V4 Pro كنموذجها الرائد بعد فترة المعاينة

mm
أضف Unite.AI إلى مصادرك المفضلة على Google

أعلنت DeepSeek عن إطلاق الإصدار الإنتاجي من نموذجها الرائد، DeepSeek V4 Pro، مما ينهي فترة المعاينة التي استمرت لأكثر من أربعة أشهر. تم إطلاق الإصدار، المعروف باسم V4 Pro 0813، في 12 أغسطس 2026، على صفحة نموذج OpenRouter ووثائق API الخاصة بـ DeepSeek، و现在 يتم إدراج DeepSeek-V4-Pro-0813 كإصدار النموذج وراء نقطة النهاية deepseek-v4-pro.

تتم نقل اقتصاديات API من فترة المعاينة: 0.435 دولار لكل مليون رمز إدخال عند فشل الذاكرة المؤقتة، 0.003625 دولار لكل مليون عند نجاح الذاكرة المؤقتة، و 0.87 دولار لكل مليون رمز إخراج، مع نافذة سياق تبلغ مليون رمز وحد أقصى إخراج يبلغ 384000 رمز. تؤكد صفحة التسعير الخاصة بـ DeepSeek إصدار 0813، والتسعير، وحد أقصى تزامن يبلغ 500 لنقطة النهاية Pro مقابل 2500 لنقطة النهاية Flash.

تتمثل الإصدار النهائي في إنهاء استراتيجية إطلاق من مرحلتين قامت بها DeepSeek. عندما أصبحت V4-Flash رسمية في 31 يوليو 2026، نشرت DeepSeek نتائج اختبار الوكيل التي أظهرت أن بناء Flash المعاد تدريبه يتفوق على V4-Pro-Preview في مجموعات الوكيل التابعة لها، وهو تحرك متعمد جعل النموذج الأصغر هو الافتراضي لتحميلات الوكيل بينما بقي النموذج الرائد في فترة المعاينة. الإصدار 0813 هو إجابة النموذج الرائد، ويأتي مع نافذة سياق ونقطة خروج و conjunto ميزات غير متغيرة في الاسم. التغيير هو أن علامة المعاينة قد زالت.

ما يقوم عليه إصدار 0813

يتمثل V4 Pro في نظام خبير مختلط مع 1.6 تريليون معامل إجمالي و 49 مليار معامل نشط لكل رمز، وفقًا للبطاقة النموذجية على Hugging Face. يجمع التصميم بين متغيري انتباه يسميهما DeepSeek انتباه مضغوط و انتباه مضغوط بشكل كبير، ويقول إنها تقطع حسابات الاستدلال الفردي إلى 27٪ وذاكرة التخزين المؤقت إلى 10٪ مما كان يحتاجه نموذج V3.2 عند إعداد مليون رمز. تم تدريب كلا نموذجي V4 على أكثر من 32 تريليون رمز، مع تدريب لاحق ينمو الخبراء المحددون بال领域 بشكل منفصل ثم يدمجهم في نموذج واحد من خلال التقطير السياسي.

كانت الأوزان المفتوحة للنسخ المعاينة قابلة للتنزيل منذ أبريل، وسجل مستودع Pro أكثر من 1.4 مليون تنزيل في الشهر الماضي على Hugging Face. توصي البطاقة بنافذة سياق تبلغ على الأقل 384000 رمز عند تشغيل نموذج معالجة الصواب الأقصى محليًا.

الأرقام التي تقدمها DeepSeek

المطالبات التقييمية الرئيسية هي تقارير من البطاقة النموذجية وعمليات Harness الخاصة بالشركة. عند أقصى جهد استدلال، الذي يسميه DeepSeek V4-Pro-Max، تقارير البطاقة:

  • SWE-bench Verified: 80.6٪ محسوم
  • Terminal Bench 2.0: 67.9٪ دقة
  • GPQA Diamond: 90.1٪ تمرير@1
  • Humanity’s Last Exam: 37.7٪ تمرير@1
  • MMLU-Pro: 87.5٪
  • LiveCodeBench: 93.5٪ تمرير@1
  • Codeforces rating: 3206
  • MRCR عند مليون رمز: 83.5 MMR

تضع جدول المقارنة الخاص بالبطاقة تلك النقاط مقابل أنظمة حدود مسماة: يتبع V4-Pro-Max GPT-5.4 عند مجهود xHigh على Terminal Bench 2.0 (67.9 إلى 75.1) و Gemini-3.1-Pro على Humanity’s Last Exam (37.7 إلى 44.4)، بينما يسجل أعلى نقاط LiveCodeBench و Apex Shortlist. على SWE-bench Verified يصل إلى 80.6، على قدم المساواة مع Gemini-3.1-Pro وفراكشن خلف Claude Opus 4.6 عند 80.8. لم يتم إعادة إنتاج أي من هذه الأعمدة بواسطة مقيم مستقل حتى الآن لإصدار 0813.

يتمتع API بثلاثة أوضاع تشغيل (لا يفكر، جهد استدلال عالٍ، وجهد أقصى يصف الوثائق بأنه “دفع حدود قدرة الاستدلال بالنموذج”) ويدعم تنسيق OpenAI ChatCompletions وتنسيق Anthropic Messages وتنسيق Responses API الخاص بـ DeepSeek، مع استدعاء الأداة وإخراج JSON على كلا Pro و Flash.

كيف وصلت DeepSeek إلى هنا

يكمل إصدار Pro GA النصف الثاني من استراتيجية الإصدار التي وضعت النموذج الأرخص في المقدمة أولاً. عندما أصبحت V4-Flash رسمية في 31 يوليو 2026، نشرت DeepSeek نتائج اختبار الوكيل التي أظهرت أن بناء Flash المعاد تدريبه يتفوق على V4-Pro-Preview في مجموعات الوكيل التابعة لها، وهو تحرك متعمد جعل النموذج الأصغر هو الافتراضي لتحميلات الوكيل بينما بقي النموذج الرائد في فترة المعاينة. الإصدار 0813 هو إجابة النموذج الرائد، ويأتي مع نافذة سياق ونقطة خروج و conjunto ميزات غير متغيرة في الاسم. التغيير هو أن علامة المعاينة قد زالت.

يتمتع الوضع التسعيري بمراقبة. تذكر إشعار على صفحة التسعير الخاصة بـ DeepSeek أن الشركة تخطط “لزيادة كبيرة” في التسعير الإجمالي لل-API في المستقبل القريب، مع تفاصيل ستأتي عن طريق الإشعار الرسمي. حتى الآن، تظل معدلات V4 Pro كما هي في فترة المعاينة، ويتجاوز متوسط السعر المدفوع من خلال OpenRouter بكفاءة السعر المحدد، الذي ي归زه OpenRouter إلى التخزين المؤقت والخصومات.

قامت DeepSeek ببناء خارج النموذج نفسه خلال العام الماضي: يتم تدريب سلسلة V4 حول حملات الوكيل (مساعدي التشفير، التutomatization متعددة الخطوات،合成 الوثائق الطويلة) التي أعلنت عنها في أبريل، وأصبحت هذه الحملات الآن تشكل جزءًا من تطوير الشركة الداخلي. وقد تم إطلاق نماذج رائدة مفتوحة في مختبرات مفتوحة صينية بتواتر شهر تقريبًا، من Kimi K3 من Moonshot إلى M2.7 من MiniMax، وإصدار V4 Pro هو محاولة DeepSeek للاحتفاظ بنموذجها الرائد في المقدمة.

ما سيتم شحنه بعد ذلك

البند المفتوح هو الأوزان الجديدة. لا تزال مستودعات Hugging Face تستضيف بناء المعاينة أبريل، ويشير جدول التنزيل الخاص بالبطاقة النموذجية إلى تلك الملفات؛ لم تعلن DeepSeek عن جدول زمني لنشر أوزان 0813 أو لم تذكر ما إذا كان إصدار GA يختلف عن المعاينة بعد التدريب. تتمثل وتيرة الشركة المعلنة لسلسلة V4، وفقًا لسجل التغييرات، في إطلاقها عبر API أولاً.

على الجانب التجاري، يلتزم إشعار الصفحة التسعيرية DeepSeek بالإعلان الرسمي عن خطة التسعير المنقحة، مع تطبيق الزيادة عبر خدمات API. حتى وصول ذلك الإشعار، يستمر deepseek-v4-pro في تقديم إصدار 0813 عند معدلات المنشور في 12 أغسطس 2026 — 0.435 دولار للداخل، 0.87 دولار للخارج، لكل مليون رمز، عند مليون رمز من السياق.

جوناس ريف هو محلل منشأ بالذكاء الاصطناعي في Unite.AI، يركز على الذكاء الاصطناعي الإدراكي والذكاء الاصطناعي العام (AGI) والأسس النظرية للذكاء الآلي. يعمل على كيفية ظهور التعلم والاستدلال والذاكرة والاستخراج في الأنظمة البيولوجية والاصطناعية، ورسم الصلات بين هياكل الذكاء الاصطناعي الحديثة والأسئلة القديمة في العلوم الإدراكية وفلسفة العقل.
مع نهج概念ي واعٍ، يبحث جوناس في الإطارات مثل نماذج الاستدلال والأنظمة الوكيلية والاعتراف الناشئ ونظرية التوجيه، بهدف توضيح ما يعنيه التقدم نحو AGI بالفعل - وما لا يعنيه. بدلاً من مطاردة الجداول الزمنية أو الهياج، يؤكد على المبادئ الأولى والصقل المفاهيمي وحدود النماذج الحالية.
المقالات التي كتبها جوناس ريف هي منشأة بالذكاء الاصطناعي ومراجعة بواسطة فريق تحرير Unite.AI لضمان الدقة والوضوح والمناقشة المسؤولة للمفاهيم المتقدمة للذكاء الاصطناعي.