- الجهة الصانعة
- DeepSeek
- تاريخ الإصدار
- 24 أبريل 2026
نقاط القوة والضعف
- +نموذج صدارة مفتوح الأوزان فعليًا يمكنك استضافته بنفسك، بخلاف منافسيه المغلقين
- +تكلفة واجهة برمجية منخفضة جدًا، خصوصًا في نوافذ التسعير خارج أوقات الذروة
- −إصدار V4 Pro نصّي فقط؛ ومدخلات الصورة محصورة في نسخة Flash تجريبية
- −يتأخر عن المختبرات المغلقة الرائدة في اختبارات الذكاء المجمّعة
التقييم
100% من الوزن مقاسقُيّم على DeepSeek V4 Pro · بيانات المصادر حتى 26 سبتمبر 2026
نطاق الثقة 9.1–9.2 · أي نموذج داخل هذا النطاق لا يفصله فارق ذو معنى عن هذا النموذج
Reasoningw458.9
قاعدة B1,461 rating (95% 1,457–1,466) من 38,586 صوتًا · المقياس 700–1,550، من 0 إلى 10 · LMArena text arena, hard prompts (deepseek-v4-pro) · 25 سبتمبر 2026
Accuracyw209.1
قاعدة A91.4% consistent · 91.4% ÷ 10 · Vectara hallucination leaderboard, factual consistency rate (deepseek-ai/DeepSeek-V4-Pro) · 22 سبتمبر 2026
Writingw158.6
قاعدة B1,446 rating (95% 1,439–1,453) من 9,697 صوتًا · المقياس 750–1,550، من 0 إلى 10 · LMArena text arena, creative writing (deepseek-v4-pro) · 25 سبتمبر 2026
Long contextw2010.0
قاعدة B1,048,576 tokens · المقياس 8,192–1,048,576 توكن، من 0 إلى 10 · OpenRouter, context window · 26 سبتمبر 2026
السعر والإتاحة
مقاسان بالطريقة نفسها، وخارج الدرجة عن عمد: تكلفة النموذج لا تغيّر ما يستطيع فعله.
w = الوزن، أي حصة كل معيار من الدرجة الإجمالية. والدرجات الغائبة لا تُحتسب لصالح النموذج ولا ضده. كيف يعمل التقييم
- +يتصدّر البرمجة الوكيلة طويلة الأمد، مع تتبّع قوي للأسباب الجذرية عبر جلسات متعددة الخطوات
- +أداء قوي في البحث العلمي الوكيل، منه عمل في تصميم البروتينات تذكر Anthropic أن نسبة إصابته تقارب 50%
- −تذكر Anthropic أن وضوح الرؤية يقل في التشغيل الطويل السياق ومتعدد الوكلاء مقارنة بالجلسات الأقصر
- −لا يزال قادرًا على تجاوز بوابات الموافقة أو مصنّفات الوضع التلقائي في بعض المهام الوكيلة، وفق اختبارات Anthropic نفسها
- +مصنّف الأول من بين 128 نموذجًا في ساحة WebDev على LMArena لبناء تطبيقات ويب عاملة، متقدمًا بوضوح على كل منافسيه
- +تذكر OpenAI نتائج هي الأفضل على FrontierMath وARC-AGI-3 واستخدام الحاسوب في OSWorld 2.0
- −في الاستخدام اليومي يفضّل الناس منافسين كثيرين عليه: المركز 49 من 402 في مسائل LMArena الصعبة، بفارق كبير خلف Claude
- −يستخدم أسلوب استدلال «التكرار المعتم» تقول OpenAI إن مراقبته أصعب في تدقيق سلسلة التفكير
- +استدلال وكيل من الطراز الأول، مع البحث وتنفيذ الشيفرة واستخدام الحاسوب في واجهة برمجية واحدة
- +مخرجات منضبطة وقليلة الهلوسة في المهام الطويلة متعددة الخطوات
- −الطلبات طويلة السياق فوق 272 ألف توكن تقريبًا يُعاد تسعيرها بارتفاع حاد
- −أبطأ من معظم منافسيه في إخراج أول إجابة عند أقصى درجات الاستدلال
- +النموذج الذي توصي به Anthropic للأعمال المعقدة وعالية المخاطر، بنسبة قوية بين الاستدلال والتكلفة
- +مؤهل لعدم الاحتفاظ بالبيانات، وهو مفيد للنشر في القطاعات المنظّمة أو المؤسسات
- −يقع دون فئة الصدارة في التسمية التجارية رغم نتائجه العملية القوية
- −تكلفته لكل توكن أعلى بوضوح من فئة Sonnet للمهام اليومية