DeepSeek V4.1 FlashDeepSeek V4.1 Flash
9.2/10
- الجهة الصانعة
- DeepSeek
- تاريخ الإصدار
- 10 سبتمبر 2026
نقاط القوة والضعف
- +برخصة MIT وقابل للتنزيل، بـ 552 مليار معامل منها 8 مليارات نشطة فقط، ويخدمه 27 مزوّدًا مستقلًا
- +تذكر DeepSeek نتيجة 74.2% في Deep-SWE v1.1، متقدمًا على Opus 5 (74.0%) وGPT-5.6 Sol (73.0%)
- −المركز 36 من 409 في ساحة النصوص العامة على LMArena، بعيدًا خلف النماذج الرائدة التي يوازيها في مقاييس البرمجة المنشورة
- −نموذج من طبقة Flash بحكم التصميم: وخط Pro من DeepSeek نفسها أقوى في الرياضيات والاستدلال الطويل
التقييم
80% من الوزن مقاسقُيّم على DeepSeek V4.1 Flash (Max) · بيانات المصادر حتى 26 سبتمبر 2026
نطاق الثقة 9.2–9.4 · أي نموذج داخل هذا النطاق لا يفصله فارق ذو معنى عن هذا النموذج
Reasoningw459.1
قاعدة B1,485 rating (95% 1,476–1,494) من 4,357 صوتًا · المقياس 700–1,550، من 0 إلى 10 · LMArena text arena, hard prompts (deepseek-v4.1-flash-max) · 25 سبتمبر 2026
Accuracyw20—
لا يوجد قياس مستقل بعد
Writingw158.4
قاعدة B1,436 rating (95% 1,419–1,453) من 1,297 صوتًا · المقياس 750–1,550، من 0 إلى 10 · LMArena text arena, creative writing (deepseek-v4.1-flash-max) · 25 سبتمبر 2026
Long contextw2010.0
قاعدة B1,048,576 tokens · المقياس 8,192–1,048,576 توكن، من 0 إلى 10 · OpenRouter, context window · 26 سبتمبر 2026
السعر والإتاحة
مقاسان بالطريقة نفسها، وخارج الدرجة عن عمد: تكلفة النموذج لا تغيّر ما يستطيع فعله.
w = الوزن، أي حصة كل معيار من الدرجة الإجمالية. والدرجات الغائبة لا تُحتسب لصالح النموذج ولا ضده. كيف يعمل التقييم
- +أول خط متقدم لـ Meta بعد انصرافها عن Llama، متعدد الوسائط أصالةً عبر النص والصورة والفيديو بسعر 1.25/4.25 دولار لكل مليون رمز
- +تذكر Meta انخفاضًا يقارب 20% في استدعاءات الأدوات و25% في الرموز مقارنةً بـ Muse Spark 1.2 في العمل الوكيل نفسه
- −مغلق المصدر، بما ينهي موقع الأوزان المفتوحة الذي منحته Llama لـ Meta، ويخدمه مزوّد واحد على OpenRouter
- −المركز العاشر من 409 في ساحة النصوص العامة على LMArena — قوي لكنه خلف نماذج Anthropic وGoogle فوقه
- +أعلى نموذج تقييمًا في الدليل في مسائل LMArena الصعبة بعد خط Opus من Anthropic، على 14,320 صوتًا
- +تذكر Google نتيجة 90.8% في Terminal-Bench 2.1 صعودًا من 81.6% لـ 3.7 Flash، بسعر 0.75/3.75 دولار لكل مليون رمز
- −مبني على 3.7 Flash لا على نموذج أساس جديد، وتنصح Google بالبقاء على 3.7 للأعمال التي تقدّم الكفاءة
- −ينفق رموز تفكير أكثر بحكم التصميم، فالسعر المعلن أقل مما تكلفه المهمة فعلًا
- +أكبر إصدار مفتوح الأوزان حتى الآن بـ 2.8 تريليون معامل منها 104 مليارات نشطة، ويخدمه 17 مزوّدًا مستقلًا
- +تذكر Moonshot نتيجة 81.2 في FrontierSWE و88.3 في Terminal-Bench 2.1، وترتّبه LMArena الثامن من 133 في WebDev
- −3/15 دولارًا لكل مليون رمز، أي أضعاف سعر النماذج مفتوحة الأوزان التي ينافسها
- −رخصته مفتوحة إلى حد: فأعمال النموذج-كخدمة التي تتجاوز 20 مليون دولار سنويًا تحتاج اتفاقًا منفصلًا
- +المركز السادس من 133 في ساحة WebDev على LMArena، أعلى النماذج غير الرائدة تقييمًا في بناء تطبيقات ويب عاملة
- +خليط خبراء بـ 2.4 تريليون معامل منها نحو 95 مليارًا نشطة ونافذة مليون رمز، بسعر 2/6 دولارات لكل مليون رمز
- −يخسر أمام GLM-5.3 في سبعة من ثمانية مقاييس ينشرها الطرفان، وبأضعاف السعر
- −يخدمه مزوّد واحد على OpenRouter، فلا بديل عند تعذّره