100 نموذج ذكاء اصطناعي،
تحت المجهر.
دليل عملي للنماذج التي تشكّل الذكاء الاصطناعي في اللغة والبرمجة والصورة والفيديو والصوت وبيئة المؤسسات. يوضّح ما يتفوق فيه كل نموذج فعليًا، وأين يقصّر، ومن أين جاء، ومتى صدر.
- نماذج مرصودة
- 100
- فئات
- 06
- دول المنشأ
- 12
- حالات استخدام
- 116
الأعلى تقييمًا
37 نموذجًا لديها قياسات مستقلة كافية للتقييم. تُقيَّم كل فئة وفق معاييرها الخاصة، لذا يبقى هذا العرض المختلط دليلًا تقريبيًا — استخدم التبويبات للمقارنة بين المتماثلات.
الأعلى تقييمًا
- 01Claude Fable 5.1Anthropic · United States · نماذج اللغةيقوده الاستدلال — 1,526 rating في مسائل LMArena الصعبة، وهو الأعلى مناصفةً بين نماذج اللغة.9.6
- 02Claude Opus 5Anthropic · United States · نماذج اللغةيقوده الاستدلال — 1,525 rating في مسائل LMArena الصعبة، وهو الأعلى مناصفةً بين نماذج اللغة.متعادل إحصائيًا مع #19.6
- 03GPT-5.6OpenAI · United States · نماذج اللغةيقوده الاستدلال — 1,481 rating في مسائل LMArena الصعبة، وهو الثالث بين نماذج اللغة.9.2
- 04DeepSeek V4DeepSeek · China · نماذج اللغةيقوده الكتابة — 1,446 rating في الكتابة الإبداعية على LMArena، وترتيبه 6 من 21 من نماذج اللغة.متعادل إحصائيًا مع #39.1
- 05Gemini 3 FlashGoogle · United States · نماذج اللغةيقوده الكتابة — 1,457 rating في الكتابة الإبداعية على LMArena، وهو الرابع بين نماذج اللغة.متعادل إحصائيًا مع #39.1
- 06GPT-6 AstraOpenAI · United States · نماذج اللغةيقوده الكتابة — 1,423 rating في الكتابة الإبداعية على LMArena، وترتيبه 9 من 21 من نماذج اللغة.متعادل إحصائيًا مع #39.1
لا يُنشر سوى الصدارة. فكلما نزلنا في الترتيب صارت الدرجات في معظمها لنماذج أقدم محفوظة للرجوع إليها، أو لنماذج بالكاد تملك قياسات تكفي للتقييم، ما يجعل جدول «الأدنى تقييمًا» حديثًا عن ثغرات الأدلة أكثر منه عن المنتجات. وصفحة كل نموذج تعرض درجاته وما ينقصه.
تقيس الدرجة القدرة فقط: السعر والإتاحة مقاسان أيضًا، لكنهما يظهران في صفحة كل نموذج بدل دمجهما في هذا الرقم. وتُحتسب الدرجات عند الحد الأدنى لنطاق الثقة لكل مصدر، والنماذج المتداخلة النطاقات تُعلَّم متعادلة لأن الأدلة لا تفرّق بينها. أما النماذج التي تقل قياساتها المستقلة عن الحد المطلوب فهي قيد التقييم ولا تظهر هنا إطلاقًا. كيف يعمل التقييم
نماذج صُنعت في العالم العربي
مرتّبة بحسب إجادتها للعربية — وهو ما لا تقوله الدرجات أعلاه، لأن المقاييس التي تقف وراءها تُجرى بالإنجليزية. وتنشر لوحتان مستقلتان قياسًا للعربية في صورة يمكن قراءتها والتحقق منها، وهما تختبران أمرين مختلفين، فأُفردت لكل واحدة علامة تبويب بدل متوسط لا يعبّر عن أيٍّ منهما.
أجوبة عربية حرة، يقيّمها نموذج حَكَم على ست صفات: الصحة والاكتمال والإيجاز والنفع والصدق وعدم الإضرار. وتنشر اللوحة فاصلًا ثقةً بنسبة 95% بطريقة bootstrap، فالعلامة هنا هي طرفه الأدنى، والنماذج التي تتقاطع فواصلها تُعدّ متعادلة.
AraGen v367 نموذجًا مقاسًا، آخرها في 4 أبريل 2026
- 01Jais 2 70B ChatInception · UAEدُرّب من الصفر على العربية والإنجليزية بتعاون بين Inception وMBZUAI وCerebras، بمفردات عربية أولًا مبنية للعربية الفصحى واللهجات المحلية والتبديل بين العربية والإنجليزية. أوزانه مفتوحة برخصة Apache 2.0، إلا أن نافذته البالغة 8,192 رمزًا قصيرة بمقاييس اليوم.0.52 3C3H (0.48–0.57) · المركز 18 من 67 مقاسًا هنا · 14 ديسمبر 20254.8
- 02Falcon H1 34B InstructTII · UAEنموذج أبوظبي الهجين بين Transformer وMamba، بـ 34 مليار معامل يغطي 18 لغة لا العربية وحدها. وقد أصدر TII بعده Falcon-H1-Arabic، وهو نسخة متخصصة في العربية لم تقِسها أي من لوحتي القياس هنا بعد.0.46 3C3H (0.41–0.51) · المركز 28 من 67 مقاسًا هنا · 28 سبتمبر 2025متعادل إحصائيًا مع #14.1
- 03Fanar 1 9B InstructQCRI · Qatarنموذج قطر، استُكمل تدريبه من Gemma 2 على تريليون رمز عربي وإنجليزي في QCRI، ويغطي اللهجات الخليجية والشامية والمصرية، ومُواءَم عن قصد مع القيم الإسلامية والثقافة العربية. نافذته 4,096 رمزًا، وقد أعلن QCRI بعده Fanar 2.0 بـ 27 مليار معامل لم تقِسه أي من اللوحتين.0.16 3C3H (0.12–0.20) · المركز 54 من 67 مقاسًا هنا · 30 سبتمبر 20251.2
وللمقارنة، أعلى علامة على هذه اللوحة هي 8.2، يحملها gpt-5-2025-08-07 — وهو نموذج صُنع خارج المنطقة.
لم تقِسه هذه اللوحة بعد: Karnak, Yehia 7B, ALLaM 7B Instruct.
تختلف اللوحتان على بعض هذه النماذج، والخلاف يستحق القراءة لا التذويب في متوسط: فالمقاييس الاختبارية أكثرها اختيار من متعدد، ويمكن تدريب النموذج على إجادته، أما AraGen فيحكم على أجوبة يقرأها إنسان فعلًا. والنموذج الذي يتصدّر إحداهما ويتأخر في الأخرى يقول عن نفسه شيئًا حقيقيًا.
تتبع العلامات القاعدة نفسها المتّبعة في بقية الموقع: نسبة منشورة مقسومة على 10، لا تقدير أبدًا. وهذه النماذج مفصولة عن المئة في الدليل لأنها تُقاس بمقاييس أخرى وفي ميدان آخر — فمركزها هنا لا يقول شيئًا عن موقعها عالميًا، ومركزها هناك لا يقول شيئًا عن عربيتها. كيف يعمل التقييم
نافذة السياق، كل النماذج في مشهد واحد
- Claude Fable 5.1
- GPT-6 Astra
- GPT-5.6
- Claude Opus 5
- Claude Sonnet 5
- Claude Haiku 4.5
- Gemini 3 Pro
- Gemini 3 Flash
- Grok 4.6
- DeepSeek V4
- GLM-5
- Qwen3-Max
- Llama 4
- Mistral Medium 3.5
- Gemma 4
- Phi-4
- Mistral Small 4
- Kimi K2
- ERNIE 5.0
- Nemotron 3 Ultra
- Jamba 2
- Hunyuan Large
- Reka Flash 3
- Grok 4 Fast
- Doubao 1.5
- Solar Pro 2
- Yi-Lightning
- Aya Expanse
- GPT-4o
- Command R+
- GPT-5.3 Codex
- Claude Opus 4.6 (Claude Code)
- Qwen3 Coder 480B
- Cursor Composer
- MiniMax M2.1
- Devin
- GitHub Copilot
- Amazon Q Developer
- Windsurf
- Tabnine
- Replit Agent
- Aider
- Gemini 3 Flash
- Gemini 3 Pro
- GLM-5
- Claude Haiku 4.5
- GPT-6 Astra
- Midjourney V8.1
- GPT Image 2
- Gemini 3 Pro Image
- FLUX.2
- Ideogram 4
- Recraft V4.1
- Adobe Firefly Image 5
- Seedream 5.0
- Grok Imagine Image
- DALL-E 3
- Stable Diffusion 3.5
- Leonardo AI
- Playground v3
- NightCafe
- Microsoft Designer
- Kandinsky 4
- Luma Photon
- Freepik Mystic
- Veo 3.1
- Sora 2
- Kling 3
- Runway Gen-4.5
- Seedance 2
- Luma Ray 3.2
- MiniMax Hailuo 2.3
- Wan 2.7
- Grok Imagine Video
- Pika 2.5
- CogVideoX
- Haiper 2.5
- Vidu Q3
- Genmo Mochi 1
- LTX-2.3
- HunyuanVideo 1.5
- Synthesia
- D-ID
- Suno v5
- Udio v4
- ElevenLabs (Voice & Music)
- Google Lyria 3
- MiniMax Music 2.5
- Stable Audio 2.5
- Whisper
- Murf AI
- Play.ht (PlayAI)
- WellSaid Labs
- Descript Overdub
- AIVA
- Boomy
- Amazon Polly
- Perplexity Sonar / Deep Research
- NotebookLM
- Cohere Command A+
- Amazon Nova
- Glean
- Microsoft 365 Copilot
- You.com
- Writer Palmyra
في هذا الدليل
آخر ما صدر
من أين تأتي النماذج
دولة المقر الرئيسي لكل جهة صانعة. تتركّز الصدارة في بلدين، لكن أوروبا والخليج وإسرائيل وآسيا والمحيط الهادئ تصدر جميعها نماذج تستحق المتابعة.
- الولايات المتحدة57
- الصين19
- المملكة المتحدة6
- كندا4
- إسرائيل4
- أستراليا2
- فرنسا2
- ألمانيا1
- لوكسمبورغ1
- روسيا1
- كوريا الجنوبية1
- إسبانيا1