OpenAI

GPT-5.3 Codex

قيد التقييم
الجهة الصانعة
OpenAI
المنشأ
الولايات المتحدة
تاريخ الإصدار
5 فبراير 2026

نقاط القوة والضعف

  • أتمتة ممتازة لسطر الأوامر وعمليات git وتتبّع أعطال CI/CD
  • أوفر بكثير في التوكن من منافسيه كثيفي الاستدلال في المهام الروتينية
  • يحتاج تعليمات مفصّلة لا لبس فيها؛ ويتعثّر مع الطلبات المبهمة
  • نافذة سياق أصغر من بعض منافسيه، وهو قيد على المستودعات الضخمة

التقييم

قيد القياس · 55% مقاس

قُيّم على GPT-5.3 Codex · بيانات المصادر حتى 26 سبتمبر 2026

  • Code qualityw45—

    لا يوجد قياس مستقل بعد

  • Web developmentw404.6

    قاعدة B1,408 rating (95% 1,394–1,422) من 2,643 صوتًا · المقياس 1,050–1,800، من 0 إلى 10 · LMArena WebDev arena (gpt-5.3-codex (codex-harness)) · 25 سبتمبر 2026

  • Codebase contextw158.0

    قاعدة B400,000 tokens · المقياس 8,192–1,048,576 توكن، من 0 إلى 10 · OpenRouter, context window · 26 سبتمبر 2026

السعر والإتاحة

مقاسان بالطريقة نفسها، وخارج الدرجة عن عمد: تكلفة النموذج لا تغيّر ما يستطيع فعله.

  • Cost efficiencyخارج التقييم2.9

    قاعدة B$4.81 per 1M tokens (blended) · المقياس 30–0.05، من 0 إلى 10 · OpenRouter, blended price per token · 26 سبتمبر 2026

w = الوزن، أي حصة كل معيار من الدرجة الإجمالية. والدرجات الغائبة لا تُحتسب لصالح النموذج ولا ضده. كيف يعمل التقييم

المزيد في البرمجة والوكلاء

عرض الكل →
Anthropic
  • قوي في استنتاج المقصود من الطلبات المبهمة ومن السياق المعماري
  • سياق بمليون توكن يدعم إعادة هيكلة متماسكة عبر ملفات ومستودعات متعددة
  • قد يستهلك توكن أكثر بكثير من نماذج برمجية أخف في العمل الروتيني
  • يسرد استدلاله بإسهاب، ما يبطئ المهام السريعة
Alibaba
  • أداء مفتوح الأوزان قريب من المتصدّرين المملوكين
  • مجاني للاستضافة الذاتية، وجذاب للفرق الحساسة للتكلفة أو المعزولة عن الإنترنت
  • يحتاج بنية تحتية جادة لتشغيله بحجمه الكامل
  • أدواته وتكاملاته مع بيئات التطوير أقل نضجًا من Copilot أو Cursor أو Codex
Cursor
قيد التقييم
  • حلقة تغذية راجعة فورية ومحكمة؛ ترى كل تغيير وتوجّهه
  • تسعير ثابت معقول للمساعدة طوال اليوم
  • يحتاج مطوّرًا يقوده فعليًا؛ وليس مبنيًا للتشغيل دون إشراف
  • وضع الوكيل الخلفي وغير المتزامن لا يزال مبكرًا ومحدودًا
MiniMax
قيد التقييم
  • بديل منخفض التكلفة يصمد بشكل معقول في اختبارات البرمجة
  • خيار جيد للمهام الاستكشافية المتوازية عالية الحجم
  • متأخر بوضوح عن متصدّري البرمجة في المسائل الصعبة
  • منظومة ودعم مجتمعي أصغر من منافسيه الأكبر