- أتمتة ممتازة لسطر الأوامر وعمليات git وتتبّع أعطال CI/CD
- أوفر بكثير في التوكن من منافسيه كثيفي الاستدلال في المهام الروتينية
- يحتاج تعليمات مفصّلة لا لبس فيها؛ ويتعثّر مع الطلبات المبهمة
- نافذة سياق أصغر من بعض منافسيه، وهو قيد على المستودعات الضخمة
النموذج نفسه المدرج باسم GLM-5 ضمن نماذج اللغة، ومدرج هنا مرة أخرى لأنه يُستخدم نموذجًا برمجيًا ويُقيَّم وفق معايير تلك الفئة. ويُحتسب مرة واحدة في إجماليات الدليل.
قُيّم على GLM-5 · بيانات المصادر حتى 26 سبتمبر 2026
نطاق الثقة 6.3–6.4 · أي نموذج داخل هذا النطاق لا يفصله فارق ذو معنى عن هذا النموذج
قاعدة A72.8% resolved · 72.8% ÷ 10 · SWE-bench Verified, % resolved (mini-SWE-agent harness) (GLM 5) · 17 فبراير 2026
قاعدة B1,434 rating (95% 1,426–1,442) من 7,504 صوتًا · المقياس 1,050–1,800، من 0 إلى 10 · LMArena WebDev arena (glm-5) · 25 سبتمبر 2026
قاعدة B204,800 tokens · المقياس 8,192–1,048,576 توكن، من 0 إلى 10 · OpenRouter, context window · 26 سبتمبر 2026
مقاسان بالطريقة نفسها، وخارج الدرجة عن عمد: تكلفة النموذج لا تغيّر ما يستطيع فعله.
قاعدة B$0.93 per 1M tokens (blended) · المقياس 30–0.05، من 0 إلى 10 · OpenRouter, blended price per token · 26 سبتمبر 2026
w = الوزن، أي حصة كل معيار من الدرجة الإجمالية. والدرجات الغائبة لا تُحتسب لصالح النموذج ولا ضده. كيف يعمل التقييم