Anthropic

Claude Sonnet 5.5

قيد التقييم
الجهة الصانعة
Anthropic
المنشأ
الولايات المتحدة
تاريخ الإصدار
28 سبتمبر 2026

نقاط القوة والضعف

  • تذكر Anthropic أنه يُخرج الإجابات بسرعة تزيد 30% على الأقل عن Sonnet 5، ويحتاج رموزًا أقل لكثير من المهام نفسها
  • متاح عبر Anthropic وAWS وGoogle Cloud وAzure بسعر دولارين للمدخلات و10 دولارات للمخرجات لكل مليون رمز
  • صدر في 28 سبتمبر، ولم تتوافر له بعد قياسات مستقلة تستوفي شروط التقييم في هذا الدليل
  • تضع Anthropic نموذج Opus 5.5 فوقه في العمل المعقّد الذي يحتاج حكمًا متأنيًا
الموقع
www.anthropic.com

التقييم

قيد القياس · 20% مقاس

قُيّم على Claude Sonnet 5.5 · بيانات المصادر حتى 29 سبتمبر 2026

  • Reasoningw45—

    لا يوجد قياس مستقل بعد

  • Accuracyw20—

    لا يوجد قياس مستقل بعد

  • Writingw15—

    لا يوجد قياس مستقل بعد

  • Long contextw209.9

    قاعدة B1,000,000 tokens · المقياس 8,192–1,048,576 توكن، من 0 إلى 10 · OpenRouter, context window · 29 سبتمبر 2026

السعر والإتاحة

مقاسان بالطريقة نفسها، وخارج الدرجة عن عمد: تكلفة النموذج لا تغيّر ما يستطيع فعله.

w = الوزن، أي حصة كل معيار من الدرجة الإجمالية. والدرجات الغائبة لا تُحتسب لصالح النموذج ولا ضده. كيف يعمل التقييم

المزيد في نماذج اللغة

عرض الكل →
Meta
  • أول خط متقدم لـ Meta بعد انصرافها عن Llama، متعدد الوسائط أصالةً عبر النص والصورة والفيديو بسعر 1.25/4.25 دولار لكل مليون رمز
  • تذكر Meta انخفاضًا يقارب 20% في استدعاءات الأدوات و25% في الرموز مقارنةً بـ Muse Spark 1.2 في العمل الوكيل نفسه
  • مغلق المصدر، بما ينهي موقع الأوزان المفتوحة الذي منحته Llama لـ Meta، ويخدمه مزوّد واحد على OpenRouter
  • المركز العاشر من 409 في ساحة النصوص العامة على LMArena — قوي لكنه خلف نماذج Anthropic وGoogle فوقه
Google
  • أعلى نموذج تقييمًا في الدليل في مسائل LMArena الصعبة بعد خط Opus من Anthropic، على 14,320 صوتًا
  • تذكر Google نتيجة 90.8% في Terminal-Bench 2.1 صعودًا من 81.6% لـ 3.7 Flash، بسعر 0.75/3.75 دولار لكل مليون رمز
  • مبني على 3.7 Flash لا على نموذج أساس جديد، وتنصح Google بالبقاء على 3.7 للأعمال التي تقدّم الكفاءة
  • ينفق رموز تفكير أكثر بحكم التصميم، فالسعر المعلن أقل مما تكلفه المهمة فعلًا
Moonshot AI
9.4/10
  • أكبر إصدار مفتوح الأوزان حتى الآن بـ 2.8 تريليون معامل منها 104 مليارات نشطة، ويخدمه 17 مزوّدًا مستقلًا
  • تذكر Moonshot نتيجة 81.2 في FrontierSWE و88.3 في Terminal-Bench 2.1، وترتّبه LMArena الثامن من 133 في WebDev
  • 3/15 دولارًا لكل مليون رمز، أي أضعاف سعر النماذج مفتوحة الأوزان التي ينافسها
  • رخصته مفتوحة إلى حد: فأعمال النموذج-كخدمة التي تتجاوز 20 مليون دولار سنويًا تحتاج اتفاقًا منفصلًا
Alibaba
  • المركز السادس من 133 في ساحة WebDev على LMArena، أعلى النماذج غير الرائدة تقييمًا في بناء تطبيقات ويب عاملة
  • خليط خبراء بـ 2.4 تريليون معامل منها نحو 95 مليارًا نشطة ونافذة مليون رمز، بسعر 2/6 دولارات لكل مليون رمز
  • يخسر أمام GLM-5.3 في سبعة من ثمانية مقاييس ينشرها الطرفان، وبأضعاف السعر
  • يخدمه مزوّد واحد على OpenRouter، فلا بديل عند تعذّره