Claude Sonnet 5.5 يتفوق على Opus في اختبار برمجي لكن استهلاكه للرموز يرفع كلفة المهمة
يضع إطلاق Claude Sonnet 5.5 تكلفة المهمة، لا سعر الرمز وحده، في صلب المقارنة بين نماذج Anthropic. فقد أظهر اختبار مستقل تقدمه على Opus 5.5 في مهام الطرفية، لكنه سجل أيضاً أعلى استهلاك للرموز بين النماذج التي قاسها عند إعداد الجهد الأقصى.
أطلقت Anthropic نموذج Claude Sonnet 5.5 بتسعير يبلغ دولارين لكل مليون رمز إدخال و10 دولارات لكل مليون رمز إخراج، من دون تغيير عن Sonnet 5. ويعادل ذلك نصف سعر Claude Opus 5.5 لكل رمز، بحسب تقرير نشره موقع Decrypt في 28 سبتمبر 2026.
لكن السعر المعلن لكل مليون رمز لا يحسم بالضرورة تكلفة إنجاز المهمة. إذ تتغير الفاتورة بحسب عدد الرموز التي يستهلكها النموذج وإعداد «الجهد» الذي يتيح له التفكير لفترة أطول مقابل كلفة أعلى.
نتائج البرمجة تمنح Sonnet أفضلية على Opus
قالت Anthropic إن Sonnet 5.5 سجل 70.6% في Terminal-Bench 4.0، مقابل 66.4% لـ Opus 5.5 و10.3% لـ Sonnet 5. ويقيس الاختبار قدرة وكيل ذكاء اصطناعي على إتمام مهام مهنية معقدة عبر تنفيذ أوامر في بيئة طرفية.
وأظهرت نتائج جهة التقييم المستقلة Artificial Analysis تفوقاً مماثلاً، وإن بدرجات مختلفة: 63.6% لـ Sonnet 5.5، و59.6% لـ Opus 5.5، و59.1% لـ GPT-6 Astra. ويعني اختلاف الأرقام بين الجهتين أن النتائج ترتبط بإعدادات الاختبار والنسخة المستخدمة من النموذج ومنهجية احتساب النجاح.
وتقول Anthropic إن النموذج الجديد أسرع بأكثر من 30% من Sonnet 5، وإنه مناسب للمهام اليومية المحددة وإصلاح الأخطاء وإعداد المستندات والعروض والجداول. وهذه توصيفات صادرة عن الشركة، ولا يقدم المصدر قياسات مستقلة مفصلة للتحقق من السرعة أو جودة الاستخدامات المذكورة.
إعداد الجهد الأقصى يغيّر معادلة السعر
وفق Artificial Analysis، استهلك Sonnet 5.5 عند إعداد الجهد الأقصى نحو 193 ألف رمز لكل مهمة اختبار، وهو أعلى استهلاك سجلته الجهة بين النماذج التي اختبرتها، وبنحو 60% فوق Opus 5.5. وقدّرت كلفة المهمة عند 7.60 دولارات، أي أعلى بنحو 50% من Sonnet 5 وفق التقرير.
تبدو هذه النتيجة مخالفة لادعاء Anthropic بإمكان تحقيق وفر يصل إلى 30%، لكن المقارنتين لا تستخدمان الإعداد نفسه. فالشركة تربط التوفير بمستويات جهد أدنى، وتقول إن الإعداد المتوسط، وهو الافتراضي في تطبيقاتها، يتيح لـ Sonnet 5.5 تجاوز أفضل نتيجة برمجية لـ Sonnet 5 بكلفة تقل عن عُشرها.
لذلك، لا تكفي مقارنة أسعار الإدخال والإخراج وحدها عند اختيار نموذج للمؤسسات أو المطورين؛ فالأهم هو كلفة إتمام سير عمل محدد عند مستوى الجودة والجهد المطلوبين.
وفي المنافسة السعرية، ذكر التقرير أن OpenAI خفّضت سعر GPT-6 Sol إلى دولارين للإدخال و10 دولارات للإخراج لكل مليون رمز، بينما يبلغ تسعير GPT-5.6 Terra دولارين للإدخال و12 دولاراً للإخراج. ولم تنشر Anthropic مقارنات معيارية مع Terra، بحسب المصدر.
وتبقي Anthropic على Opus 5.5 كنموذج أقوى للأعمال المعقدة التي تحتاج إلى حكم مستمر عبر مراحل متعددة، وفق توصيفها. كما قالت إن Claude Haiku 5.5، الموجّه للتطبيقات واسعة النطاق والحساسة للكلفة، سيصدر خلال الأسابيع التالية.
وتبقى للبيانات حدودها: اختبار Artificial Analysis أُجري على نسخة ما قبل الإطلاق احتوت على خلل برمجي، وقالت Anthropic إن أثره كان محدوداً أو ربما أدى إلى تقليل نتائج النموذج قليلاً. كما تقيس الاختبارات المعيارية حالات محددة، ولا تثبت وحدها تفوقاً عاماً أو كلفة تشغيل أدنى في بيئات الإنتاج.
اقرأ أيضاً
- Anthropic تختار Accenture وFaculty لتقييم نماذج الذكاء الاصطناعي
- أسهم ديل تقفز 9% بعد رفع توقعات 2027 بدعم من خوادم الذكاء الاصطناعي
- طفرة الذكاء الاصطناعي في كوريا الجنوبية تعيد تشكيل المواعدة والتعليم والإعلام
حول المصدر
المعلومات الأساسية في هذا التقرير مأخوذة من Decrypt.
الانضمام إلى المحادثة