آخر تحديث --:--
بيانات السوق المباشرة

بيتكوين...--| إيثريوم...--| بي إن بي...--| سولانا...--| ريبل...--| كاردانو...--| دوجكوين...--| ترون...--| تشين لينك...--| لايتكوين...--

⁦Claude Sonnet⁩ 5.5 يتفوق على ⁦Opus⁩ في اختبار برمجي لكن استهلاكه للرموز يرفع كلفة المهمة

استمع للمقال -- دقيقة
00:00
00:00

Claude Sonnet 5.5 يتفوق على Opus في اختبار برمجي لكن استهلاكه للرموز يرفع كلفة المهمة

يضع إطلاق Claude Sonnet 5.5 تكلفة المهمة، لا سعر الرمز وحده، في صلب المقارنة بين نماذج Anthropic. فقد أظهر اختبار مستقل تقدمه على Opus 5.5 في مهام الطرفية، لكنه سجل أيضاً أعلى استهلاك للرموز بين النماذج التي قاسها عند إعداد الجهد الأقصى.

أطلقت Anthropic نموذج Claude Sonnet 5.5 بتسعير يبلغ دولارين لكل مليون رمز إدخال و10 دولارات لكل مليون رمز إخراج، من دون تغيير عن Sonnet 5. ويعادل ذلك نصف سعر Claude Opus 5.5 لكل رمز، بحسب تقرير نشره موقع Decrypt في 28 سبتمبر 2026.

لكن السعر المعلن لكل مليون رمز لا يحسم بالضرورة تكلفة إنجاز المهمة. إذ تتغير الفاتورة بحسب عدد الرموز التي يستهلكها النموذج وإعداد «الجهد» الذي يتيح له التفكير لفترة أطول مقابل كلفة أعلى.

نتائج البرمجة تمنح Sonnet أفضلية على Opus

قالت Anthropic إن Sonnet 5.5 سجل 70.6% في Terminal-Bench 4.0، مقابل 66.4% لـ Opus 5.5 و10.3% لـ Sonnet 5. ويقيس الاختبار قدرة وكيل ذكاء اصطناعي على إتمام مهام مهنية معقدة عبر تنفيذ أوامر في بيئة طرفية.

وأظهرت نتائج جهة التقييم المستقلة Artificial Analysis تفوقاً مماثلاً، وإن بدرجات مختلفة: 63.6% لـ Sonnet 5.5، و59.6% لـ Opus 5.5، و59.1% لـ GPT-6 Astra. ويعني اختلاف الأرقام بين الجهتين أن النتائج ترتبط بإعدادات الاختبار والنسخة المستخدمة من النموذج ومنهجية احتساب النجاح.

وتقول Anthropic إن النموذج الجديد أسرع بأكثر من 30% من Sonnet 5، وإنه مناسب للمهام اليومية المحددة وإصلاح الأخطاء وإعداد المستندات والعروض والجداول. وهذه توصيفات صادرة عن الشركة، ولا يقدم المصدر قياسات مستقلة مفصلة للتحقق من السرعة أو جودة الاستخدامات المذكورة.

إعداد الجهد الأقصى يغيّر معادلة السعر

وفق Artificial Analysis، استهلك Sonnet 5.5 عند إعداد الجهد الأقصى نحو 193 ألف رمز لكل مهمة اختبار، وهو أعلى استهلاك سجلته الجهة بين النماذج التي اختبرتها، وبنحو 60% فوق Opus 5.5. وقدّرت كلفة المهمة عند 7.60 دولارات، أي أعلى بنحو 50% من Sonnet 5 وفق التقرير.

تبدو هذه النتيجة مخالفة لادعاء Anthropic بإمكان تحقيق وفر يصل إلى 30%، لكن المقارنتين لا تستخدمان الإعداد نفسه. فالشركة تربط التوفير بمستويات جهد أدنى، وتقول إن الإعداد المتوسط، وهو الافتراضي في تطبيقاتها، يتيح لـ Sonnet 5.5 تجاوز أفضل نتيجة برمجية لـ Sonnet 5 بكلفة تقل عن عُشرها.

لذلك، لا تكفي مقارنة أسعار الإدخال والإخراج وحدها عند اختيار نموذج للمؤسسات أو المطورين؛ فالأهم هو كلفة إتمام سير عمل محدد عند مستوى الجودة والجهد المطلوبين.

وفي المنافسة السعرية، ذكر التقرير أن OpenAI خفّضت سعر GPT-6 Sol إلى دولارين للإدخال و10 دولارات للإخراج لكل مليون رمز، بينما يبلغ تسعير GPT-5.6 Terra دولارين للإدخال و12 دولاراً للإخراج. ولم تنشر Anthropic مقارنات معيارية مع Terra، بحسب المصدر.

وتبقي Anthropic على Opus 5.5 كنموذج أقوى للأعمال المعقدة التي تحتاج إلى حكم مستمر عبر مراحل متعددة، وفق توصيفها. كما قالت إن Claude Haiku 5.5، الموجّه للتطبيقات واسعة النطاق والحساسة للكلفة، سيصدر خلال الأسابيع التالية.

وتبقى للبيانات حدودها: اختبار Artificial Analysis أُجري على نسخة ما قبل الإطلاق احتوت على خلل برمجي، وقالت Anthropic إن أثره كان محدوداً أو ربما أدى إلى تقليل نتائج النموذج قليلاً. كما تقيس الاختبارات المعيارية حالات محددة، ولا تثبت وحدها تفوقاً عاماً أو كلفة تشغيل أدنى في بيئات الإنتاج.

اقرأ أيضاً

حول المصدر

المعلومات الأساسية في هذا التقرير مأخوذة من Decrypt.

فتح المصدر الأصلي

مقالات ذات صلة

أسواق أكثر. حساب واحد.
bStocks · Stock Options · TradFi Perps على Binance

رابط إحالة تجاري: قد يحصل الموقع على عمولة أو منفعة عند التسجيل أو الاستخدام عبره. لا يمثل توصية استثمارية.