لمعظم أعمال الكتابة والمستندات والجداول والبرمجة اليومية، يبدو Sonnet 5.5 كافيًا بنصف سعر Opus 5.5 تقريبًا. تبقى أفضلية Opus في البرمجة المفتوحة الطويلة. هذا ما تقوله أرقام Anthropic نفسها ومراجعات ناقلة عنها، وليس نتيجة اختبار أجريناه.
أطلقت Anthropic Claude Sonnet 5.5 في 28 سبتمبر 2026، بعد ستة أيام من Opus 5.5. تصفه الشركة بأنه «ترقية واضحة على Sonnet 5، أسرع بنسبة 30% وأرخص بنسبة تصل إلى 30% لمعظم الأعمال».
الأرقام التي أعلنتها Anthropic
| البند | Sonnet 5.5 | ملاحظة |
|---|---|---|
| سعر الإدخال (لكل مليون توكن) | 2 دولار | نفس سعر Sonnet 5 |
| سعر الإخراج (لكل مليون توكن) | 10 دولارات | Opus 5.5 نحو ضعف السعر (4 و20) بحسب مراجعات |
| Terminal-Bench 4.0 | 70.6% | كان 10.3% لـ Sonnet 5؛ وذُكر لـ Opus 5.5 نحو 66.4% |
| OSWorld 2.1 | 80.1% | مقابل 81.8% لـ Opus 5.5 بحسب تقارير |
| GDPval-AA v2.1 | 1844 | شبه تعادل مع Opus 5.5 (1846) |
هذه معايير نشرتها الشركة وتقارير ناقلة عنها، مثل AI Weekly وCodersera، لا اختبارات مستقلة بالكامل. وتتغير الأرقام كثيرًا حسب مستوى «الجهد» (effort) المضبوط؛ ففي FrontierCode يتقدم Opus بفارق 8.2 نقطة عند الجهد الأقصى، ويضيق إلى 2.3 نقطة عند مستوى xhigh بحسب تلك التقارير.
أين تجده؟
متاح الآن في تطبيق Claude وعبر منصة Claude (المعرّف claude-sonnet-5-5) وعلى AWS وGoogle Cloud وMicrosoft Azure، مع خيار عدم الاحتفاظ بالبيانات. لم تذكر صفحة الإطلاق ما إذا كان متاحًا في الخطة المجانية، فتأكد من تطبيقك. وللمقارنة بين خطط Claude وChatGPT وGemini راجع مقارنة الخطط والأسعار.
ما الذي تحسّن فعلًا؟
- سرعة توليد أعلى بأكثر من 30% عن Sonnet 5.
- قفزة كبيرة في البرمجة عبر سطر الأوامر، وفق Terminal-Bench.
- وضوح أفضل في الكتابة والتعاون، وفهم أدق للصور بحسب Anthropic.
- ضمانات أمنية للأمن السيبراني بمستوى Opus 5.5، وحماية من «هجمات التقطير».
متى يبقى Opus 5.5 هو الخيار؟
إن كان عملك برمجة مفتوحة طويلة، أو مهامًا يكلّفك فيها الخطأ الواحد وقتًا أو مالًا، فالفارق في FrontierCode عند الجهد الأقصى يبرر الدفع الأعلى. أما تحرير المستندات وتحليل الجداول وكتابة التقارير والمهام الوكيلة المتكررة فالأرقام المنشورة تضع Sonnet قريبًا جدًا من Opus بنصف التكلفة تقريبًا.
إن كنت مطورًا يدفع بالتوكن فالسعر هو الخبر. وإن كنت مستخدمًا عاديًا فاختر النموذج الذي يعرضه تطبيقك، وانتظر مراجعات مستقلة تقارن الاثنين على المهام العربية.