تخيّل مكتبًا فيه شخصان متمرّسان. الأولى هي الشريكة التي تستدعيها إلى الاجتماع حين تكون القضية غير مألوفة والرهان كبيرًا. والثاني هو الزميل الذي ينجز كومة الأسبوع، أربعين رسالة وثلاثة جداول بيانات وعرضًا تقديميًا ليوم الخميس، بسرعة وإتقان.
معظمنا يحتاج إلى الشخص الثاني أكثر بكثير من الأول. Claude Sonnet 5.5 هو ذلك الزميل.
أطلقته Anthropic في 28 سبتمبر 2026، بعد أسبوع من Claude Opus 5.5، بوصفه النموذج الثاني في عائلة Claude 5.5. وهو مصمم ليكون الرفيق اليومي لـ Opus. وبعبارة Anthropic، صُنع Opus للعمل المعقد الذي يتطلب حكمًا دقيقًا، بينما يكون Sonnet 5.5 في أقوى حالاته مع المهام اليومية محددة النطاق، وإصلاح الأخطاء، وإعداد المستندات والعروض وجداول البيانات المتقنة.
إلى أي حد يقترب من Opus؟
أكثر مما قد تتوقع، على الأقل في الاختبارات المستقلة.
تجري Artificial Analysis اختبارين يدوران حول العمل المهني المكتمل لا حول أسئلة المسابقات. في GDPval-AA v2.1 تنتج النماذج مخرجات حقيقية، مثل نموذج مالي أو مذكرة قانونية أو إحاطة، وتُقارن النتائج وجهًا لوجه كما في مباريات الشطرنج. سجّل Sonnet 5.5 1844 Elo، وحصل Opus 5.5 على 1846، وهو فارق أصغر من أن يُعتدّ به. وفي اختبار AA-Briefcase الأحدث، الذي يقيس العمل المعرفي الأطول متعدد الخطوات، سجّل 1811 مقابل 1822 لـ Opus.
وأوسع مقياس مستقل هو مؤشر الذكاء من Artificial Analysis، وهو نتيجة مركّبة من تقييمات صعبة. عند مستوى max سجّل Sonnet 5.5 56 نقطة، ولم يتقدم عليه سوى Opus 5.5 بـ 58.
هذه قفزة كبيرة لنموذج من فئة Sonnet. فسلفه Sonnet 5 سجّل 1449 في GDPval-AA. وعمليًا يعني ذلك أن العمل المكتبي الذي كان يحتاج إلى النموذج الرائد يمكن أن يذهب الآن إلى النموذج الأرخص والأسرع.
أين يبقى Opus متقدمًا
هناك مجالان يكون فيهما الفارق حقيقيًا.
الحقائق. يطرح اختبار AA-Omniscience من Artificial Analysis آلاف الأسئلة عن الحقائق. أجاب Sonnet 5.5 إجابة صحيحة عن 54% منها، وOpus 5.5 عن 66%. فالنموذج الأصغر يختزن معرفة أقل ببساطة. لكن هناك جانبًا مشرقًا: حين لم يعرف Sonnet 5.5 الإجابة، اختلق واحدة في 47% من الحالات، مقابل 59% لـ Opus 5.5. إنه يعرف أقل، لكنه أكثر استعدادًا للاعتراف بذلك. ومع هذا، إن احتجت إلى تاريخ غير شائع أو اسم أو إحصاء، فاطلب منه البحث في الويب أو ذكر مصدر.
الحكم. هنا تتحدث Anthropic بصراحة غير معتادة. ففي عدة اختبارات يؤدي Sonnet 5.5 عند مستوى max أداءً مماثلًا لـ Opus 5.5. لكن في اختبارات Anthropic نفسها واختبارات المختبرين الخارجيين يبقى Opus 5.5 أقوى بوضوح في العمل المعقد المفتوح الذي يتطلب حكمًا متواصلًا. وإن لم يكن للسؤال إطار واضح، كقرار استراتيجي أو عقد ببنود غير مألوفة، فهو لا يزال من اختصاص Opus.
فيمَ يتفوق
تبرز Anthropic المستندات والتلخيصات وجداول البيانات والعروض التقديمية، وتقول إن لدى النموذج حسًّا مرهفًا بالتصميم: إذ يستطيع اتباع قالب الشرائح بدقة تجعل التعديل اللاحق قليلًا جدًا. وقد تحسّنت قراءته للرسوم البيانية تحسنًا كبيرًا. ففي اختبار Chartography من Anthropic، الذي يطلب قراءة القيم من الرسوم البيانية دون أدوات، سجّل 61.6% مقابل 15.6% لـ Sonnet 5.
وهو سريع أيضًا. تقول Anthropic إن الإخراج يصل أسرع من Sonnet 5 بأكثر من 30%، وقد لاحظ المختبرون الأوائل ذلك: تقول Zendesk إن تذاكر الدعم عولجت أسرع بنسبة 20%، وقاست Box سرعة تبلغ 2.4 ضعف الإصدار السابق.
ويستطيع كذلك تشغيل الحاسوب. ففي OSWorld 2.1، حيث ينقر النموذج ويكتب ليشق طريقه عبر تطبيقات سطح مكتب حقيقية، تعلن Anthropic عن 80.1% بنظام الدرجات الجزئية، قريبًا من 81.8% لـ Opus 5.5.
اترك المؤشر في المنتصف
لدى Sonnet 5.5 خمسة مستويات جهد: low وmedium وhigh وxhigh وmax. وتستخدم تطبيقات Claude مستوى medium افتراضيًا. هذا ما قاسته Artificial Analysis عند كل مستوى:
| مستوى الجهد | مؤشر الذكاء | تكلفة المهمة |
|---|---|---|
| Low | 36 | $0.41 |
| Medium | 41 | $0.59 |
| High | 47 | $1.08 |
| Xhigh | 52 | $2.74 |
| Max | 56 | $7.60 |
الدرجة الأخيرة هي المكلفة. فعند max كتب Sonnet 5.5 نحو 193,000 رمز إخراج لكل مهمة، وهو أعلى رقم قاسته Artificial Analysis على الإطلاق، وأكثر بنحو 60% من Opus 5.5 عند max. بالنسبة إلى معظم مستخدمي تطبيق Claude يعني هذا ببساطة انتظارًا أطول. أما للمطورين الذين يدفعون لكل رمز، فيعني أن Sonnet المدفوع إلى أقصاه لم يعد الخيار الرخيص. وإن احتاجت مهمة إلى هذا القدر من التفكير، فهي تستحق Opus عادةً.
العيب بصراحة
لا صور. يقرأ Claude لقطات الشاشة والرسوم البيانية وملفات PDF الممسوحة ضوئيًا جيدًا، لكنه لا يولّد صورًا أو صوتًا أو فيديو. وإن أردت تطبيقًا واحدًا يرسم ويتحدث أيضًا، فإن ChatGPT وGemini أشمل.
سعر الرمز ليس سعر المهمة. تكلف الرموز ما كانت تكلفه في Sonnet 5: دولاران لكل مليون رمز إدخال و10 دولارات لكل مليون رمز إخراج. وتقول Anthropic إن المهام المعتادة تكلف أقل بما يصل إلى 30% لأن النموذج ينجز العمل بخطوات أقل. هذا صحيح عند الإعدادات العادية؛ أما عند max، فكما يُظهر الجدول، ترتفع الفاتورة بسرعة.
بعض الطلبات محروسة. Sonnet 5.5 هو أول نموذج Sonnet يُطرح بضوابط الأمن السيبراني الأشد التي تطبقها Anthropic على أقوى نماذجها. وتُحال طلبات الأمن الأعلى خطورة إلى Sonnet 5 بشكل ظاهر للمستخدم. ولن يصادف ذلك أحد تقريبًا.
لمن يناسب
| إن كان يومك يتضمن… | استخدم | لماذا |
|---|---|---|
| رسائل وتلخيصات وجداول بيانات وعروضًا تقديمية | Claude Sonnet 5.5 | عمل مكتبي قريب من مستوى Opus، وسريع، ومتاح في الخطة المجانية |
| قرارات عالية المخاطر وحقائق غير شائعة وبحثًا معقدًا | Claude Opus 5.5 | معرفة أكثر وحكم أقوى بوضوح |
| «شغّل هذا البرنامج على حاسوبي وأنجز المهمة» | GPT-6 Astra | وكيل أقوى وأوفر لاستخدام الحاسوب |
| تطبيقًا واحدًا للدردشة والصور والصوت | ChatGPT أو Gemini | صندوق أدوات إبداعي أوسع |
الحكم للاستخدام اليومي
لن يحل Claude Sonnet 5.5 محل Opus في أصعب الأسئلة، ولا تدّعي Anthropic ذلك. لكن أصعب الأسئلة لا تشغل إلا جزءًا صغيرًا من معظم الأسابيع. وفي كل ما عداها، هو سريع وقادر ومتاح ضمن الخطة المجانية لـ Claude، وبسعر لا يستدعي التفكير فيه. اتركه على الإعداد الافتراضي، وتحقّق من الحقائق غير الشائعة، واستدعِ Opus حين يرتفع الرهان.