دليل مرتب

المنظومة اليومية — مساعدات الذكاء الاصطناعي الرائدة

هذه هي السكاكين السويسرية للذكاء الاصطناعي: المساعدات التي يفتحها الناس قبل بريدهم الإلكتروني. تكتب وتفكّر وتخطط، وأحيانًا تختلق أشياء بثقة مدهشة. يتصدر Claude Opus 5.5 حاليًا العمل المعرفي المتأني القابل للتحقق، ويقدّم Claude Sonnet 5.5 نتائج شبه مماثلة في الأعمال المكتبية ضمن الخطة المجانية لـ Claude، وGPT-6 Astra هو الأقوى في تشغيل البرامج نيابةً عنك، ويقدّم GPT-6.1 Sol في ChatGPT Work نتائج تقارب Astra بجزء بسيط من التكلفة. إليك ما يجيده كل منها، وأين يتعثر، ولماذا يعتمد الاختيار الصحيح على شكل يومك.

القرار أولاً

ترتيبنا

ابدأ بالفائز، ثم قارن المفاضلات التي قد تغيّر الإجابة بالنسبة لك.

#1 النظام البيئي اليومي

Claude Opus 5.5

Anthropic

Claude Opus 5.5 هو النموذج الذي نسلّمه مهمة معقدة وعالية المخاطر ونحن مطمئنون إلى أنه سيعود بالإجابة الصحيحة. تقول Anthropic إنه يؤدي في معظم الأعمال بمستوى نموذجها الأعلى Fable 5.1، لكنه يكلّف أقل من نصف سعره لكل رمز. وصار يكتب اليوم كزميل هادئ متمرّس، لا كخرّيج جديد متوتر.

لماذا تفوز

أعلى درجة على مؤشر Artificial Analysis Intelligence Index المستقل عند الإطلاق (58 بأقصى جهد). يتصدر GDPval-AA v2.1، وهو اختبار لعمل مهني حقيقي، بـ 1846 نقطة Elo متقدمًا على Fable 5.1 (1735). انخفض سعر الرموز 20% إلى 4/20 دولارًا، وانخفضت قراءة الذاكرة المؤقتة 60% إلى 0.20 دولار، ما يجعل أعباء العمل المعتادة أرخص بنحو 40% من Opus 5 وفق Anthropic. الكتابة أسرع بأكثر من 30%، ورُفعت حدود الاستخدام لكل خمس ساعات في الخطط المدفوعة.

العيب

عند أقصى جهد يفكّر بصوت عالٍ كثيرًا: قاست Artificial Analysis نحو 119,000 رمز إخراج لكل مهمة مقابل نحو 27,000 لـ GPT-6 Astra، لذا لا يُثمر السعر المنخفض إلا إذا بقيت الأعمال الروتينية على مستوى الجهد الافتراضي. لا يولّد الصور، ولم يعد ممكنًا إيقاف التفكير تمامًا، ومعظم طلبات الأمن السيبراني تُحال بهدوء إلى النموذج الأقدم Opus 4.8.

9.8 تقييم التحرير
اقرأ المراجعة
الأفضل لـ

Claude Opus 5.5 هو النموذج الذي نسلّمه مهمة معقدة وعالية المخاطر ونحن مطمئنون إلى أنه سيعود بالإجابة الصحيحة. تقول Anthropic إنه يؤدي في معظم الأعمال بمستوى نموذجها الأعلى Fable 5.1، لكنه يكلّف أقل من نصف سعره لكل رمز. وصار يكتب اليوم كزميل هادئ متمرّس، لا كخرّيج جديد متوتر.

لماذا تفوز

أعلى درجة على مؤشر Artificial Analysis Intelligence Index المستقل عند الإطلاق (58 بأقصى جهد). يتصدر GDPval-AA v2.1، وهو اختبار لعمل مهني حقيقي، بـ 1846 نقطة Elo متقدمًا على Fable 5.1 (1735). انخفض سعر الرموز 20% إلى 4/20 دولارًا، وانخفضت قراءة الذاكرة المؤقتة 60% إلى 0.20 دولار، ما يجعل أعباء العمل المعتادة أرخص بنحو 40% من Opus 5 وفق Anthropic. الكتابة أسرع بأكثر من 30%، ورُفعت حدود الاستخدام لكل خمس ساعات في الخطط المدفوعة.

انتبه إلى

عند أقصى جهد يفكّر بصوت عالٍ كثيرًا: قاست Artificial Analysis نحو 119,000 رمز إخراج لكل مهمة مقابل نحو 27,000 لـ GPT-6 Astra، لذا لا يُثمر السعر المنخفض إلا إذا بقيت الأعمال الروتينية على مستوى الجهد الافتراضي. لا يولّد الصور، ولم يعد ممكنًا إيقاف التفكير تمامًا، ومعظم طلبات الأمن السيبراني تُحال بهدوء إلى النموذج الأقدم Opus 4.8.

#2

GPT-6 Astra

OpenAI

GPT-6 Astra هو الرائد الجديد من OpenAI للجزء من العمل الذي يحدث خارج مربع المحادثة. يقود المتصفح، وينقر عبر تطبيقات سطح المكتب، ويُنفّذ مسارات العمل المهنية متعددة الخطوات حتى النهاية، ويتحقق من حقائقه بنفسه أفضل بنحو الضعف مقارنةً بـ GPT-5.6 Sol — داخل منظومة ChatGPT وCodex وAPI نفسها التي تعرفها.

9.8 تقييم التحرير
اقرأ المراجعة
#3

نفس أوزان نموذج Mythos 5.1 الحصري، ولكن مع طبقة الأمان التي يحصل عليها معظم المستخدمين بالفعل. إنه النموذج الذي تنصحك شركة Anthropic باستخدامه عندما يفشل Opus 5 بالجهد العالي في تقييماتك الخاصة — البرمجة طويلة الأمد، والبحث لعدة ساعات، والمستندات التي يجب أن تظل متماسكة.

9.8 تقييم التحرير
اقرأ المراجعة
#4

Claude Sonnet 5.5

Anthropic

Claude Sonnet 5.5 هو المساعد المناسب لأسبوع العمل العادي: تلخيص المستندات، وبناء جداول البيانات والعروض التقديمية، وصياغة التقارير. في الاختبارات المستقلة للعمل المكتبي يقترب من Opus 5.5 إلى حدود نقطة أو نقطتين، ومتاح ضمن الخطة المجانية لـ Claude، ورموزه في الواجهة البرمجية بنصف السعر. لكن Opus يعرف حقائق أكثر ويتعامل مع المشكلات المعقدة فعلًا بشكل أفضل.

9.7 تقييم التحرير
اقرأ المراجعة
#5

GPT-6.1 Sol

OpenAI

إن نموذج GPT-6.1 Sol هو نموذج العمل اليومي من OpenAI: النموذج الذي توكل إليه تقاريرك وملفات PDF والمهام المتعددة الخطوات في ChatGPT Work. في الاختبارات المستقلة، جاء في مرتبة متأخرة بنقطة واحدة فقط عن نموذج GPT-6 Astra، النموذج الرائد لشركة OpenAI، لكنه يكلف أقل من ربع التكلفة للمهمة العادية. يقرأ المستندات الطويلة بشكل جيد ويرتكب أخطاء واقعية أقل من النموذج الذي يحل محله. ووفقًا لـ OpenAI، يمكنه أيضًا تشغيل تطبيقات سطح المكتب بكفاءة تقارب Astra.

9.6 تقييم التحرير
اقرأ المراجعة
#6

Gemini 3.1 Pro

Google DeepMind

Gemini 3.1 Pro هو متخصص Google في التفكير العميق: نموذج رائد تقادم لكنه ما زال ممتازاً في العلوم والمنطق الجديد والوثائق الطويلة والبحث متعدد الوسائط. عائلة Flash أسرع وأرخص، غير أن 3.1 Pro يظل مفيداً عندما تكون جودة التحليل أهم من سرعة الوصول.

9.6 تقييم التحرير
اقرأ المراجعة
#7

Grok 4.7

xAI

يحافظ Grok 4.7 على السعر المنخفض نفسه لـ Grok 4.6 – دولاران للإدخال و6 دولارات للإخراج لكل مليون رمز – لكنه نموذج أقوى وأكثر تأنيًا بشكل ملموس. درّبته xAI على مهام أطول وأصعب، وعلّمته أن يراجع عمله بنفسه. إنه أوفر طريق للحصول على مساعدة قريبة من المستوى الأعلى في العمل المكتبي، والمسودات القانونية، والرياضيات الهندسية.

9.6 تقييم التحرير
اقرأ المراجعة
#8

Qwen3.8-Max

Alibaba / Qwen Team

يتوفر Qwen3.8 الآن في شكلين مهمين: منتج Qwen3.8-Max المستضاف مع الرؤية، والأدوات المدمجة، وسياق افتراضي بـ 1 مليون رمز، وأول نموذج قابل للتنزيل من فئة Max لـ Qwen. النموذج المفتوح عبارة عن نموذج نصي يحتوي على 2.4 تريليون معلمة إجمالية و 95 مليار معلمة نشطة مع سياق أصلي يبلغ 262 ألفًا يمتد إلى ما يقرب من مليون رمز.

9.0 تقييم التحرير
اقرأ المراجعة
أسئلة وإجابات

الأسئلة الشائعة