الترتيب #4 المنظومة اليومية — مساعدات الذكاء الاصطناعي الرائدة
Google DeepMind

Gemini 3.1 Pro

Gemini 3.1 Pro هو متخصص Google في التفكير العميق: نموذج رائد تقادم لكنه ما زال ممتازاً في العلوم والمنطق الجديد والوثائق الطويلة والبحث متعدد الوسائط. عائلة Flash أسرع وأرخص، غير أن 3.1 Pro يظل مفيداً عندما تكون جودة التحليل أهم من سرعة الوصول.

تم التحديث 14 أغسطس 2026 Multi-modalReasoningLong context
الأفضل لـ

Gemini 3.1 Pro هو متخصص Google في التفكير العميق: نموذج رائد تقادم لكنه ما زال ممتازاً في العلوم والمنطق الجديد والوثائق الطويلة والبحث متعدد الوسائط. عائلة Flash أسرع وأرخص، غير أن 3.1 Pro يظل مفيداً عندما تكون جودة التحليل أهم من سرعة الوصول.

لماذا تفوز

حقق عند الإطلاق 77.1% في ARC-AGI-2 و94.3% في GPQA Diamond و44.4% في Humanity's Last Exam بلا أدوات و80.6% في SWE-Bench Verified، ويستقبل النص والصور والصوت والفيديو وPDF ضمن مليون رمز.

انتبه إلى

بعد ستة أشهر ما زال Preview بسعر 2/12 دولاراً لكل مليون رمز حتى سياق 200 ألف. أخلف خليفته 3.5 Pro موعد يونيو وربما تجاوزته خريطة Gemini 4، بينما صار 3.7 Flash نموذج العمل العملي.

01

ما هو في الواقع

تخيّل أن تعطي ملف البحث الصعب نفسه لثلاثة زملاء. الأول يقرأ كل صفحة ويقارن الهوامش والرسوم ثم يعيد حجة متأنية. الثاني يتحرك بسرعة ويستدعي الأدوات اللازمة ويحوّل الملف إلى لوحة قبل الغداء. الثالث يعالج ألف ملف مشابه معاً، ويستخرج الحقول الاثني عشر نفسها من كل واحد بلا استنزاف الميزانية.

هذه صورة مفيدة لعائلة Gemini الحالية. 3.1 Pro هو المحلل المتأني، و3.7 Flash البنّاء والوكيل السريع، و3.5 Flash-Lite خط الإنتاج الاقتصادي. كلمة Pro لا تجعل الأول الأفضل لكل مهمة؛ بل تصف نوع المقايضة التي صُمم لها.

نموذج استدلال رائد تقادم أمام الجمهور

أطلقت Google النموذج في Preview يوم 19 فبراير 2026. كانت القفزة الأساسية في الاستدلال. في ARC-AGI-2—ألغاز تستلزم اكتشاف قواعد بصرية جديدة—ارتفعت النتيجة من 31.1% مع Gemini 3 Pro إلى 77.1%. وأضاف 94.3% في GPQA Diamond و44.4% في HLE بلا أدوات.

وصلت Artificial Analysis إلى صورة مشابهة: 57 نقطة والمركز الأول وقيادة ستة من عشرة اختبارات، بسرعة نحو 114 رمزاً في الثانية. وكان سعر 2/12 دولاراً جذاباً مقارنة بالنماذج الرائدة آنذاك.

لم يكن ذلك فوزاً شاملاً. ففي جدول Google تأخر 3.1 Pro عن نماذج Claude في GDPval-AA، وكان Gemini 3 Pro القديم أعلى قليلاً في MMMU-Pro. الأدق وصفه بنموذج عام قوي له موهبة خاصة في العلم والتجريد، لا الأفضل في كل شيء. كما أن اختباراً على وثائقك ولغتك وتكلفة الخطأ لديك أهم من أي لوحة عامة.

التاريخ مهم. الترتيب صورة لا حزام بطولة دائم. ستة أشهر من الإصدارات حركت الملعب. لم يصبح 3.1 Pro أقل ذكاءً؛ تحسنت النماذج الأخرى في البرمجة طويلة الأفق والتحكم بالحاسوب والعمل المؤسسي.

أين يبقى 3.1 Pro مفيداً؟

يتألق حين تكون المشكلة صعبة قبل أن تصبح متكررة. يجمع العالم ورقة وصوراً مجهرية، ويجمع المحقق مقابلة وخطاً زمنياً وتقريراً مالياً، ويقارن فريق المنتج تسجيل الشاشة بالشيفرة. تدخل كلها في طلب متعدد الوسائط حتى مليون رمز.

هذا تحليل لا توليد وسائط. يعيد 3.1 Pro نصاً؛ يصنع Veo الفيديو وNano Banana الصور وLyria الموسيقى. توصيلها داخل منتج لا يجعلها قدرات نموذج واحد، كما أن قائد الأوركسترا لا يعزف كل آلة بنفسه.

تجعله الأدوات أوسع من نظام سؤال وجواب للـPDF: يستطيع استدعاء الدوال وإرجاع JSON والبحث وتنفيذ الشيفرة. لكن نماذج Flash الجديدة أسرع غالباً وأقل وقوعاً في الحلقات الفاشلة خلال مهام الوكلاء الطويلة. لذلك من المنطقي استخدام 3.1 Pro كخبير كبير يفحص الجزء الأصعب، لا كروبوت يدير خط العمل كله بالضرورة.

والسياق طاولة هائلة لا ذاكرة فوتوغرافية. يهبط MRCR لدى Google من 84.9% في متوسط 128k إلى 26.3% في اختبار 1M. إذا اعتمد الجواب على سطر في الصفحة 4000، فإن رفع كل شيء والأمل ليس هندسة جيدة. قلّص المواد وسمّ المصادر واطلب الصفحات وتحقق.

الانتظار الطويل لـGemini 3.5 Pro

في 19 مايو قالت Google إن 3.5 Pro مستخدم داخلياً وسيصل «الشهر المقبل». انتهى يونيو من دونه. في 16 يوليو ذكرت Bloomberg أنه متأخر أشهراً لأن محاولات تحسين قدراته، وخصوصاً البرمجة، لم تبلغ الأهداف الداخلية.

بعد خمسة أيام أطلقت Google 3.6 Flash و3.5 Flash-Lite. صار الوصف: اختبار مع الشركاء وإصدار «حين يكون جاهزاً». وفي الإعلان نفسه كشفت عن بدء أضخم تدريب أولي لـGemini 4. وفي أغسطس ما زالت الصفحة تعد بـ“3.5 Pro coming soon” فوق 3.1 Pro القديم.

تقول SemiAnalysis إنه أُلغي بهدوء. الأدلة المحيطة تجعل الفكرة قابلة للتصديق، لكن Google لم تؤكدها. قد يكون أُلغي أو تغير اسمه أو اندمج في Gemini 4 أو يخضع لإعادة بناء. النتيجة العملية: لا تشتر اشتراكاً ولا تبن نظاماً على وعد بلا endpoint.

الدقة هنا مهمة. اعتبار الإلغاء حقيقة يتجاوز ما أعلنته Google، والقول إن الخطة تسير طبيعياً يتجاهل الموعد الفائت والتقارير. الخلاصة الصادقة أن خطة الإصدار الأصلية فشلت، بينما مستقبل منتج عام يحمل اسم 3.5 Pro تحديداً ما زال مجهولاً.

المنظومة لم تنتظر

Gemini 3.7 Flash متاح GA منذ 13 أغسطس، وهو هدف ترحيل لعديد من أعمال 3.1 Pro. يقدم سياق 1M ومخرج 64k وأدوات وثلاث درجات تفكير. تنشر Google 43.6% في FrontierCode و65.3% في DeepSWE و85.8% في Terminal-Bench و34% في GDP.pdf. مؤشره 56 وسرعته قرابة 340 رمزاً/ث، بسعر 0.75/3.75 دولار حتى ديسمبر ثم 1.50/7.50.

ويخدم 3.5 Flash-Lite طبقة أخرى. هو مستقر ومتعدد الوسائط بسياق 1M وسعر 0.30/2.50 وسرعة تقارب 350 رمزاً/ث. وظائفه الطبيعية تحليل الوثائق والتصنيف واستخراج الإيصالات ووكلاء البحث وإنتاج بدائل متوازية. يتقدم كثيراً على 3.1 Flash-Lite في Terminal-Bench والسياق الطويل وGDPval-AA. لا يحول Lite إلى Pro؛ بل يجعله ناقلاً إنتاجياً مدهشاً.

الاختيار العملي

اختر 3.1 Pro إذا أثبتت اختباراتك تفوقه في العلم والبحث والمنطق الجديد. اجعل 3.7 Flash الافتراضي للوكلاء الجدد وUI والأتمتة والحجم الكبير. استخدم 3.5 Flash-Lite خلف الكواليس للمهام الصغيرة الواضحة.

وانتظر endpoint حقيقياً قبل الإيمان بـ3.5 Pro. أسماء النماذج وعود؛ أما endpoints فهي المنتجات.

02

نقاط القوة والقيود بصراحة

نقاط القوة الرئيسية

  • استدلال تجريدي وعلمي ممتاز: جعلته نتائج 77.1% في ARC-AGI-2 و94.3% في GPQA و44.4% في HLE من أقوى نماذج فبراير. المعايير خرائط وليست الواقع كله، لكنها تتفق على براعته في المنطق الجديد والمفاهيم التقنية والبحث.
  • أدلة متعددة الوسائط في تحليل واحد: يحلل النص والصور والصوت والفيديو وPDF معاً، فيربط نبرة مقابلة برسم في تقرير ومشهد من عرض. مخرجاته نص؛ Veo وNano Banana وLyria نماذج مستقلة.
  • طاولة كبيرة للوثائق والشيفرة: يسع مليون رمز ملفات ودراسات ومستودعات ضخمة. السعة ليست ذاكرة مثالية—نتيجة Google في أصعب MRCR عند 1M هي 26.3%—لذلك يجب تضييق المصادر وطلب الاقتباسات.
  • برمجة وأدوات قوية لجيله: حقق 80.6% في SWE-Bench Verified و68.5% في Terminal-Bench 2.0 و85.9% في BrowseComp و69.2% في MCP Atlas، ويدعم الدوال والمخرجات المنظمة والبحث وتنفيذ الشيفرة.
  • متاح عبر منصات عمل Google: يظهر في Gemini وAI Studio وAPI ومنتجات المؤسسات وAI Mode وAntigravity وNotebookLM. للمؤسسة الموجودة في Workspace وCloud قد تهم الإدارة والوصول أكثر من فارق صغير في ترتيب.

قيود صادقة

  • الخليفة الموعود عالق: قالت Google في مايو إن 3.5 Pro سيأتي في يونيو. مر الموعد، وأفادت Bloomberg بتأخر أشهر وبأن تحسين البرمجة لم يحقق الأهداف. ثم تحولت Google إلى اختبار الشركاء وإطلاقه ‘حين يصبح جاهزاً’.
  • الإلغاء محتمل لا مؤكد: أفادت SemiAnalysis بإلغاء هادئ. صدور جيلين Flash وبدء تدريب Gemini 4 يجعلان ذلك معقولاً، لكن صفحة Google ما زالت تقول ‘قريباً’. الإلغاء أو تغيير الاسم أو إعادة البناء احتمالات لا حقائق.
  • Flash أنسب لكثير من الإنتاج: 3.7 Flash متاح عاماً وأقوى في اختبارات حديثة وسعره المؤقت 0.75/3.75 دولار. أما 3.5 Flash-Lite فسعره 0.30/2.50 ومصمم لاستخراج الوثائق والوكلاء الفرعيين المتوازيين.
  • Preview وتراجع السياق الطويل يتطلبان الحذر: دورة الحياة أقل ضماناً ومليون رمز لا يضمن استرجاع كل حقيقة مدفونة. يلزم تثبيت الإصدار واختبار بديل وطلب المصادر ومراجعة الإجابات المهمة.
03

لمحة عن المعايير

ARC-AGI-2 — 77.1%

نتيجة Google الموثقة في ألغاز بقواعد بصرية جديدة، مقابل 31.1% لـGemini 3 Pro؛ أوضح دليل على قفزة التفكير التجريدي.

GPQA Diamond — 94.3%

أسئلة علوم صعبة بمستوى الدراسات العليا بلا أدوات. يدعم استخدامه للشرح العلمي، لا تصديق معلومة بلا مصدر.

SWE-Bench Verified — 80.6%

نتيجة قوية في مشكلات مستودعات حقيقية. الاختبارات الأحدث تظهر أنه قادر لكنه لم يعد يحدد قمة البرمجة.

Artificial Analysis Intelligence Index — 57 عند الإطلاق

المركز الأول في فبراير ونحو 114 رمز إخراج في الثانية؛ صورة تاريخية مهمة لا ترتيب حالي.

04

الحكم

يبقى Gemini 3.1 Pro متخصصاً جيداً للاستدلال الصعب والعلم وجمع الأدلة المختلفة. للأنظمة الجديدة يكون 3.7 Flash غالباً خيار الإنتاج الأفضل، و3.5 Flash-Lite محركاً اقتصادياً للاستخراج والوكلاء الفرعيين. أما 3.5 Pro فلا تفترض وجوده قبل ظهور endpoint؛ التأخير وتقرير الإلغاء وGemini 4 تشير إلى أن الاسم نفسه قد لا يصل أبداً.

05

الأسئلة الشائعة