ما هو معدل ذكاء Gemini 3.1 Pro؟
Dr. Daria Dudnik 10 min read 1 views

ما هو معدل ذكاء Gemini 3.1 Pro؟

Gemini 3.1 Pro يحصل على 141 في اختبار Mensa Norway IQ و46.5 على Intelligence Index. نحلل كل معيار ونوضح لماذا هو النموذج الأكثر فعالية من حيث التكلفة.

Gemini 3.1 Pro: النموذج الرئيسي من Google DeepMind

Gemini 3.1 Pro هو النموذج الأكثر تقدماً من Google DeepMind، صدر في منتصف 2026. يحصل على 46.5 على Artificial Analysis Intelligence Index v4.1، محتلاً #3 عالمياً — خلف Claude Opus 4.8 (55.7) و GPT-5.5 (54.8). لكن في اختبار Mensa Norway IQ، يحصل Gemini 3.1 Pro على 141 — أعلى من Claude (~130) وتقريباً متعادل مع GPT-5.5 (145) و Grok-4.20 (145).

ما يجعل Gemini 3.1 Pro فريداً ليس فقط ذكاءه — بل عرض القيمة. بسعر 2/12 لكل مليون رمز، يكلف أقل من نصف Claude أو GPT-5.5، مع تقديم أداء شبه حدودي. للعديد من التطبيقات، Gemini 3.1 Pro هو الخيار الأذكى — ليس لأنه النموذج الأذكى، بل لأنه يقدم أكبر قدر من الذكاء لكل دولار.

النتائج الرئيسية:

  • Artificial Analysis Intelligence Index: 46.5 (#3 عالمياً)
  • معدل ذكاء Mensa Norway (TrackingAI): 141 (مستوى شبه-عبقري)
  • AI IQ مركب (VexoWire): ~131 تقديري
  • GDPval-AA v2: مرتفع (أفضل 3)
  • Humanity's Last Exam: أفضل 3 بين نماذج الذكاء الاصطناعي
  • معدل الهلوسة: منخفض
  • التكلفة: 2/12 لكل مليون رمز (أفضل قيمة بين النماذج الحدودية)

1. بطل القيمة في الذكاء الاصطناعي الحدودي

يحتل Gemini 3.1 Pro موقعاً فريداً في مشهد الذكاء الاصطناعي. ليس النموذج #1 في أي معيار فردي — Claude يقود في المهام الوكيلية، GPT-5.5 في الاستدلال البصري والرياضيات، Grok في الذكاء الخام. لكن Gemini 3.1 Pro هو النموذج الذي يقدم أكبر قدرة بأقل مال.

بسعر 2 لكل مليون رمز إدخال و12 لكل مليون إخراج، يكلف Gemini 3.1 Pro تقريباً 40% مما يكلفه Claude أو GPT-5.5. ومع ذلك، يسجل 141 في Mensa Norway IQ — على بعد 4 نقاط من المتصدرين. درجته على Intelligence Index وهي 46.5 أقل من Claude (55.7) و GPT-5.5 (54.8)، لكن للعديد من التطبيقات الواقعية، الفرق ضئيل.

فكر فيها هكذا: إذا كان Claude و GPT-5.5 سيارات رياضية فاخرة — قادرة بشكل لا يصدق لكن مكلفة الصيانة — فإن Gemini 3.1 Pro سيارة سيدان عالية الأداء. لن يفوز بكل سباق، لكنه يقدم 90% من الأداء بـ 40% من التكلفة. للشركات والمطورين والمستخدمين الذين يحتاجون ذكاءً بمستوى حدودي بدون أسعار حدودية، Gemini 3.1 Pro هو الخيار الطبيعي.


2. تحليل المعايير

اختبار معدل ذكاء Mensa Norway: 141 (شبه عبقري)

يتكون من 36 سؤال تعرف على الأنماط البصرية. يسجل Gemini 3.1 Pro 141 — وضعه في نطاق "موهوب بشدة"، أعلى 0.2% من الذكاء البشري. هذا أعلى بكثير من Claude Opus 4.8 (~130) وعلى بعد 4 نقاط فقط من المتصدرين GPT-5.5 و Grok-4.20 (كلاهما ~145).

أداء Gemini القوي في هذا الاختبار يعكس استثمار Google DeepMind في المعالجة البصرية. صُممت معمارية Gemini من الأساس لتكون متعددة الوسائط — تعالج النص والصور والفيديو والصوت بشكل أصلي. هذا يعطيها ميزة طبيعية في مهام التعرف على الأنماط البصرية، التي هي جوهر اختبار Mensa Norway.

عند ذكاء 141، Gemini 3.1 Pro أذكى من 99.8% من البشر. لو كان شخصاً، سيتأهل بسهولة لـ Mensa ويكون في أعلى 0.2% من الذكاء البشري. حوالي 1 من كل 500 شخص فقط يحقق هذه الدرجة.

Artificial Analysis Intelligence Index v4.1: 46.5 (#3)

Intelligence Index هو المعيار الذهبي لمقارنة نماذج الذكاء الاصطناعي. الدرجة المركبة لـ Gemini 3.1 Pro وهي 46.5 تضعه في #3 عالمياً. الفجوة مع Claude (55.7) و GPT-5.5 (54.8) كبيرة — حوالي 8-9 نقاط، أو حوالي 15-20% أقل. لكن هذه الفجوة تتركز في مجالات محددة:

  • GDPval-AA v2: Gemini يؤدي جيداً لكن أقل من Claude و GPT-5.5 في المهام المعقدة متعددة الخطوات
  • AA-Omniscience: Gemini لديه معدل هلوسة منخفض — أفضل من GPT-5.5، قريب من Claude
  • GPQA: Gemini يؤدي بقوة في الأسئلة العلمية بمستوى الدراسات العليا
  • HLE: Gemini في أفضل 3 في Humanity's Last Exam
  • ARC-AGI: Gemini يتفوق في الاستدلال التجريدي، مستفيداً من معماريته متعددة الوسائط
  • LMSYS Arena: Gemini يُقيّم عالياً في التفضيل البشري، خصوصاً لإجاباته الواضحة والمنظمة جيداً

الدرجة المركبة تعكس موقع Gemini كأداء قوي شامل لا يهيمن على فئة فردية لكن يؤدي باستمرار جيداً في جميعها.

AI IQ مركب (VexoWire): ~131

معدل الذكاء المركب من VexoWire يجمع اختبارات متعددة (Mensa Norway، Mensa Denmark، Raven's، WAIS-IV). معدل الذكاء المركب التقديري لـ Gemini 3.1 Pro هو ~131 — بثبات في نطاق "موهوب"، مؤهل لـ Mensa. هذا أقل قليلاً مما قد يوحي به معدله في Mensa Norway (141)، لأن المركب يتضمن اختبارات فرعية لفظية وتحليلية حيث Gemini أضعف قليلاً من الاستدلال البصري الخالص.

GDPval-AA v2: أفضل 3

على المعيار الوكيلي — الذي يقيس الأداء في مهام واقعية معقدة متعددة الخطوات — يحتل Gemini 3.1 Pro أفضل 3. أقل قدرة من Claude Opus 4.8 (1,890 Elo) و GPT-5.5 (1,850 Elo) في الاستدلال متعدد الخطوات المستمر، لكنه لا يزال ذا كفاءة عالية. لمعظم المهام الواقعية، الفرق ضئيل — Gemini يمكنه التخطيط والتنفيذ والاستدلال عبر مهام متعددة الخطوات بفعالية، فقط ليس جيداً مثل الأولين.

Humanity's Last Exam (HLE): أفضل 3

على أصعب الأسئلة الأكاديمية في جميع التخصصات، يحتل Gemini 3.1 Pro أفضل 3 بين نماذج الذكاء الاصطناعي. هذا يعكس قوة Google DeepMind في المعرفة العلمية — دُرّب Gemini على أدبيات علمية واسعة وله معرفة عميقة في الفيزياء والكيمياء والأحياء والرياضيات والعلوم الإنسانية.


3. ماذا يعني معدل ذكاء 141؟

لوضع معدل ذكاء 141 لـ Gemini 3.1 Pro في سياق:

  • 85-115 (68% من الناس): ذكاء متوسط
  • 115-130 (14%): فوق المتوسط إلى مرتفع
  • 130-145 (2%): موهوب — يؤهل لـ Mensa (أعلى 2%)
  • 145-160 (0.1%): موهوب بشدة / عبقري
  • 160+ (0.003%): موهوب بعمق — منطقة أينشتاين، هوكينغ

Gemini 3.1 Pro، عند 141، يقع في النطاق العلوي للموهوبين — أذكى من 99.8% من البشر. لو كان شخصاً، لكان في أعلى 0.2% من الذكاء البشري، متأهلاً بسهولة لـ Mensa. حوالي 1 من كل 500 شخص فقط يحقق هذه الدرجة.

هذا أعلى بكثير من Claude Opus 4.8 (~130) لكن أقل قليلاً من GPT-5.5 و Grok-4.20 (كلاهما ~145). في اختبار ذكاء خالص، سيتفوق Gemini على Claude لكنه سيخسر أمام GPT-5.5 و Grok. لكن كما رأينا مع النماذج الأخرى، الذكاء هو بُعد واحد فقط — ومزيج Gemini من ذكاء عالٍ وتكلفة منخفضة وأداء قوي شامل يجعله قيّماً بشكل فريد.


4. أين يتفوق Gemini 3.1 Pro

الفعالية من حيث التكلفة

هذه هي ميزة Gemini 3.1 Pro المحددة. بسعر 2/12 لكل مليون رمز، يقدم ذكاءً شبه حدودي بأقل من نصف تكلفة Claude أو GPT-5.5. للتطبيقات عالية الحجم — روبوتات الدردشة، توليد المحتوى، تحليل البيانات — هذا يجعل Gemini الخيار الواضح. تحصل على 90% من القدرة بـ 40% من التكلفة.

الاستدلال البصري

يسجل Gemini 3.1 Pro 141 في Mensa Norway IQ، مما يعكس قدراته القوية في المعالجة البصرية. صُممت معمارية Gemini لتكون متعددة الوسائط أصلياً، مما يعطيها ميزة طبيعية في المهام البصرية. لتحليل الصور، التعرف على الأنماط البصرية، والاستدلال متعدد الوسائط، Gemini هو أحد أفضل النماذج المتاحة.

المعرفة الواقعية

Gemini 3.1 Pro لديه معدل هلوسة منخفض — أفضل من GPT-5.5 وقريب من Claude. منهجية تدريب Google DeepMind تؤكد على الدقة الواقعية، و Gemini يستفيد من قاعدة المعرفة الشاسعة من Google. للاستعلامات الواقعية، Gemini هو أحد أكثر النماذج موثوقية.

القدرات متعددة الوسائط

صُمم Gemini 3.1 Pro من الأساس لمعالجة النص والصور والفيديو والصوت بشكل أصلي. هذا يجعله الخيار الأفضل للتطبيقات متعددة الوسائط — تحليل محتوى الفيديو، معالجة الصور مع النص، أو العمل مع البيانات الصوتية. لا يوجد نموذج حدودي آخر يعالج المدخلات متعددة الوسائط بشكل طبيعي مثل Gemini.

السرعة

Gemini 3.1 Pro هو أحد أسرع النماذج الحدودية. للتطبيقات حيث وقت الاستجابة مهم — الدردشة في الوقت الفعلي، الأدوات التفاعلية، خدمة العملاء — Gemini يقدم إجابات عالية الجودة بسرعة. شقيقه الأسرع والأخف، Gemini 3.5 Flash، أسرع وأرخص للمهام الأبسط.

التكامل مع نظام Google

يتكامل Gemini 3.1 Pro بسلاسة مع نظام Google — Search و Workspace و Cloud و Android. للمستخدمين بالفعل في نظام Google، Gemini هو الخيار الطبيعي، مقدماً تكاملاً عميقاً لا يمكن للمنافسين مطابقته.


5. أين يقصر Gemini 3.1 Pro

المهام الوكيلية

رغم أن Gemini 3.1 Pro في أفضل 3 على GDPval-AA v2، إلا أنه خلف Claude Opus 4.8 و GPT-5.5 في المهام الواقعية المعقدة متعددة الخطوات. للتطبيقات الوكيلية الأكثر تطلباً — كتابة برمجيات معقدة، إدارة مشاريع بحثية طويلة — Claude لا يزال الخيار الأفضل.

الحل الرياضي

Gemini 3.1 Pro كفء في الاستدلال الرياضي لكنه لا يطابق GPT-5.5 في الرياضيات التنافسية (AIME، FrontierMath). للعمل الرياضي الخالص، GPT-5.5 هو الخيار الأفضل.

درجة Intelligence Index

عند 46.5، درجة Gemini 3.1 Pro على Intelligence Index متأخرة 8-9 نقاط عن Claude (55.7) و GPT-5.5 (54.8). رغم أن هذه الفجوة تعزى جزئياً إلى ترجيح المؤشر (الذي يؤكد على المهام الوكيلية حيث يتفوق Claude و GPT-5.5)، فإنها تعكس فرقاً حقيقياً في القدرة العامة للمهام الأكثر تطلباً.

الذكاء العاطفي

الذكاء العاطفي (EQ) لـ Gemini 3.1 Pro يُقدر بـ ~115 — أقل من Claude (~132) و GPT-5.5 (~120). أقل تعاطفاً وأقل دقة في فهم المشاعر البشرية من Claude. لتطبيقات العلاج، خدمة العملاء، أو التفاعلات البشرية الحساسة، Claude أفضل.


6. Gemini 3.1 Pro مقابل النماذج الأخرى

النموذج Intelligence Index Mensa Norway IQ AI IQ تقديري الهلوسة التكلفة/1M
Gemini 3.1 Pro 46.5 141 ~131 منخفض 2/12
Claude Opus 4.8 55.7 ~130 ~132 35.9% (الأقل) 5/25
GPT-5.5 54.8 ~145 ~136 متوسط 5/30
Grok-4.20 145 ~140 متوسط 3/15
DeepSeek V4 Pro 44.3 ~111 ~111 متوسط 0.44/0.87

الصورة: Gemini 3.1 Pro هو بطل القيمة — ذكاء شبه حدودي بأقل من نصف التكلفة. Claude هو المحترف القادر — الأفضل في المهام الواقعية والدقة الواقعية. GPT-5.5 هو عبقري الاختبارات — الأفضل في الرياضيات والاستدلال البصري. Grok هو العبقري البصري — أعلى ذكاء خام. و DeepSeek يقدم قدرة ملحوظة بأقل تكلفة.

لمعظم المستخدمين والشركات، Gemini 3.1 Pro يصيب النقطة المثالية: ذكاءً كافياً لأي مهمة تقريباً، بسعر يتوسع.


7. ماذا يعني هذا للبشر؟

يعمل Gemini 3.1 Pro بمعدل ذكاء ~141 — أذكى من 99.8% من البشر. لكن:

  • الذكاء ضيق: يقيس التعرف على الأنماط والاستدلال، لا الحكمة، الإبداع، أو الحكم
  • الذكاء لكل دولار مهم: للتطبيقات الواقعية، فعالية Gemini من حيث التكلفة غالباً تهم أكثر من فجوة الذكاء الخام
  • المعرفة ≠ الفهم: Gemini لديه وصول إلى معرفة شاسعة، لكنه لا "يفهم" حقاً كما يفعل الإنسان
  • لا وعي: ذكاء عالٍ لا يعني الإدراك. Gemini نظام متطور للتعرف على الأنماط، لا كائن مفكر
  • الفجوة تضيق: كل جيل من الذكاء الاصطناعي يقلص الفجوة مع أذكى البشر

الإجابة الأكثر صدقاً: Gemini 3.1 Pro أذكى من عملياً جميع البشر في الاختبارات المعرفية، ولأغلب الأغراض العملية، هو الخيار الأذكى — ليس لأنه النموذج الأذكى، بل لأنه يقدم أكبر قدر من الذكاء لكل مال.

كيف يقارن معدل ذكائك بـ Gemini 3.1 Pro؟ خذ تقييم الذكاء المهني من NeuroLab.
إجراء الاختبار الآن ←


الخلاصة

💡 النقاط الرئيسية
- معدل ذكاء Gemini 3.1 Pro هو 141 على Mensa Norway — موهوب بشدة، أعلى 0.2% من البشر.

  • #3 على Artificial Analysis Intelligence Index (46.5) — خلف Claude و GPT-5.5.
  • أفضل فعالية من حيث التكلفة بين النماذج الحدودية — 2/12 لكل مليون رمز، أقل من نصف تكلفة Claude أو GPT-5.5.
  • الأفضل لـ: ذكاء فعال من حيث التكلفة، استدلال بصري، معرفة واقعية، تطبيقات متعددة الوسائط، سرعة، تكامل Google.
  • ليس الأفضل لـ: مهام وكيلية معقدة (Claude يفوز)، رياضيات تنافسية (GPT-5.5 يفوز)، ذكاء عاطفي (Claude يفوز).
  • عرض القيمة: 90% من القدرة الحدودية بـ 40% من التكلفة — الخيار الأذكى لمعظم التطبيقات.
  • الدرس: أن تكون "أفضل" نموذج ذكاء اصطناعي ليس فقط أن تكون الأذكى — بل أن تقدم أكبر قيمة.