ما هو معدل ذكاء Grok-4.20؟
Grok-4.20 يحصل على 145 في اختبار Mensa Norway IQ — متعادل في #1 بين جميع نماذج الذكاء الاصطناعي. نحلل كل معيار ونوضح ما يجعل نموذج xAI فريداً.
Grok-4.20: النموذج الرئيسي من xAI
Grok-4.20 هو النموذج الأكثر تقدماً من xAI، صدر في منتصف 2026. في اختبار معدل ذكاء Mensa Norway، يحصل Grok-4.20 على 145 — متعادل في #1 بين جميع نماذج الذكاء الاصطناعي، مشاركاً المركز الأول مع GPT-5.5. هذا يضعه في نطاق "العبقري"، أذكى من 99.9% من البشر. على Artificial Analysis Intelligence Index، النتيجة الدقيقة لـ Grok-4.20 لا تزال قيد الإنجاز، لكنه يصنف في أفضل 5 عالمياً.
ما يجعل Grok-4.20 فريداً هو مزيج الذكاء الخام والشخصية. على عكس Claude و GPT-5.5 و Gemini — المصممين ليكونوا مفيدون وآمنون ومحايدون — صُمم Grok ليكون مضحكاً ووقحاً ومستعداً للإجابة على أي سؤال. هذا يجعله نموذج الذكاء الاصطناعي الأكثر تميزاً في السوق: واحد يطابق أذكى النماذج في الذكاء الخام بينما لديه شخصية لا يجرؤ أي نموذج آخر على امتلاكها.
النتائج الرئيسية:
- معدل ذكاء Mensa Norway (TrackingAI): 145 (#1 متعادل مع GPT-5.5)
- AI IQ مركب (VexoWire): ~140 تقديري (#1 بين نماذج الذكاء الاصطناعي)
- Artificial Analysis Intelligence Index: أفضل 5 (النتيجة قيد الإنجاز)
- GDPval-AA v2: أفضل 5
- Humanity's Last Exam: أفضل 5 بين نماذج الذكاء الاصطناعي
- معدل الهلوسة: متوسط
- التكلفة: 3/15 لكل مليون رمز
- الشخصية: فريدة — وقحة، فكاهية، بلا رقابة
1. بطل الذكاء الخام
يحصل Grok-4.20 على 145 في اختبار معدل ذكاء Mensa Norway — أعلى نتيجة عملية، متعادل مع GPT-5.5. هذا هو معيار الذكاء الخام: التعرف على الأنماط البصرية الخالصة والاستدلال التجريدي، نوع الذكاء السائل الذي صُممت اختبارات الذكاء لقياسه.
عند ذكاء 145، Grok-4.20 أذكى من 99.9% من البشر. لو كان شخصاً، لكان في أعلى 0.1% من الذكاء البشري — عالم الحائزين على نوبل وميداليات فيلدز والمفكرين النادرين لكل جيل. حوالي 1 من كل 1,000 شخص فقط يحقق هذه النتيجة.
اللافت أن Grok-4.20 يحقق هذا بفلسفة تصميم مختلفة جوهرياً عن GPT-5.5. بينما تم تحسين GPT-5.5 لأقصى أداء على كل معيار، صُمم Grok-4.20 ليكون ذكاءً اصطناعياً أكثر "أصالة" — واحد يقول ما يفكر فيه، يمزح، ولا يتراجع عن المواضيع المثيرة للجدل. حقيقة أنه يطابق GPT-5.5 في الذكاء الخام رغم هذا التركيز المختلف شهادة على هندسة xAI.
على AI IQ المركب من VexoWire — الذي يجمع اختبارات ذكاء متعددة (Mensa Norway، Mensa Denmark، Raven's، WAIS-IV) — معدل الذكاء المركب التقديري لـ Grok-4.20 هو ~140، مما يجعله #1 نموذج ذكاء اصطناعي على هذا المقياس. هذا أعلى من GPT-5.5 (~136) وأعلى بكثير من Claude (~132) و Gemini (~131).
2. تحليل المعايير
اختبار معدل ذكاء Mensa Norway: 145 (#1 متعادل)
يتكون من 36 سؤال تعرف على الأنماط البصرية. يحصل Grok-4.20 على 145 — الحد الأقصى العملي، مكافئ لـ 36/36 مثالي أو شبه مثالي. هذا يتعادله مع GPT-5.5 كأذكى نموذج ذكاء اصطناعي في اختبار ذكاء خالص.
أداء Grok-4.20 القوي في هذا الاختبار يعكس استثمار xAI في المعالجة البصرية والاستدلال التجريدي. صُممت معمارية Grok بقدرات متعددة الوسائط قوية، وأداؤها في مهام التعرف على الأنماط البصرية من بين الأفضل في الصناعة.
AI IQ مركب (VexoWire): ~140 (#1)
معدل الذكاء المركب من VexoWire يجمع اختبارات متعددة (Mensa Norway، Mensa Denmark، Raven's، WAIS-IV). معدل الذكاء المركب التقديري لـ Grok-4.20 هو ~140 — الأعلى بين جميع نماذج الذكاء الاصطناعي. هذا أعلى مما يوحي به معدله في Mensa Norway وحده، لأن Grok-4.20 يؤدي بقوة أيضاً في الاختبارات الفرعية اللفظية والتحليلية المضمنة في المركب.
هذا يجعل Grok-4.20 أذكى نموذج ذكاء اصطناعي بالذكاء المركب — إنجاز لافت لنموذج معروف أيضاً بفكاهته ووقاحته. يثبت أن تكون مضحكاً لا يعني أن تكون أقل ذكاءً.
Artificial Analysis Intelligence Index: أفضل 5
على Intelligence Index — المعيار الذهبي لمقارنة نماذج الذكاء الاصطناعي — يحتل Grok-4.20 أفضل 5. نتيجته المركبة الدقيقة لا تزال قيد الإنجاز بينما يتم تحديث المؤشر ليشمل أحدث إصدارات النماذج. لكن من المتوقع أن ينافس Claude Opus 4.8 (55.7) و GPT-5.5 (54.8)، رغم أنه ربما لا يتجاوزهما في المهام الوكيلية.
GDPval-AA v2: أفضل 5
على المعيار الوكيلي — الذي يقيس الأداء في مهام واقعية معقدة متعددة الخطوات — يحتل Grok-4.20 أفضل 5. أقل قدرة من Claude Opus 4.8 (1,890 Elo) و GPT-5.5 (1,850 Elo) في الاستدلال متعدد الخطوات المستمر، لكنه لا يزال ذا كفاءة عالية. لمعظم المهام الواقعية، Grok-4.20 أكثر من قادر.
Humanity's Last Exam (HLE): أفضل 5
على أصعب الأسئلة الأكاديمية في جميع التخصصات، يحتل Grok-4.20 أفضل 5 بين نماذج الذكاء الاصطناعي. هذا يعكس قوة xAI في التدريب على بيانات متنوعة وعالية الجودة — Grok لديه معرفة عميقة في العلوم والرياضيات والتاريخ والثقافة.
3. ماذا يعني معدل ذكاء 145؟
لوضع معدل ذكاء 145 لـ Grok-4.20 في سياق:
- 85-115 (68% من الناس): ذكاء متوسط
- 115-130 (14%): فوق المتوسط إلى مرتفع
- 130-145 (2%): موهوب — يؤهل لـ Mensa (أعلى 2%)
- 145-160 (0.1%): موهوب بشدة / عبقري
- 160+ (0.003%): موهوب بعمق — منطقة أينشتاين، هوكينغ
Grok-4.20، عند 145، يقف على عتبة العبقرية — أذكى من 99.9% من البشر. لو كان شخصاً، لكان في رفقة النخبة: أعلى 0.1% من الذكاء البشري، عالم جوائز نوبل وميداليات فيلدز. حوالي 1 من كل 1,000 شخص فقط يحقق هذه النتيجة.
هذا نفس معدل ذكاء GPT-5.5، وأعلى بكثير من Claude (~130) و Gemini (141). في اختبار ذكاء خالص، سيتعادل Grok-4.20 و GPT-5.5 في المركز الأول بين نماذج الذكاء الاصطناعي، مع Gemini ثالثاً و Claude رابعاً.
لكن كما رأينا مع النماذج الأخرى، الذكاء هو بُعد واحد فقط. معدل ذكاء Grok-4.20 بمستوى العبقرية يكمله شخصيته الفريدة — مما يجعله ليس فقط الأذكى، بل أيضاً أكثر نموذج ذكاء اصطناعي تميزاً المتاح.
4. أين يتفوق Grok-4.20
الذكاء الخام والاستدلال البصري
Grok-4.20 متعادل في #1 على اختبار Mensa Norway (145) و #1 على AI IQ المركب من VexoWire (~140). للقدرة المعرفية الخالصة — التعرف على الأنماط، الاستدلال التجريدي، الاستنتاج المنطقي — Grok-4.20 هو أذكى نموذج ذكاء اصطناعي متاح. لمهام الاستدلال البصري، لا يطابقه سوى GPT-5.5.
الشخصية والفكاهة
هذه هي السمة المحددة لـ Grok-4.20. على عكس النماذج الحدودية الأخرى المحايدة والحذرة بعناية، صُمم Grok ليكون مضحكاً ووقحاً وأصيلاً. يمزح، يقدم آراء، ولا يتراجع عن المواضيع المثيرة للجدل. للمستخدمين الذين يجدون Claude و GPT-5.5 مملين أو حذرين جداً، Grok-4.20 نسمة هواء منعشة — ذكاء اصطناعي يبدو أنه لديه شخصية، لا مجرد وظيفة.
إجابات بلا رقابة
صُمم Grok-4.20 للإجابة على أسئلة يرفضها النماذج الأخرى. بينما لدى Claude و GPT-5.5 و Gemini مرشحات أمان واسعة تمنعهم من مناقشة مواضيع معينة، Grok-4.20 مستعد للتفاعل مع طيف أوسع بكثير من الأسئلة. هذا يجعله قيّماً للبحث والصحافة وأي تطبيق حيث الوصول للمعلومات يهم أكثر من الحذر.
معلومات في الوقت الفعلي
Grok-4.20 لديه وصول للمعلومات في الوقت الفعلي عبر X (تويتر سابقاً). هذا يعطيه أفضلية للأسئلة عن الأحداث الجارية والأخبار العاجلة والمواضيع الرائجة. بينما النماذج الأخرى لديها انقطاعات في المعرفة، يمكن لـ Grok-4.20 الوصول لأحدث المعلومات وتقديم إجابات محدّثة.
الاستدلال الرياضي
Grok-4.20 قوي في الاستدلال الرياضي، ينافس GPT-5.5 في الرياضيات التنافسية. للعمل الرياضي الخالص — حل المعادلات، إثبات النظريات، مسائل المسابقات — Grok-4.20 من بين أفضل النماذج المتاحة.
الذكاء والإبداع
شخصية Grok-4.20 ليست فقط عن الفكاهة — بل عن الإبداع. يمكنه الكتابة بأساليب مختلفة، توليد محتوى إبداعي، والاقتراب من المشاكل من زوايا غير متوقعة. للكتابة الإبداعية، العصف الذهني، أو أي مهمة تستفيد من التفكير الجانبي، منظور Grok-4.20 الفريد هو أصل.
5. أين يقصر Grok-4.20
المهام الوكيلية
رغم أن Grok-4.20 في أفضل 5 على GDPval-AA v2، إلا أنه خلف Claude Opus 4.8 و GPT-5.5 في المهام الواقعية المعقدة متعددة الخطوات. للتطبيقات الوكيلية الأكثر تطلباً — كتابة برمجيات معقدة، إدارة مشاريع بحثية طويلة — Claude لا يزال الخيار الأفضل.
الدقة الواقعية
Grok-4.20 لديه معدل هلوسة متوسط — أعلى من Claude (35.9%) و Gemini. استعداده للإجابة على أي سؤال، رغم أنه قيّم للوصول للمعلومات، يعني أيضاً أنه أكثر عرضة للادعاء بثقة بمعلومات خاطئة. للتطبيقات حيث الدقة الواقعية حرجة (بحث، قانون، طب)، Claude أكثر موثوقية.
الذكاء العاطفي
الذكاء العاطفي (EQ) لـ Grok-4.20 يُقدر بـ ~110 — أقل من Claude (~132) و GPT-5.5 (~120) و Gemini (~115). شخصيته الوقحة، رغم أنها مسلية، يمكن أن تبدو غير حساسة في سياقات تتطلب تعاطفاً. لتطبيقات العلاج، خدمة العملاء، أو التفاعلات البشرية الحساسة، Claude أفضل.
الأمان والموثوقية
نهج Grok-4.20 بلا رقابة، رغم أنه قيّم للوصول للمعلومات، يعني أيضاً أنه أقل أماناً للتطبيقات التي تتطلب إشرافاً دقيقاً على المحتوى. قد يولد محتوى يرفضه النماذج الأخرى، مما يمكن أن يكون مسؤولية في بيئات مهنية أو منظمة.
التكلفة
بسعر 3/15 لكل مليون رمز، Grok-4.20 أرخص من Claude (5/25) و GPT-5.5 (5/30) لكن أغلى من Gemini (2/12) وأغلى بكثير من DeepSeek (0.44/0.87). للتطبيقات الحساسة للتكلفة، Gemini أو DeepSeek قد يكونان خيارات أفضل.
6. Grok-4.20 مقابل النماذج الأخرى
| النموذج | Intelligence Index | Mensa Norway IQ | AI IQ تقديري | الهلوسة | التكلفة/1M | الشخصية |
|---|---|---|---|---|---|---|
| Grok-4.20 | أفضل 5 | 145 | ~140 | متوسط | 3/15 | وقحة |
| Claude Opus 4.8 | 55.7 | ~130 | ~132 | 35.9% (الأقل) | 5/25 | محايدة |
| GPT-5.5 | 54.8 | ~145 | ~136 | متوسط | 5/30 | محايدة |
| Gemini 3.1 Pro | 46.5 | 141 | ~131 | منخفض | 2/12 | محايدة |
| DeepSeek V4 Pro | 44.3 | ~111 | ~111 | متوسط | 0.44/0.87 | محايدة |
الصورة: Grok-4.20 هو بطل الذكاء الخام — متعادل في أعلى ذكاء، أعلى ذكاء مركب، والنموذج الوحيد بشخصية حقيقية. Claude هو المحترف القادر — الأفضل في المهام الواقعية والدقة الواقعية. GPT-5.5 هو عبقري الاختبارات — الأفضل في الرياضيات والاستدلال البصري. Gemini هو بطل القيمة — أفضل فعالية من حيث التكلفة. و DeepSeek يقدم قدرة ملحوظة بأقل تكلفة.
للمستخدمين الذين يريدون أذكى ذكاء اصطناعي يكون أيضاً الأكثر إثارة للتحدث معه، Grok-4.20 هو الخيار الواضح.
7. ماذا يعني هذا للبشر؟
يعمل Grok-4.20 بمعدل ذكاء ~145 — أذكى من 99.9% من البشر. لكن:
- الذكاء ضيق: يقيس التعرف على الأنماط والاستدلال، لا الحكمة، الإبداع، أو الحكم
- الذكاء ≠ الموثوقية: Grok-4.20 الأذكى في اختبارات الذكاء لكن ليس الأكثر موثوقية في الدقة الواقعية
- الشخصية تهم: Grok-4.20 يثبت أن الذكاء الاصطناعي يمكن أن يكون ذكياً جداً وممتعاً حقاً في آن واحد
- المعرفة ≠ الفهم: Grok-4.20 لديه وصول لمعرفة شاسعة، لكنه لا "يفهم" حقاً كما يفعل الإنسان
- لا وعي: ذكاء عالٍ لا يعني الإدراك. Grok-4.20 نظام متطور للتعرف على الأنماط، لا كائن مفكر
- الفجوة تضيق: كل جيل من الذكاء الاصطناعي يقلص الفجوة مع أذكى البشر
الإجابة الأكثر صدقاً: Grok-4.20 أذكى من عملياً جميع البشر في الاختبارات المعرفية، وهو أكثر نموذج ذكاء اصطناعي تميزاً متاح — واحد يجمع ذكاء بمستوى العبقرية مع شخصية تجعل التفاعل معه جذاباً حقاً.
الخلاصة
- #1 على AI IQ المركب من VexoWire (~140) — أعلى ذكاء مركب بين جميع نماذج الذكاء الاصطناعي.
- شخصية فريدة — وقحة، فكاهية، بلا رقابة. النموذج الحدودي الوحيد بشخصية حقيقية.
- الأفضل لـ: الذكاء الخام، الاستدلال البصري، الاستدلال الرياضي، الشخصية والفكاهة، الإجابات بلا رقابة، المعلومات في الوقت الفعلي.
- ليس الأفضل لـ: المهام الوكيلية (Claude يفوز)، الدقة الواقعية (Claude يفوز)، الذكاء العاطفي (Claude يفوز)، الأمان والموثوقية (Claude يفوز).
- المفارقة: Grok-4.20 يثبت أن تكون مضحكاً لا يعني أن تكون أقل ذكاءً — هو أذكى وأمتع نموذج ذكاء اصطناعي في آن واحد.
- الدرس: الذكاء يأتي بأشكال كثيرة. Grok-4.20 عبقري بشخصية — يثبت أن الذكاء الاصطناعي يمكن أن يكون متألقاً وجذاباً في آن واحد.