Какой IQ у Grok-4.20?
Grok-4.20 набирает 145 на тесте Mensa Norway IQ — #1 в мире. Разбираем флагман xAI и его исключительное визуальное мышление.
Grok-4.20: флагман xAI
Grok-4.20 — самая продвинутая модель xAI, выпущенная в 2026 году. На тесте Mensa Norway IQ (бенчмарк TrackingAI) Grok-4.20 Expert Mode набрал 145 — разделил #1 с GPT-5.4 Pro Vision.
Это самый высокий IQ, когда-либо зафиксированный у AI на стандартизированном человеческом IQ-тесте, помещающий Grok-4.20 в диапазон «гения» — топ 0.1% человеческого интеллекта.
- Expert Mode: 145 (идеально 36/36 по визуальным паттернам)
- Standard Mode: ~135
- AI IQ композит (оценочно): ~140
- Стоимость: 3.00/15.00 за 1M токенов
1. Разбор бенчмарков
Тест Mensa Norway IQ
Grok-4.20 Expert Mode набрал 145 на тесте TrackingAI Mensa Norway — максимальный балл, эквивалент идеального 36/36. Это делит его с GPT-5.4 Pro Vision как самый высокий IQ среди AI.
В стандартном режиме (без экспертного рассуждения) Grok-4.20 набирает примерно ~135 — всё ещё в диапазоне «очень высокого».
AI IQ композит
У проекта AI IQ пока нет полного композитного балла для Grok-4.20, но на основе результатов Mensa Norway и сильных показателей на ARC-AGI и GPQA, оценочный композитный IQ — ~140.
Визуальное распознавание паттернов
Grok-4.20 превосходен в визуально-пространственном мышлении. На тесте Mensa Norway, который сильно визуален, он обходит Claude Opus 4.8 (~130) и совпадает с GPT-5.4 Pro Vision (145).
Тест iqscore.io
Оценивается, что Grok-4.20 наберёт ~140-145 на 36-вопросном тесте iqscore.io.
2. Где Grok-4.20 силён
Визуально-пространственное мышление
#1 в мире на Mensa Norway (145) — Grok-4.20 непревзойдён в визуальном распознавании паттернов, пространственном вращении и анализе абстрактных фигур.
Рассуждение в Expert Mode
Expert Mode Grok-4.20 включает более глубокие цепочки рассуждений, аналогично моделям o-series от OpenAI. Это повышает IQ с ~135 (стандарт) до 145 (эксперт).
Знания в реальном времени
Grok-4.20 имеет доступ к данным X (бывший Twitter) в реальном времени, что даёт преимущество на текущих событиях — хотя это не напрямую влияет на IQ.
Математическое мышление
Сильные результаты на AIME и FrontierMath — математическое мышление Grok-4.20 сопоставимо с GPT-5.5 и Claude Opus 4.8.
Экономичность
3.00/15.00 за 1M токенов — дешевле Claude Opus 4.8 (5/25) и GPT-5.5 (5/30), при IQ на визуальных тестах на уровне или выше.
3. Где отстаёт
Агентные задачи
Grok-4.20 пока не ранжирован на GDPval-AA v2. Агентные возможности ожидаемо сильны, но не доказаны на уровне Claude Opus 4.8 (1,890 Elo).
Уровень галлюцинаций
У Grok-4.20 умеренный уровень галлюцинаций — выше Claude Opus 4.8 (35.9%), но ниже некоторых старых моделей. Доступ к данным в реальном времени может вносить фактические ошибки.
Intelligence Index
Grok-4.20 пока полностью не ранжирован на Artificial Analysis Intelligence Index v4.1. Ожидается, что композитный балл будет конкурентным, но может уступать Claude Opus 4.8 (55.7) и GPT-5.5 (54.8).
Эмоциональный интеллект
Grok-4.20 известен своим «нефильтрованным» характером — остроумным, но менее эмоционально калиброванным, чем Claude Opus 4.8 (~132 EQ).
4. Grok-4.20 vs другие модели
| Модель | Mensa Norway IQ | AI IQ оцен. | Стоимость/1M | Галлюцинации |
|---|---|---|---|---|
| Grok-4.20 | 145 | ~140 | 3/15 | умеренные |
| GPT-5.4 Pro Vision | 145 | ~136 | — | умеренные |
| Gemini 3.1 Pro | 141 | ~131 | 2/12 | низкие |
| Claude Opus 4.8 | ~130 | ~132-145 | 5/25 | низшие |
| GPT-5.5 | ~145 | ~136 | 5/30 | умеренные |
| DeepSeek V4 Pro | ~111 | ~111 | 0.44/0.87 | умеренные |
5. Что это значит для людей?
Grok-4.20 работает на IQ 145 в Expert Mode — выше, чем у 99.9% людей. Но:
- IQ 145 = порог гения: топ 0.1%, только 1 из 1000 человек
- Визуальный гений ≠ общий гений: силён в паттернах, не обязательно во всех когнитивных задачах
- Expert Mode важен: прибавка 10 баллов от стандарта к эксперту показывает глубину рассуждения
- Данные в реальном времени — палка о двух концах: актуальны, но менее проверены
- AI IQ узок: распознавание паттернов — одно измерение интеллекта
Заключение
- Уровень гения: топ 0.1% человеческого интеллекта (1 из 1000).
- Expert Mode повышает IQ на ~10 баллов: с ~135 (стандарт) до 145 (эксперт).
- Непревзойдённое визуально-пространственное мышление: #1 по визуальным паттернам.
- Экономичный гений: 3/15 за 1M токенов — дешевле Claude и GPT.
- Сильное математическое мышление: сопоставимо с GPT-5.5 и Claude.
- Пока не ранжирован на Intelligence Index — агентные возможности не доказаны.
- Умеренный уровень галлюцинаций — выше, чем у Claude Opus 4.8.