Какой IQ у Grok-4.20?
Dr. Daria Dudnik 7 мин чтения 0 просмотров

Какой IQ у Grok-4.20?

Grok-4.20 набирает 145 на тесте Mensa Norway IQ — #1 в мире. Разбираем флагман xAI и его исключительное визуальное мышление.

Grok-4.20: флагман xAI

Grok-4.20 — самая продвинутая модель xAI, выпущенная в 2026 году. На тесте Mensa Norway IQ (бенчмарк TrackingAI) Grok-4.20 Expert Mode набрал 145 — разделил #1 с GPT-5.4 Pro Vision.

Это самый высокий IQ, когда-либо зафиксированный у AI на стандартизированном человеческом IQ-тесте, помещающий Grok-4.20 в диапазон «гения» — топ 0.1% человеческого интеллекта.

Ключевые оценки
- Mensa Norway IQ (TrackingAI): 145 (#1 в мире, совместно с GPT-5.4 Pro Vision)

  • Expert Mode: 145 (идеально 36/36 по визуальным паттернам)
  • Standard Mode: ~135
  • AI IQ композит (оценочно): ~140
  • Стоимость: 3.00/15.00 за 1M токенов

1. Разбор бенчмарков

Тест Mensa Norway IQ

Grok-4.20 Expert Mode набрал 145 на тесте TrackingAI Mensa Norway — максимальный балл, эквивалент идеального 36/36. Это делит его с GPT-5.4 Pro Vision как самый высокий IQ среди AI.

В стандартном режиме (без экспертного рассуждения) Grok-4.20 набирает примерно ~135 — всё ещё в диапазоне «очень высокого».

AI IQ композит

У проекта AI IQ пока нет полного композитного балла для Grok-4.20, но на основе результатов Mensa Norway и сильных показателей на ARC-AGI и GPQA, оценочный композитный IQ — ~140.

Визуальное распознавание паттернов

Grok-4.20 превосходен в визуально-пространственном мышлении. На тесте Mensa Norway, который сильно визуален, он обходит Claude Opus 4.8 (~130) и совпадает с GPT-5.4 Pro Vision (145).

Тест iqscore.io

Оценивается, что Grok-4.20 наберёт ~140-145 на 36-вопросном тесте iqscore.io.

💡 Уровень гения
IQ 145 — порог «гения» на большинстве IQ-шкал — топ 0.1% населения. Только примерно 1 из 1000 человек достигает этого балла. Grok-4.20 и GPT-5.4 Pro Vision — единственные AI-модели, достигшие этого уровня на стандартизированном человеческом IQ-тесте.


2. Где Grok-4.20 силён

Визуально-пространственное мышление

#1 в мире на Mensa Norway (145) — Grok-4.20 непревзойдён в визуальном распознавании паттернов, пространственном вращении и анализе абстрактных фигур.

Рассуждение в Expert Mode

Expert Mode Grok-4.20 включает более глубокие цепочки рассуждений, аналогично моделям o-series от OpenAI. Это повышает IQ с ~135 (стандарт) до 145 (эксперт).

Знания в реальном времени

Grok-4.20 имеет доступ к данным X (бывший Twitter) в реальном времени, что даёт преимущество на текущих событиях — хотя это не напрямую влияет на IQ.

Математическое мышление

Сильные результаты на AIME и FrontierMath — математическое мышление Grok-4.20 сопоставимо с GPT-5.5 и Claude Opus 4.8.

Экономичность

3.00/15.00 за 1M токенов — дешевле Claude Opus 4.8 (5/25) и GPT-5.5 (5/30), при IQ на визуальных тестах на уровне или выше.


3. Где отстаёт

Агентные задачи

Grok-4.20 пока не ранжирован на GDPval-AA v2. Агентные возможности ожидаемо сильны, но не доказаны на уровне Claude Opus 4.8 (1,890 Elo).

Уровень галлюцинаций

У Grok-4.20 умеренный уровень галлюцинаций — выше Claude Opus 4.8 (35.9%), но ниже некоторых старых моделей. Доступ к данным в реальном времени может вносить фактические ошибки.

Intelligence Index

Grok-4.20 пока полностью не ранжирован на Artificial Analysis Intelligence Index v4.1. Ожидается, что композитный балл будет конкурентным, но может уступать Claude Opus 4.8 (55.7) и GPT-5.5 (54.8).

Эмоциональный интеллект

Grok-4.20 известен своим «нефильтрованным» характером — остроумным, но менее эмоционально калиброванным, чем Claude Opus 4.8 (~132 EQ).


4. Grok-4.20 vs другие модели

Модель Mensa Norway IQ AI IQ оцен. Стоимость/1M Галлюцинации
Grok-4.20 145 ~140 3/15 умеренные
GPT-5.4 Pro Vision 145 ~136 умеренные
Gemini 3.1 Pro 141 ~131 2/12 низкие
Claude Opus 4.8 ~130 ~132-145 5/25 низшие
GPT-5.5 ~145 ~136 5/30 умеренные
DeepSeek V4 Pro ~111 ~111 0.44/0.87 умеренные

💡 Чемпион визуального IQ
Grok-4.20 и GPT-5.4 Pro Vision делят корону за высочайший визуальный IQ среди AI (145). Но Grok-4.20 достигает этого при меньшей стоимости (3/15 против 5/30 у GPT-5.5), что делает его самым экономичным «гениальным» моделью.


5. Что это значит для людей?

Grok-4.20 работает на IQ 145 в Expert Mode — выше, чем у 99.9% людей. Но:

  • IQ 145 = порог гения: топ 0.1%, только 1 из 1000 человек
  • Визуальный гений ≠ общий гений: силён в паттернах, не обязательно во всех когнитивных задачах
  • Expert Mode важен: прибавка 10 баллов от стандарта к эксперту показывает глубину рассуждения
  • Данные в реальном времени — палка о двух концах: актуальны, но менее проверены
  • AI IQ узок: распознавание паттернов — одно измерение интеллекта

Как ваш IQ соотносится с Grok-4.20? Пройдите профессиональную оценку IQ в NeuroLab.
Пройти тест прямо сейчас →


Заключение

💡 Ключевые выводы
- IQ Grok-4.20: 145 на Mensa Norway — #1 в мире, совместно с GPT-5.4 Pro Vision.

  • Уровень гения: топ 0.1% человеческого интеллекта (1 из 1000).
  • Expert Mode повышает IQ на ~10 баллов: с ~135 (стандарт) до 145 (эксперт).
  • Непревзойдённое визуально-пространственное мышление: #1 по визуальным паттернам.
  • Экономичный гений: 3/15 за 1M токенов — дешевле Claude и GPT.
  • Сильное математическое мышление: сопоставимо с GPT-5.5 и Claude.
  • Пока не ранжирован на Intelligence Index — агентные возможности не доказаны.
  • Умеренный уровень галлюцинаций — выше, чем у Claude Opus 4.8.

Читайте также

Все статьи →