Какой IQ у Gemini 3.1 Pro?
Dr. Daria Dudnik 7 мин чтения 0 просмотров

Какой IQ у Gemini 3.1 Pro?

Gemini 3.1 Pro набирает 46.5 на Intelligence Index и 141 на Mensa Norway. Разбираем флагман Google DeepMind и его когнитивный профиль.

Gemini 3.1 Pro: флагман Google DeepMind

Gemini 3.1 Pro — самая способная модель Google DeepMind, выпущенная в 2026 году. Она набирает 46.5 на Artificial Analysis Intelligence Index v4.1 — #7 в мире, но с выдающимися результатами в определённых областях.

На тесте Mensa Norway IQ, Gemini 3.1 Pro Preview набрал 141 — третий результат в мире, после Grok-4.20 (145) и GPT-5.4 Pro Vision (145).

Ключевые оценки
- Artificial Analysis Intelligence Index: 46.5 (#7 в мире)

  • Mensa Norway IQ (TrackingAI): 141 (#3 в мире)
  • AI IQ композит (VexoWire): ~131
  • AA-Omniscience: 32.9 (#1 в мире — высочайшая точность знаний)
  • Стоимость: 2.00/12.00 за 1M токенов

1. Разбор бенчмарков

Artificial Analysis Intelligence Index v4.1

Gemini 3.1 Pro набирает 46.5 — ниже Claude Opus 4.8 (55.7) и GPT-5.5 (54.8), но сильна в специфических областях:

  • AA-Omniscience (8%): 32.9 — #1 в мире (высочайшая точность знаний)
  • GPQA (6%): сильный
  • CritPt (6%): сильный (физика)
  • GDPval-AA v2 (20%): умеренный

Тест Mensa Norway

Gemini 3.1 Pro Preview набрал 141 на визуальном тесте TrackingAI — исключительный результат. С поддержкой vision — 132 (вербализованная версия без vision: 141).

AI IQ композит

Проект AI IQ оценивает Gemini 3.1 Pro в ~131 IQ — в топ-кластере вместе с GPT-5.4 и Claude Opus 4.7.

Тест iqscore.io

Gemini 3.1 Pro набрал 129 — 33/36, с идеальными результатами по числовому и логическому мышлению.

💡 Король знаний
Gemini 3.1 Pro лидирует в AA-Omniscience с 32.9 — бенчмарк точности фактических знаний. Самый низкий уровень галлюцинаций среди всех фронтальных моделей. Самая надёжная модель для фактических запросов.


2. Где Gemini 3.1 Pro сильна

Знания и фактическая точность

#1 в AA-Omniscience (32.9) — высочайшая точность, низший уровень галлюцинаций. Самая надёжная модель для фактической информации.

Визуальное распознавание паттернов

Mensa Norway IQ 141 — #3 в мире. Gemini превосходна в визуально-пространственном мышлении, особенно с vision.

Числовое и логическое мышление

На iqscore.io: 9/9 по числовому и 9/9 по логическому — идеально.

Скорость

Gemini 3.5 Flash (облегчённая версия) — 1.6 минуты на задачу, самая быстрая модель с баллом выше 46.

Экономичность

2.00/12.00 за 1M токенов — дешевле Claude Opus 4.8 (5/25) и GPT-5.5 (5/30).


3. Где отстаёт

Агентные задачи

Gemini 3.1 Pro набирает меньше на GDPval-AA v2 по сравнению с Claude и GPT. Менее эффективна в многошаговых реальных задачах.

Общий индекс интеллекта

46.5 — отстаёт от Claude Opus 4.8 (55.7) на 9 баллов — значительный разрыв по композитному мышлению.

Пространственное мышление (без vision)

Без vision результат Mensa Norway падает с 141 до 132 — сильная зависимость от визуальной обработки.


4. Gemini 3.1 Pro vs другие модели

Модель Intelligence Index Mensa Norway IQ AI IQ оцен. Стоимость/1M
Gemini 3.1 Pro 46.5 141 ~131 2/12
Claude Opus 4.8 55.7 ~130 ~132-145 5/25
GPT-5.5 54.8 ~145 ~136 5/30
Grok-4.20 145 3/15
DeepSeek V4 Pro 44.3 ~111 ~111 0.44/0.87

💡 Парадокс
У Gemini 3.1 Pro самый высокий Mensa Norway IQ (141) среди не-Grok/GPT моделей, но самый низкий Intelligence Index (46.5) среди фронтальных моделей. Это показывает, что визуальное распознавание паттернов и композитное мышление — разные когнитивные способности.


5. Что это значит для людей?

Gemini 3.1 Pro работает на оценочном IQ 131-141 — выше, чем у 98-99% людей. Но:

  • IQ 141 = топ 0.25%: выше большинства членов Mensa
  • Знания ≠ мышление: знание фактов ≠ решение проблем
  • Визуальный гений, агентный середняк: сильна в паттернах, слабее в многошаговых задачах
  • Преимущество скорости: быстрее и дешевле Claude и GPT

Как ваш IQ соотносится с Gemini 3.1 Pro? Пройдите профессиональную оценку IQ в NeuroLab.
Пройти тест прямо сейчас →


Заключение

💡 Ключевые выводы
- Оценочный IQ Gemini 3.1 Pro: 131-141 в зависимости от теста.

  • Mensa Norway IQ: 141 — #3 в мире, исключительное визуальное мышление.
  • #1 в AA-Omniscience: самая точная, минимальные галлюцинации.
  • Intelligence Index: 46.5 — ниже Claude/GPT по композитным задачам.
  • Самая дешёвая фронтальная модель: 2/12 за 1M токенов.
  • Лучше всего для фактических запросов и визуальных паттернов, не агентных задач.
  • Идеально 9/9 по числовому и логическому мышлению (iqscore.io).

Читайте также

Все статьи →