Какой IQ у Gemini 3.1 Pro?
Gemini 3.1 Pro набирает 46.5 на Intelligence Index и 141 на Mensa Norway. Разбираем флагман Google DeepMind и его когнитивный профиль.
Gemini 3.1 Pro: флагман Google DeepMind
Gemini 3.1 Pro — самая способная модель Google DeepMind, выпущенная в 2026 году. Она набирает 46.5 на Artificial Analysis Intelligence Index v4.1 — #7 в мире, но с выдающимися результатами в определённых областях.
На тесте Mensa Norway IQ, Gemini 3.1 Pro Preview набрал 141 — третий результат в мире, после Grok-4.20 (145) и GPT-5.4 Pro Vision (145).
- Mensa Norway IQ (TrackingAI): 141 (#3 в мире)
- AI IQ композит (VexoWire): ~131
- AA-Omniscience: 32.9 (#1 в мире — высочайшая точность знаний)
- Стоимость: 2.00/12.00 за 1M токенов
1. Разбор бенчмарков
Artificial Analysis Intelligence Index v4.1
Gemini 3.1 Pro набирает 46.5 — ниже Claude Opus 4.8 (55.7) и GPT-5.5 (54.8), но сильна в специфических областях:
- AA-Omniscience (8%): 32.9 — #1 в мире (высочайшая точность знаний)
- GPQA (6%): сильный
- CritPt (6%): сильный (физика)
- GDPval-AA v2 (20%): умеренный
Тест Mensa Norway
Gemini 3.1 Pro Preview набрал 141 на визуальном тесте TrackingAI — исключительный результат. С поддержкой vision — 132 (вербализованная версия без vision: 141).
AI IQ композит
Проект AI IQ оценивает Gemini 3.1 Pro в ~131 IQ — в топ-кластере вместе с GPT-5.4 и Claude Opus 4.7.
Тест iqscore.io
Gemini 3.1 Pro набрал 129 — 33/36, с идеальными результатами по числовому и логическому мышлению.
2. Где Gemini 3.1 Pro сильна
Знания и фактическая точность
#1 в AA-Omniscience (32.9) — высочайшая точность, низший уровень галлюцинаций. Самая надёжная модель для фактической информации.
Визуальное распознавание паттернов
Mensa Norway IQ 141 — #3 в мире. Gemini превосходна в визуально-пространственном мышлении, особенно с vision.
Числовое и логическое мышление
На iqscore.io: 9/9 по числовому и 9/9 по логическому — идеально.
Скорость
Gemini 3.5 Flash (облегчённая версия) — 1.6 минуты на задачу, самая быстрая модель с баллом выше 46.
Экономичность
2.00/12.00 за 1M токенов — дешевле Claude Opus 4.8 (5/25) и GPT-5.5 (5/30).
3. Где отстаёт
Агентные задачи
Gemini 3.1 Pro набирает меньше на GDPval-AA v2 по сравнению с Claude и GPT. Менее эффективна в многошаговых реальных задачах.
Общий индекс интеллекта
46.5 — отстаёт от Claude Opus 4.8 (55.7) на 9 баллов — значительный разрыв по композитному мышлению.
Пространственное мышление (без vision)
Без vision результат Mensa Norway падает с 141 до 132 — сильная зависимость от визуальной обработки.
4. Gemini 3.1 Pro vs другие модели
| Модель | Intelligence Index | Mensa Norway IQ | AI IQ оцен. | Стоимость/1M |
|---|---|---|---|---|
| Gemini 3.1 Pro | 46.5 | 141 | ~131 | 2/12 |
| Claude Opus 4.8 | 55.7 | ~130 | ~132-145 | 5/25 |
| GPT-5.5 | 54.8 | ~145 | ~136 | 5/30 |
| Grok-4.20 | — | 145 | — | 3/15 |
| DeepSeek V4 Pro | 44.3 | ~111 | ~111 | 0.44/0.87 |
5. Что это значит для людей?
Gemini 3.1 Pro работает на оценочном IQ 131-141 — выше, чем у 98-99% людей. Но:
- IQ 141 = топ 0.25%: выше большинства членов Mensa
- Знания ≠ мышление: знание фактов ≠ решение проблем
- Визуальный гений, агентный середняк: сильна в паттернах, слабее в многошаговых задачах
- Преимущество скорости: быстрее и дешевле Claude и GPT
Заключение
- Mensa Norway IQ: 141 — #3 в мире, исключительное визуальное мышление.
- #1 в AA-Omniscience: самая точная, минимальные галлюцинации.
- Intelligence Index: 46.5 — ниже Claude/GPT по композитным задачам.
- Самая дешёвая фронтальная модель: 2/12 за 1M токенов.
- Лучше всего для фактических запросов и визуальных паттернов, не агентных задач.
- Идеально 9/9 по числовому и логическому мышлению (iqscore.io).