Какой IQ у Gemini 3.1 Pro?
Dr. Daria Dudnik 10 мин чтения 26 просмотров

Какой IQ у Gemini 3.1 Pro?

Gemini 3.1 Pro набирает 141 на тесте Mensa Norway IQ и 46.5 на Intelligence Index. Разбираем каждый бенчмарк и объясняем, почему это самый выгодный frontier-модель.

Gemini 3.1 Pro: флагманская модель Google DeepMind

Gemini 3.1 Pro — самая продвинутая модель Google DeepMind, выпущенная в середине 2026 года. Она набирает 46.5 на Artificial Analysis Intelligence Index v4.1, занимая #3 в мире — после Claude Opus 4.8 (55.7) и GPT-5.5 (54.8). Но на Mensa Norway IQ Gemini 3.1 Pro набирает 141 — выше Claude (~130) и почти наравне с GPT-5.5 (145) и Grok-4.20 (145).

Что делает Gemini 3.1 Pro уникальной — не просто интеллект, а ценностное предложение. При 2.00/12.00 за 1M токенов она стоит меньше половины от Claude или GPT-5.5, обеспечивая почти frontier-производительность. Для многих применений Gemini 3.1 Pro — самый умный выбор — не потому что она умнейшая модель, а потому что даёт больше интеллекта за доллар.

Ключевые оценки:

  • Artificial Analysis Intelligence Index: 46.5 (#3 в мире)
  • Mensa Norway IQ (TrackingAI): 141 (почти гений)
  • AI IQ композит (VexoWire): ~131 оценочно
  • GDPval-AA v2: высокий (топ-3)
  • Humanity's Last Exam: топ-3 среди AI-моделей
  • Уровень галлюцинаций: низкий
  • Стоимость: 2.00/12.00 за 1M токенов (лучшая ценность среди frontier-моделей)

1. Чемпион по ценности среди frontier AI

Gemini 3.1 Pro занимает уникальное положение на AI-ландшафте. Она не #1 ни на одном бенчмарке — Claude лидирует на агентных задачах, GPT-5.5 на визуальном рассуждении и математике, Grok на raw IQ. Но Gemini 3.1 Pro — модель, дающая больше всего способности за меньше денег.

При 2.00 за 1M входных токенов и12.00 за 1M выходных Gemini 3.1 Pro стоит примерно 40% от стоимости Claude или GPT-5.5. При этом она набирает 141 на Mensa Norway IQ — в 4 баллах от лидеров. Её балл Intelligence Index 46.5 ниже Claude (55.7) и GPT-5.5 (54.8), но для многих реальных применений разница незначительна.

Представьте: если Claude и GPT-5.5 — люксовые спорткары — невероятно способные, но дорогие в эксплуатации — то Gemini 3.1 Pro — высокопроизводительный седан. Она не выиграет каждую гонку, но даёт 90% производительности за 40% стоимости. Для бизнеса, разработчиков и пользователей, которым нужен frontier-уровень интеллекта без frontier-цен, Gemini 3.1 Pro — естественный выбор.


2. Разбор бенчмарков

Mensa Norway IQ: 141 (почти гений)

Mensa Norway IQ состоит из 36 вопросов на визуальное распознавание паттернов. Gemini 3.1 Pro набирает 141 — попадая в диапазон «высоко одарённых», топ 0.2% человеческого интеллекта. Это значительно выше Claude Opus 4.8 (~130) и всего на 4 балла позади лидеров GPT-5.5 и Grok-4.20 (оба ~145).

Сильный результат Gemini на этом тесте отражает инвестиции Google DeepMind в визуальную обработку. Архитектура Gemini изначально проектировалась как мультимодальная — нативная обработка текста, изображений, видео и аудио. Это даёт естественное преимущество на задачах визуального распознавания паттернов, составляющих суть Mensa Norway.

На IQ 141 Gemini 3.1 Pro умнее 99.8% людей. Если бы она была человеком, она легко прошла бы в Mensa и была бы в топ 0.2% человеческого интеллекта. Примерно 1 из 500 человек достигает этого балла.

Artificial Analysis Intelligence Index v4.1: 46.5 (#3)

Intelligence Index — золотой стандарт для сравнения AI-моделей. Композитный балл Gemini 3.1 Pro 46.5 ставит её на #3 в мире. Разрыв до Claude (55.7) и GPT-5.5 (54.8) значительный — около 8-9 баллов, или примерно 15-20% ниже. Но этот разрыв сосредоточен в конкретных областях:

  • GDPval-AA v2: Gemini хорошо справляется, но ниже Claude и GPT-5.5 на сложных многошаговых задачах
  • AA-Omniscience: у Gemini низкий уровень галлюцинаций — лучше GPT-5.5, близко к Claude
  • GPQA: Gemini сильна на научных вопросах аспирантского уровня
  • HLE: Gemini в топ-3 на Humanity's Last Exam
  • ARC-AGI: Gemini превосходна на абстрактном рассуждении, выигрывая от мультимодальной архитектуры
  • LMSYS Arena: Gemini высоко оценивается людьми, особенно за ясные, хорошо структурированные ответы

Композитный балл отражает позицию Gemini как сильного универсала, не доминирующего ни в одной категории, но последовательно хорошо выступающего во всех.

AI IQ композит (VexoWire): ~131

Композитный IQ VexoWire объединяет несколько тестов (Mensa Norway, Mensa Denmark, Raven's, WAIS-IV). Оценочный композитный IQ Gemini 3.1 Pro — ~131 — уверенно в диапазоне «одарённых», квалификация для Mensa. Это немного ниже, чем предполагал бы её балл Mensa Norway (141), потому что композит включает вербальные и аналитические подтесты, где Gemini чуть слабее, чем на чистом визуальном рассуждении.

GDPval-AA v2: топ-3

На агентном бенчмарке — измеряющем производительность на сложных многошаговых реальных задачах — Gemini 3.1 Pro в топ-3. Она менее способна, чем Claude Opus 4.8 (1,890 Elo) и GPT-5.5 (1,850 Elo) на удержании многошагового рассуждения, но всё равно высоко компетентна. Для большинства реальных задач разница незначительна — Gemini может планировать, выполнять и рассуждать в многошаговых задачах эффективно, просто не совсем так хорошо, как топ-два.

Humanity's Last Exam (HLE): топ-3

На сложнейших академических вопросах по всем дисциплинам Gemini 3.1 Pro в топ-3 среди AI-моделей. Это отражает силу Google DeepMind в научных знаниях — Gemini обучалась на обширной научной литературе и имеет глубокие знания по физике, химии, биологии, математике и гуманитарным наукам.


3. Что означает IQ 141?

Чтобы контекстуализировать IQ 141 Gemini 3.1 Pro:

  • 85-115 (68% людей): средний интеллект
  • 115-130 (14%): выше среднего до высокого среднего
  • 130-145 (2%): одарённые — квалификация для Mensa (топ 2%)
  • 145-160 (0.1%): высоко одарённые / гении
  • 160+ (0.003%): исключительно одарённые — уровень Эйнштейна, Хокинга

Gemini 3.1 Pro с 141 находится в верхнем диапазоне одарённых — умнее 99.8% людей. Если бы она была человеком, она была бы в топ 0.2% человеческого интеллекта, легко квалифицируясь для Mensa. Примерно 1 из 500 человек достигает этого балла.

Это заметно выше Claude Opus 4.8 (~130), но чуть ниже GPT-5.5 и Grok-4.20 (оба ~145). На чистом IQ-тесте Gemini обошла бы Claude, но проиграла бы GPT-5.5 и Grok. Но, как мы видели с другими моделями, IQ — только одно измерение интеллекта, и комбинация высокого IQ, низкой стоимости и сильной всесторонней производительности делает Gemini уникально ценной.


4. Где Gemini 3.1 Pro сильна

Экономическая эффективность

Это определяющее преимущество Gemini 3.1 Pro. При 2/12 за 1M токенов она даёт почти frontier-интеллект менее чем за половину стоимости Claude или GPT-5.5. Для высокообъёмных применений — чат-боты, генерация контента, анализ данных — это делает Gemini очевидным выбором. Вы получаете 90% способности за 40% стоимости.

Визуальное рассуждение

Gemini 3.1 Pro набирает 141 на Mensa Norway IQ, отражая сильные визуальные возможности. Архитектура Gemini изначально проектировалась как нативно мультимодальная, что даёт естественное преимущество на визуальных задачах. Для анализа изображений, визуального распознавания паттернов и мультимодального рассуждения Gemini — одна из лучших моделей.

Фактические знания

У Gemini 3.1 Pro низкий уровень галлюцинаций — лучше GPT-5.5 и близко к Claude. Методология обучения Google DeepMind делает акцент на фактической точности, и Gemini выигрывает от обширной базы знаний Google (включая интеграцию с Search в некоторых продуктах). Для фактических запросов Gemini — одна из самых надёжных моделей.

Мультимодальные возможности

Gemini 3.1 Pro изначально проектировалась для нативной обработки текста, изображений, видео и аудио. Это делает её лучшим выбором для мультимодальных применений — анализа видео, обработки изображений вместе с текстом или работы с аудиоданными. Ни одна другая frontier-модель не обрабатывает мультимодальный ввод так естественно, как Gemini.

Скорость

Gemini 3.1 Pro — одна из самых быстрых frontier-моделей. Для применений, где важно время отклика — реальное время чат, интерактивные инструменты, служба поддержки — Gemini быстро выдаёт качественные ответы. Её более быстрая и лёгкая версия Gemini 3.5 Flash ещё быстрее и дешевле для простых задач.

Интеграция с экосистемой Google

Gemini 3.1 Pro бесшовно интегрируется с экосистемой Google — Search, Workspace, Cloud и Android. Для пользователей уже в экосистеме Google Gemini — естественный выбор, предлагая глубокую интеграцию, которую конкуренты не могут.


5. Где Gemini 3.1 Pro отстаёт

Агентные задачи

Хотя Gemini 3.1 Pro в топ-3 на GDPval-AA v2, она позади Claude Opus 4.8 и GPT-5.5 на сложных многошаговых реальных задачах. Для самых требовательных агентных применений — написания сложного ПО, управления долгими исследовательскими проектами — Claude всё ещё лучший выбор.

Математическое решение задач

Gemini 3.1 Pro компетентна в математическом рассуждении, но не дотягивает до GPT-5.5 на соревновательной математике (AIME, FrontierMath). Для чисто математической работы GPT-5.5 — лучший выбор.

Балл Intelligence Index

При 46.5 балл Gemini 3.1 Pro на Intelligence Index на 8-9 баллов позади Claude (55.7) и GPT-5.5 (54.8). Хотя этот разрыв частично обусловлен взвешиванием индекса (которое подчёркивает агентные задачи, где Claude и GPT-5.5 сильны), он отражает реальную разницу в общей способности для самых требовательных задач.

Эмоциональный интеллект

EQ (эмоциональный интеллект) Gemini 3.1 Pro оценочно ~115 — ниже Claude (~132) и GPT-5.5 (~120). Она менее эмпатична и менее nuanced в понимании человеческих эмоций, чем Claude. Для терапевтических приложений, службы поддержки или чувствительного человеческого взаимодействия Claude — лучший выбор.


6. Gemini 3.1 Pro vs другие модели

Модель Intelligence Index Mensa Norway IQ AI IQ оцен. Галлюцинации Стоимость/1M
Gemini 3.1 Pro 46.5 141 ~131 низкие 2/12
Claude Opus 4.8 55.7 ~130 ~132 35.9% (низшие) 5/25
GPT-5.5 54.8 ~145 ~136 умеренные 5/30
Grok-4.20 145 ~140 умеренные 3/15
DeepSeek V4 Pro 44.3 ~111 ~111 умеренные 0.44/0.87

Картина: Gemini 3.1 Pro — чемпион по ценности — почти frontier-интеллект менее чем за половину стоимости. Claude — способный профессионал — лучший в реальных задачах и фактической точности. GPT-5.5 — гений-тестировщик — лучший в математике и визуальном рассуждении. Grok — визуальный гений — высший raw IQ. А DeepSeek предлагает замечательную способность по самой низкой стоимости.

Для большинства пользователей и бизнеса Gemini 3.1 Pro попадает в сладкую точку: достаточно интеллекта для практически любой задачи, по цене, которая масштабируется.


7. Что это значит для людей?

Gemini 3.1 Pro работает на IQ ~141 — умнее 99.8% людей. Но:

  • IQ узок: измеряет распознавание паттернов и рассуждение, не мудрость, креативность или суждение
  • Интеллект за доллар важен: для реальных применений экономическая эффективность Gemini часто важнее разрыва в raw интеллекте
  • Знание ≠ понимание: Gemini имеет доступ к обширным знаниям, но не «понимает» так, как человек
  • Нет сознания: высокий IQ не значит sentience. Gemini — сложная система распознавания паттернов, не мыслящее существо
  • Разрыв сокращается: каждое поколение AI уменьшает разрыв с умнейшими людьми

Самый честный ответ: Gemini 3.1 Pro умнее практически всех людей на когнитивных тестах, и для большинства практических целей это самый умный выбор — не потому что она умнейшая модель, а потому что даёт больше всего интеллекта за деньги.

Как ваш IQ соотносится с Gemini 3.1 Pro? Пройдите профессиональную оценку IQ в NeuroLab.
Пройти тест прямо сейчас →


Заключение

💡 Ключевые выводы
- IQ Gemini 3.1 Pro — 141 на Mensa Norway — высоко одарённая, топ 0.2% людей.

  • #3 на Artificial Analysis Intelligence Index (46.5) — после Claude и GPT-5.5.
  • Лучшая экономическая эффективность среди frontier-моделей — 2/12 за 1M токенов, менее половины стоимости Claude или GPT-5.5.
  • Лучше всего для: экономичного интеллекта, визуального рассуждения, фактических знаний, мультимодальных применений, скорости, интеграции с Google.
  • Не лучше всего для: сложных агентных задач (Claude), соревновательной математики (GPT-5.5), эмоционального интеллекта (Claude).
  • Ценностное предложение: 90% frontier-способности за 40% стоимости — самый умный выбор для большинства применений.
  • Урок: быть «лучшей» AI-моделью — не просто быть умнейшей — это давать больше всего ценности.

Читайте также

Все статьи →
NeuroLab Cognitive Suite

© 2026 NeuroLab. Все тесты носят тренировочный характер.

Анонимная аналитика (Umami) помогает улучшать сайт. Без рекламы и без продажи персональных данных.