Какой IQ у GPT-5.5?
Dr. Daria Dudnik 7 мин чтения 0 просмотров

Какой IQ у GPT-5.5?

GPT-5.5 набирает 54.8 балла на Artificial Analysis Intelligence Index и оценочный IQ 136 по шкале AI IQ. Разбираем все бенчмарки и их значение.

GPT-5.5: фронтальная модель OpenAI

GPT-5.5 — самая продвинутая модель OpenAI, выпущенная в 2026 году. Она набирает 54.8 на Artificial Analysis Intelligence Index v4.1 — второе место после Claude Opus 4.8 (55.7), отставая менее чем на один балл.

По композитной шкале AI IQ, GPT-5.5 имеет оценочный IQ ~136 — самый высокий среди всех моделей, отслеживаемых проектом AI IQ.

Ключевые оценки
- Artificial Analysis Intelligence Index: 54.8 (#2 в мире)

  • AI IQ композит (VexoWire): ~136 (#1 в мире)
  • Mensa Norway IQ (TrackingAI): GPT-5.4 Pro (Vision) = 145
  • GDPval-AA v2: 1,531 Elo (#2 в мире)
  • Стоимость задачи: 0.99 (vs.1.78 у Claude Opus 4.8)

1. Разбор бенчмарков

Artificial Analysis Intelligence Index v4.1

GPT-5.5 набирает 54.8 — всего 0.9 балла позади Claude Opus 4.8:

  • GDPval-AA v2 (20%): 1,531 Elo — #2
  • Terminal-Bench 2.1 (16%): сильный
  • τ³-Bench Banking (14%): сильный
  • Humanity's Last Exam (12%): близко к #1
  • GPQA (6%), SciCode (8%), AA-Omniscience (8%)

AI IQ композит

Проект AI IQ помещает GPT-5.5 на пик колоколообразной кривой с оценочным IQ ~136 — самый высокий среди всех моделей. За ним следуют GPT-5.4 (~131) и Claude Opus 4.7 (~132).

Тест Mensa Norway

GPT-5.4 Pro (Vision) набрал 145 на тесте TrackingAI Mensa Norway — разделил #1 с Grok-4.20 Expert Mode. Ожидается, что GPT-5.5 соответствует или превосходит это.

Тест iqscore.io

ChatGPT (бесплатная версия) набрал 121. GPT-5.5 с полными возможностями рассуждения покажет значительно выше.

💡 Самый узкий разрыв
Разрыв в 0.9 балла между GPT-5.5 и Claude Opus 4.8 на Intelligence Index — самый узкий в истории AI. По шкале AI IQ GPT-5.5 фактически лидирует с ~136 против ~132 у Claude. «Лучшая» модель зависит от того, какому бенчмарку вы доверяете.


2. Где GPT-5.5 силён

Абстрактное мышление

GPT-5.5 лидирует на ARC-AGI-1 и ARC-AGI-2 — сложнейших тестах на распознавание паттернов, проверяющих флюидный интеллект.

Математическое мышление

Сильные результаты на FrontierMath (Tiers 1-4), AIME и ProofBench — математическое измерение AI IQ.

Экономическая эффективность

0.99 за задачу — почти вдвое дешевле Claude Opus 4.8 (1.78) при отставании в один балл. Также использует на ~30% меньше ходов.

Скорость

GPT-5.5 выполняет задачу за ~3.7 минуты — почти вдвое быстрее Claude Opus 4.8 (6.4 минуты).


3. Где отстаёт

Уровень галлюцинаций

У GPT-5.5 выше уровень галлюцинаций, чем у Claude Opus 4.8. На AA-Omniscience ниже точность и выше уровень галлюцинаций.

Агентная производительность

На GDPval-AA v2: 1,531 Elo против 1,890 у Claude Opus 4.8 — ~67% win rate у Claude при прямом сравнении.

Эмоциональный интеллект

По шкале EQ GPT-5.5 немного отстаёт от Claude Opus 4.8 (~132 EQ). Это важно для качества диалога.


4. GPT-5.5 vs другие модели

Модель Intelligence Index Оценочный IQ Стоимость/задача Скорость/задача
GPT-5.5 54.8 ~136 $0.99 3.7 мин
Claude Opus 4.8 55.7 ~132-145 $1.78 6.4 мин
Gemini 3.1 Pro 46.5 ~131
Grok-4.20 145
DeepSeek V4 Pro 44.3 ~111 $0.04

💡 Ценовое предложение
GPT-5.5 предлагает лучшее соотношение интеллекта к стоимости среди фронтальных моделей. При $0.99 за задачу и 3.7 минуты — почти топовая производительность за половину стоимости и в два раза быстрее Claude Opus 4.8.


5. Что это значит для людей?

GPT-5.5 работает на оценочном IQ 136 — выше, чем у 99% людей. Но:

  • IQ 136 = топ 1%: уровень Mensa, но не «гений» (145+)
  • AI IQ предметно-специфичен: силён в математике и абстракции, слабее в пространственном
  • Скорость ≠ глубина: быстрые ответы не всегда правильные
  • Смещение обучающих данных: бенчмарки могут пересекаться с данными обучения

Как ваш IQ соотносится с GPT-5.5? Пройдите профессиональную оценку IQ в NeuroLab.
Пройти тест прямо сейчас →


Заключение

💡 Ключевые выводы
- Оценочный IQ GPT-5.5: ~136 — высший по композитной шкале AI IQ.

  • 54.8 на Intelligence Index — #2, всего 0.9 позади Claude Opus 4.8.
  • Лучшее соотношение интеллект/цена: 0.99/задача vs.1.78 у Claude.
  • Самая быстрая фронтальная модель: 3.7 мин/задача vs. 6.4 мин у Claude.
  • Лидер по абстрактному и математическому мышлению (ARC-AGI, FrontierMath).
  • Выше уровень галлюцинаций, чем у Claude Opus 4.8.
  • GPT-5.4 Pro (Vision) набрал 145 на Mensa Norway — GPT-5.5 вероятно соответствует.

Читайте также

Все статьи →
Тест IQ Векслера: что реально измеряет каждый субтест
10 мин чтения

Тест IQ Векслера: что реально измеряет каждый субтест

WAIS и WISC — самые широко используемые тесты IQ в мире. Мы разбираем каждый субтест, что он на самом деле измеряет и как баллы отражают реальные когнитивные способности.

Снижение когнитивных функций после 50: что реально помогает
10 мин чтения

Снижение когнитивных функций после 50: что реально помогает

Когнитивное снижение не неизбежно. Исследования показывают, что факторы образа жизни — от физической активности и сна до социальной вовлечённости и обучения — могут замедлить, остановить или даже частично обратить возрастные когнитивные изменения. Этот гид отделяет доказательства от маркетинга.

Как меняется IQ во время беременности: данные исследований
8 мин чтения

Как меняется IQ во время беременности: данные исследований

Правда ли, что беременность уменьшает мозг? Мы рассматриваем нейробиологию материнского познания — от «мозга беременной» до стойких структурных изменений — и отделяем факты от мифов.