Какой IQ у GPT-5.5?
GPT-5.5 набирает 54.8 балла на Artificial Analysis Intelligence Index и оценочный IQ 136 по шкале AI IQ. Разбираем все бенчмарки и их значение.
GPT-5.5: фронтальная модель OpenAI
GPT-5.5 — самая продвинутая модель OpenAI, выпущенная в 2026 году. Она набирает 54.8 на Artificial Analysis Intelligence Index v4.1 — второе место после Claude Opus 4.8 (55.7), отставая менее чем на один балл.
По композитной шкале AI IQ, GPT-5.5 имеет оценочный IQ ~136 — самый высокий среди всех моделей, отслеживаемых проектом AI IQ.
- AI IQ композит (VexoWire): ~136 (#1 в мире)
- Mensa Norway IQ (TrackingAI): GPT-5.4 Pro (Vision) = 145
- GDPval-AA v2: 1,531 Elo (#2 в мире)
- Стоимость задачи: 0.99 (vs.1.78 у Claude Opus 4.8)
1. Разбор бенчмарков
Artificial Analysis Intelligence Index v4.1
GPT-5.5 набирает 54.8 — всего 0.9 балла позади Claude Opus 4.8:
- GDPval-AA v2 (20%): 1,531 Elo — #2
- Terminal-Bench 2.1 (16%): сильный
- τ³-Bench Banking (14%): сильный
- Humanity's Last Exam (12%): близко к #1
- GPQA (6%), SciCode (8%), AA-Omniscience (8%)
AI IQ композит
Проект AI IQ помещает GPT-5.5 на пик колоколообразной кривой с оценочным IQ ~136 — самый высокий среди всех моделей. За ним следуют GPT-5.4 (~131) и Claude Opus 4.7 (~132).
Тест Mensa Norway
GPT-5.4 Pro (Vision) набрал 145 на тесте TrackingAI Mensa Norway — разделил #1 с Grok-4.20 Expert Mode. Ожидается, что GPT-5.5 соответствует или превосходит это.
Тест iqscore.io
ChatGPT (бесплатная версия) набрал 121. GPT-5.5 с полными возможностями рассуждения покажет значительно выше.
2. Где GPT-5.5 силён
Абстрактное мышление
GPT-5.5 лидирует на ARC-AGI-1 и ARC-AGI-2 — сложнейших тестах на распознавание паттернов, проверяющих флюидный интеллект.
Математическое мышление
Сильные результаты на FrontierMath (Tiers 1-4), AIME и ProofBench — математическое измерение AI IQ.
Экономическая эффективность
0.99 за задачу — почти вдвое дешевле Claude Opus 4.8 (1.78) при отставании в один балл. Также использует на ~30% меньше ходов.
Скорость
GPT-5.5 выполняет задачу за ~3.7 минуты — почти вдвое быстрее Claude Opus 4.8 (6.4 минуты).
3. Где отстаёт
Уровень галлюцинаций
У GPT-5.5 выше уровень галлюцинаций, чем у Claude Opus 4.8. На AA-Omniscience ниже точность и выше уровень галлюцинаций.
Агентная производительность
На GDPval-AA v2: 1,531 Elo против 1,890 у Claude Opus 4.8 — ~67% win rate у Claude при прямом сравнении.
Эмоциональный интеллект
По шкале EQ GPT-5.5 немного отстаёт от Claude Opus 4.8 (~132 EQ). Это важно для качества диалога.
4. GPT-5.5 vs другие модели
| Модель | Intelligence Index | Оценочный IQ | Стоимость/задача | Скорость/задача |
|---|---|---|---|---|
| GPT-5.5 | 54.8 | ~136 | $0.99 | 3.7 мин |
| Claude Opus 4.8 | 55.7 | ~132-145 | $1.78 | 6.4 мин |
| Gemini 3.1 Pro | 46.5 | ~131 | — | — |
| Grok-4.20 | — | 145 | — | — |
| DeepSeek V4 Pro | 44.3 | ~111 | $0.04 | — |
5. Что это значит для людей?
GPT-5.5 работает на оценочном IQ 136 — выше, чем у 99% людей. Но:
- IQ 136 = топ 1%: уровень Mensa, но не «гений» (145+)
- AI IQ предметно-специфичен: силён в математике и абстракции, слабее в пространственном
- Скорость ≠ глубина: быстрые ответы не всегда правильные
- Смещение обучающих данных: бенчмарки могут пересекаться с данными обучения
Заключение
- 54.8 на Intelligence Index — #2, всего 0.9 позади Claude Opus 4.8.
- Лучшее соотношение интеллект/цена: 0.99/задача vs.1.78 у Claude.
- Самая быстрая фронтальная модель: 3.7 мин/задача vs. 6.4 мин у Claude.
- Лидер по абстрактному и математическому мышлению (ARC-AGI, FrontierMath).
- Выше уровень галлюцинаций, чем у Claude Opus 4.8.
- GPT-5.4 Pro (Vision) набрал 145 на Mensa Norway — GPT-5.5 вероятно соответствует.