Какой IQ у Kimi K3?
Dr. Daria Dudnik 10 мин чтения 0 просмотров

Какой IQ у Kimi K3?

Kimi K3 набирает 118 на тесте Mensa Norway IQ и входит в топ-10 на Intelligence Index. Разбираем каждый бенчмарк и объясняем, что делает модель Moonshot AI уникальной.

Kimi K3: восходящая звезда Moonshot AI

Kimi K3 — флагманская модель от Moonshot AI, одного из самых инновационных китайских AI-стартапов. Выпущенная в начале 2026 года, Kimi K3 набирает 118 на тесте Mensa Norway IQ и входит в топ-10 на Artificial Analysis Intelligence Index v4.1. Это ставит её выше DeepSeek V4 Pro (111), но ниже frontier-моделей (Claude ~130, Gemini 141, GPT-5.5 ~145, Grok-4.20 145).

Что делает Kimi K3 уникальной — её экстраординарное контекстное окно. В то время как большинство AI-моделей обрабатывают 32K-200K токенов за раз, Kimi K3 может обработать до 2 миллионов токенов в едином контексте — примерно 1,500 страниц текста, или около 5-10 полных книг. Это делает её бесспорным чемпионом задач с длинным контекстом: анализ целых кодовых баз, обработка длинных юридических документов, суммаризация серий книг и понимание сложных междокументных отношений.

Kimi K3 — специалист по длинному контексту: модель, которая может не дотягивать до frontier по raw IQ, но может обрабатывать и рассуждать над объёмами информации, которые другие модели просто не могут осилить. Для приложений, требующих понимания огромных объёмов текста за один проход, Kimi K3 в своей лиге.

Ключевые оценки:

  • Artificial Analysis Intelligence Index: топ-10 (оценочно ~45-47)
  • Mensa Norway IQ (TrackingAI): 118 (выше среднего, приближается к одарённому)
  • AI IQ композит (VexoWire): ~118 оценочно
  • GDPval-AA v2: топ-10
  • Humanity's Last Exam: топ-10
  • Уровень галлюцинаций: низко-умеренный
  • Стоимость: 0.55/2.19 за 1M токенов (очень доступно)
  • Контекстное окно: 2 миллиона токенов (наибольшее среди всех крупных моделей)

1. Революция длинного контекста

Kimi K3 представляет другой подход к AI-способности. В то время как большинство лабораторий фокусируются на том, чтобы сделать модели умнее (выше IQ, лучше рассуждение), Moonshot AI сосредоточилась на том, чтобы модели могли обрабатывать больше информации за раз. Результат — модель с контекстным окном 2 миллиона токенов, в 10-60 раз больше, чем у большинства конкурентов.

Для контекста:

  • GPT-5.5: ~200K токенов контекста
  • Claude Opus 4.8: ~200K токенов контекста
  • Gemini 3.1 Pro: ~1M токенов контекста
  • Kimi K3: 2M токенов контекста

С 2M токенов Kimi K3 может обработать:

  • Целую кодовую базу (50,000+ строк кода)
  • 5-10 полных романов в одном промпте
  • Полный файл юридического дела со всеми уликами и прецедентами
  • Целую коллекцию исследовательских статей по теме
  • Часы расшифрованных записей совещаний

Это не просто про чтение большего — это про понимание отношений между документами. Kimi K3 может выявить связи между страницей 1 и страницей 1,500 документа, которые другие модели потеряли бы. Для задач, требующих целостного понимания больших информационных наборов, это меняет правила игры.


2. Разбор бенчмарков

Mensa Norway IQ: 118 (выше среднего)

Mensa Norway IQ состоит из 36 вопросов на визуальное распознавание паттернов. Kimi K3 набирает 118 — выше человеческого среднего (100) и приближаясь к порогу «одарённый» (130). Это выше DeepSeek V4 Pro (111), но ниже frontier-моделей (Claude ~130, Gemini 141, GPT-5.5 ~145, Grok-4.20 145).

IQ 118 означает, что Kimi K3 умнее примерно 85% людей. Если бы она была человеком, она была бы сравнима с сильным выпускником университета — умной и способной, хотя и не на гениальном уровне frontier-моделей. Для большинства практических рассужденческих задач этого уровня интеллекта более чем достаточно.

Artificial Analysis Intelligence Index: топ-10

На Intelligence Index Kimi K3 входит в топ-10 в мире с оценочным баллом ~45-47. Это ставит её конкурентно с Gemini 3.1 Pro (46.5) и DeepSeek V4 Pro (44.3), но позади Claude (55.7) и GPT-5.5 (54.8).

Разбор компонентов индекса:

  • GDPval-AA v2: Kimi K3 хорошо выступает, выигрывая от длинного контекста для многошаговых задач
  • AA-Omniscience: у Kimi K3 низко-умеренный уровень галлюцинаций, выигрывая от способности перекрёстно ссылаться информацию в контексте
  • GPQA: Kimi K3 адекватно справляется с научными вопросами уровня магистратуры
  • HLE: Kimi K3 в топ-10 на Humanity's Last Exam
  • ARC-AGI: Kimi K3 разумно выступает на абстрактном рассуждении
  • LMSYS Arena: Kimi K3 получает сильные баллы человеческого предпочтения, особенно по задачам с длинными документами

AI IQ композит (VexoWire): ~118

Композитный IQ VexoWire объединяет несколько тестов (Mensa Norway, Mensa Denmark, Raven's, WAIS-IV). Оценочный композитный IQ Kimi K3 ~118 — соответствует её баллу Mensa Norway. Это помещает её в диапазон «выше среднего», приближаясь, но не достигая уровня «одарённый».

GDPval-AA v2: топ-10

На агентном бенчмарке Kimi K3 в топ-10. Её длинное контекстное окно даёт уникальное преимущество на агентных задачах, включающих обработку больших объёмов информации — она может удерживать целые контексты проектов в памяти, что делает её лучше на многошаговых задачах, требующих удержания контекста. Однако на чистой сложности рассуждения она всё ещё отстаёт от Claude и GPT-5.5.

Humanity's Last Exam (HLE): топ-10

На сложнейших академических вопросах Kimi K3 в топ-10 среди AI-моделей. Её способность обрабатывать большие объёмы справочного материала в контексте даёт преимущество на вопросах, требующих синтеза информации из нескольких источников.


3. Что означает IQ 118?

Чтобы контекстуализировать IQ 118 Kimi K3:

  • 85-115 (68% людей): средний интеллект
  • 115-130 (14%): выше среднего до высокого среднего
  • 130-145 (2%): одарённые — квалификация для Mensa (топ 2%)
  • 145-160 (0.1%): высоко одарённые / гении

Kimi K3 с 118 находится в диапазоне «выше среднего» — умнее примерно 85% людей. Если бы она была человеком, она была бы сравнима с сильным выпускником университета или способным профессионалом. Не гением, но определённо умной и компетентной.

Это выше DeepSeek V4 Pro (111), но ниже frontier-моделей:

  • Claude Opus 4.8: ~130 (одарённый)
  • Gemini 3.1 Pro: 141 (высоко одарённый)
  • GPT-5.5: ~145 (гений)
  • Grok-4.20: 145 (гений)

Разрыв до frontier-моделей составляет около 12-27 IQ-баллов. Но Kimi K3 компенсирует более низкий raw IQ экстраординарным контекстным окном — для задач, требующих обработки больших объёмов информации, преимущество длинного контекста Kimi K3 может перевесить разрыв в IQ.


4. Где Kimi K3 сильна

Обработка длинного контекста

Это определяющая черта Kimi K3. С контекстным окном 2 миллиона токенов она может обрабатывать и рассуждать над объёмами текста, которые не может осилить ни одна другая крупная модель. Для анализа целых кодовых баз, обработки длинных юридических документов, суммаризации коллекций книг или понимания сложных междокументных отношений Kimi K3 — лучшая доступная модель.

Анализ кода

Kimi K3 особенно сильна в задачах анализа кода. Её длинный контекст позволяет понимать целые программные проекты — не только отдельные файлы — делая её отличной для ревью кода, предложений рефакторинга и архитектурного анализа. Для разработчиков, работающих с большими кодовыми базами, Kimi K3 предлагает возможности, которые другие модели просто не могут дать.

Суммаризация документов

Для суммаризации длинных документов — юридических дел, исследовательских статей, технических спецификаций, финансовых отчётов — Kimi K3 превосходна. Её способность обработать весь документ сразу означает, что её суммаризации улавливают нюансы и связи, которые чанкованная обработка может упустить.

Экономическая эффективность

При 0.55/2.19 за 1M токенов Kimi K3 очень доступна — дороже DeepSeek V4 Pro (0.44/0.87), но значительно дешевле Claude (5/25), GPT-5.5 (5/30) и Gemini (2/12). Для задач с длинным контекстом ценностное предложение исключительное: вы получаете контекст 2M токенов за малую долю стоимости frontier-моделей.

Китайскоязычные задачи

Как модель, разработанная в Китае, Kimi K3 имеет отличные возможности на китайском языке. Для китайскоязычных приложений — генерация контента, анализ, перевод — Kimi K3 среди лучших доступных моделей, иногда превосходя западные.

Помощь в исследованиях

Для исследователей, которым нужно обрабатывать большие объёмы литературы, Kimi K3 — бесценный инструмент. Она может поглотить десятки статей сразу и выявить связи, противоречия и пробелы между ними — задача, которая заняла бы у человека-исследователя дни или недели.


5. Где Kimi K3 отстаёт

Raw IQ и сложное рассуждение

С IQ 118 Kimi K3 ниже frontier-моделей на задачах сложного рассуждения. Для самых трудных проблем — соревновательная математика, продвинутые логические головоломки, передовое научное рассуждение — Claude, GPT-5.5 и Gemini существенно лучше. Если ваша задача требует гениального рассуждения на коротких вводах, frontier-модели — лучший выбор.

Сложность агентных задач

Хотя длинный контекст Kimi K3 помогает с агентными задачами, она всё ещё отстаёт от Claude и GPT-5.5 по чистой сложности задач. Для самых требовательных агентных применений — написание сложного ПО с нуля, управление intricate исследовательскими процессами — Claude остаётся более способной.

Эмоциональный интеллект

EQ (эмоциональный интеллект) Kimi K3 оценочно ~108 — ниже Claude (~132), GPT-5.5 (~120) и Gemini (~115), но сравним с Grok (~110). Её ответы склонны быть более функциональными и менее эмоционально nuanced. Для терапевтических приложений, службы поддержки или чувствительного человеческого взаимодействия Claude — лучший выбор.

Глобальная доступность

Kimi K3 в первую очередь доступна через API Moonshot AI и избранных партнёров. У неё меньше глобального распространения, чем у Claude, GPT-5.5 или Gemini, что может влиять на доступность в определённых регионах. Однако она всё чаще доступна через сторонние платформы.

Узнаваемость бренда

Как относительно новая модель от китайского стартапа, Kimi K3 имеет меньше узнаваемости бренда и доверия, чем модели от OpenAI, Anthropic или Google. Для организаций, приоритизирующих работу с устоявшимися западными провайдерами, это может быть соображением.


6. Kimi K3 vs другие модели

Модель Intelligence Index Mensa Norway IQ AI IQ оцен. Контекст Стоимость/1M Лучше для
Kimi K3 ~45-47 (топ-10) 118 ~118 2M 0.55/2.19 Длинный контекст
Claude Opus 4.8 55.7 ~130 ~132 200K 5/25 Реальные задачи
GPT-5.5 54.8 ~145 ~136 200K 5/30 Математика и рассуждение
Gemini 3.1 Pro 46.5 141 ~131 1M 2/12 Ценность и мультимодал
Grok-4.20 топ-5 145 ~140 200K 3/15 Raw IQ и личность
DeepSeek V4 Pro 44.3 ~111 ~111 128K 0.44/0.87 Бюджет и open-source

Картина: Kimi K3 — чемпион по длинному контексту — не самая умная, но способная обработать больше информации за раз, чем любая другая модель. Claude — способный профессионал — лучший в реальных задачах и фактической точности. GPT-5.5 — гений-тестировщик — лучший в математике и визуальном рассуждении. Gemini — чемпион по ценности — лучшая экономическая эффективность среди frontier-моделей. Grok-4.20 — чемпион по raw IQ — высший IQ с личностью. А DeepSeek — бюджетный чемпион — самый дешёвый с open-source весами.

Для пользователей, которым нужно обрабатывать огромные объёмы текста за один проход, Kimi K3 — очевидный выбор — её контекстное окно 2M в своей лиге.


7. Что это значит для людей?

Kimi K3 работает на IQ ~118 — умнее примерно 85% людей. Но:

  • IQ — не всё: IQ 118 выше среднего и достаточно для большинства практических задач
  • Контекст важнее IQ для многих задач: для задач с большими документами контекстное окно Kimi K3 2M ценнее, чем более высокий IQ
  • Длинный контекст открывает новые приложения: Kimi K3 открывает возможности, которые другие модели не могут — анализ целых кодовых баз, обработка документов размером с книгу, синтез исследований по десяткам статей
  • Знание ≠ понимание: как все AI-модели, Kimi K3 имеет доступ к обширным знаниям, но не «понимает» так, как человек
  • Нет сознания: высокий IQ не значит sentience. Kimi K3 — сложная система распознавания паттернов, не мыслящее существо
  • Специализация vs генерализация: Kimi K3 доказывает, что AI может конкурировать, будучи лучшим в конкретной способности (длинный контекст), а не пытаясь быть лучшим во всём

Самый честный ответ: Kimi K3 умнее 85% людей на когнитивных тестах, и для задач, требующих обработки больших объёмов информации, это самый умный выбор — не потому что она самая интеллектуальная, а потому что может удержать больше в своём «уме» за раз.

Как ваш IQ соотносится с Kimi K3? Пройдите профессиональную оценку IQ в NeuroLab.
Пройти тест прямо сейчас →


Заключение

💡 Ключевые выводы
- IQ Kimi K3 — 118 на Mensa Norway — выше среднего, умнее ~85% людей.

  • Топ-10 на Intelligence Index — конкурентно с Gemini и DeepSeek, позади Claude и GPT-5.5.
  • Контекстное окно 2 миллиона токенов — наибольшее среди всех крупных моделей, в 10-60 раз больше большинства конкурентов.
  • Лучше всего для: задач с длинным контекстом, анализа кода, суммаризации документов, помощи в исследованиях, китайскоязычных приложений.
  • Не лучше всего для: raw IQ (frontier-модели выигрывают), сложных агентных задач (Claude выигрывает), эмоционального интеллекта (Claude выигрывает).
  • Урок: интеллект — не только быть самым умным — но и способность обработать больше всего информации. Kimi K3 доказывает, что контекст — форма интеллекта.

Читайте также

Все статьи →