Какой IQ у Qwen 3.5?
Dr. Daria Dudnik 10 мин чтения 0 просмотров

Какой IQ у Qwen 3.5?

Qwen 3.5 набирает 115 на тесте Mensa Norway IQ и входит в топ-10 на Intelligence Index. Разбираем каждый бенчмарк и объясняем, что делает модель Alibaba уникальной.

Qwen 3.5: универсальный конкурент от Alibaba

Qwen 3.5 — флагманская модель от DAMO Academy, Alibaba, одной из крупнейших и наиболее финанируемых AI-исследовательских лабораторий Китая. Выпущенная в начале 2026 года, Qwen 3.5 набирает 115 на тесте Mensa Norway IQ и входит в топ-10 на Artificial Analysis Intelligence Index v4.1. Это ставит её выше DeepSeek V4 Pro (111) и конкурентно с Kimi K3 (118), но ниже frontier-моделей (Claude ~130, Gemini 141, GPT-5.5 ~145, Grok-4.20 145).

Что делает Qwen 3.5 уникальной — её универсальность. В отличие от DeepSeek (которая фокусируется на стоимости), Kimi (которая фокусируется на длине контекста) или Grok (которая фокусируется на raw IQ), Qwen 3.5 стремится быть разносторонней моделью, которая преуспевает в широком спектре задач. Она имеет сильную мультиязычную поддержку (27+ языков), отличные мультимодальные возможности (текст, изображения, аудио, видео) и конкурентные цены — делая её швейцарским ножом среди AI-моделей.

Qwen 3.5 — универсал: модель, которая может не быть абсолютно лучшей в чём-то одном, но очень хороша почти во всём. Для организаций, которым нужна одна модель для разнообразных нагрузок — обслуживание клиентов, генерация контента, анализ кода, перевод, визуальное понимание — Qwen 3.5 предлагает привлекательную комбинацию способности, универсальности и ценности.

Ключевые оценки:

  • Artificial Analysis Intelligence Index: топ-10 (оценочно ~45-46)
  • Mensa Norway IQ (TrackingAI): 115 (выше среднего)
  • AI IQ композит (VexoWire): ~115 оценочно
  • GDPval-AA v2: топ-10
  • Humanity's Last Exam: топ-10
  • Уровень галлюцинаций: низко-умеренный
  • Стоимость: 0.50/1.50 за 1M токенов (очень доступно)
  • Мультимодальность: текст, изображения, аудио, видео
  • Языки: 27+ языков поддерживается

1. Преимущество универсальности

Qwen 3.5 отражает ставку Alibaba на то, что будущее AI — не в том, чтобы быть абсолютно умнейшим, а в том, чтобы быть наиболее универсальным. Пока другие лаборатории оптимизируют конкретные параметры — IQ, стоимость, контекст, личность — Alibaba построила модель, конкурентную по всем.

Профиль:

  • IQ: 115 (выше среднего, конкурентно с другими китайскими моделями)
  • Стоимость: 0.50/1.50 за 1M токенов (среди самых дешёвых)
  • Мультимодальность: текст, изображения, аудио, видео (полная мультимодальность)
  • Языки: 27+ языков (лучший в классе мультиязычности)
  • Контекст: 256K токенов (уважительно, хотя не уровня Kimi)
  • Open-source: веса доступны для локального развёртывания

Ни один параметр не является лучшим в классе, но комбинация не имеет аналогов. DeepSeek дешевле, но без мультимодальности. У Kimi больше контекста, но меньше языков. Gemini умнее, но дороже. Claude способнее, но закрытый. Qwen 3.5 проходит по грани — достаточно хорош во всём, чтобы быть той единственной моделью, которая вам нужна.

Эта универсальность делает Qwen 3.5 особенно привлекательной для:

  • Корпоративного развёртывания с разнообразными нагрузками
  • Международных приложений, требующих много языков
  • Мультимодальных приложений, объединяющих текст, изображения и аудио
  • Организаций, чувствительных к стоимости, которым всё ещё нужно качество
  • Самохостингового развёртывания через open-source веса

2. Разбор бенчмарков

Mensa Norway IQ: 115 (выше среднего)

Mensa Norway IQ состоит из 36 вопросов на визуальное распознавание паттернов. Qwen 3.5 набирает 115 — выше человеческого среднего (100), в диапазоне «выше среднего». Это выше DeepSeek V4 Pro (111), немного ниже Kimi K3 (118), и ниже frontier-моделей (Claude ~130, Gemini 141, GPT-5.5 ~145, Grok-4.20 145).

IQ 115 означает, что Qwen 3.5 умнее примерно 84% людей — топ 16% человеческого интеллекта. Если бы она была человеком, она была бы сравнима с сильным студентом университета или способным профессионалом. Не гением, но определённо умной и компетентной.

Artificial Analysis Intelligence Index: топ-10

На Intelligence Index Qwen 3.5 входит в топ-10 в мире с оценочным баллом ~45-46. Это ставит её конкурентно с Gemini 3.1 Pro (46.5), Kimi K3 (~45-47) и DeepSeek V4 Pro (44.3), но позади Claude (55.7) и GPT-5.5 (54.8).

Разбор компонентов индекса:

  • GDPval-AA v2: Qwen 3.5 хорошо выступает, выигрывая от мультимодальных возможностей для разнообразных агентных задач
  • AA-Omniscience: у Qwen 3.5 низко-умеренный уровень галлюцинаций, выигрывая от обширных обучающих данных Alibaba
  • GPQA: Qwen 3.5 адекватно справляется с научными вопросами уровня магистратуры
  • HLE: Qwen 3.5 в топ-10 на Humanity's Last Exam
  • ARC-AGI: Qwen 3.5 разумно выступает на абстрактном рассуждении
  • LMSYS Arena: Qwen 3.5 получает сильные баллы человеческого предпочтения, особенно по мультиязычным и мультимодальным задачам

AI IQ композит (VexoWire): ~115

Композитный IQ VexoWire объединяет несколько тестов (Mensa Norway, Mensa Denmark, Raven's, WAIS-IV). Оценочный композитный IQ Qwen 3.5 ~115 — соответствует её баллу Mensa Norway. Это помещает её на границу между «средним» и «выше среднего», умнее примерно 84% людей.

GDPval-AA v2: топ-10

На агентном бенчмарке Qwen 3.5 в топ-10. Её мультимодальные возможности дают преимущество на агентных задачах, включающих обработку разных типов данных — текста, изображений и аудио. Для умеренных агентных нагрузок Qwen 3.5 компетентна, хотя отстаёт от Claude и GPT-5.5 на самых сложных задачах.

Humanity's Last Exam (HLE): топ-10

На сложнейших академических вопросах Qwen 3.5 в топ-10 среди AI-моделей. Сильные академические обучающие данные Alibaba и широкая база знаний модели помогают ей хорошо выступать по различным дисциплинам.


3. Что означает IQ 115?

Чтобы контекстуализировать IQ 115 Qwen 3.5:

  • 85-115 (68% людей): средний интеллект
  • 115-130 (14%): выше среднего до высокого среднего
  • 130-145 (2%): одарённые — квалификация для Mensa (топ 2%)
  • 145-160 (0.1%): высоко одарённые / гении

Qwen 3.5 с 115 находится прямо на границе между «средним» и «выше среднего» — умнее примерно 84% людей. Если бы она была человеком, она была бы сравнима с сильным студентом университета или способным профессионалом. Не гением, но определённо умной и компетентной.

Это выше DeepSeek V4 Pro (111), но ниже frontier-моделей:

  • Claude Opus 4.8: ~130 (одарённый)
  • Gemini 3.1 Pro: 141 (высоко одарённый)
  • GPT-5.5: ~145 (гений)
  • Grok-4.20: 145 (гений)

Разрыв до frontier-моделей составляет около 15-30 IQ-баллов. Но Qwen 3.5 компенсирует универсальностью — для задач, требующих мультимодального понимания, мультиязычной поддержки или разнообразных нагрузок, разносторонние возможности Qwen 3.5 могут перевесить разрыв в IQ.


4. Где Qwen 3.5 сильна

Мультиязычная поддержка

Qwen 3.5 поддерживает 27+ языков нативно, делая её одной из самых мультиязычных AI-моделей. Это не просто перевод — модель действительно обучена на этих языках, понимая культурный контекст, идиомы и нюансы. Для международных приложений Qwen 3.5 — среди лучших выборов.

Мультимодальные возможности

Qwen 3.5 может обрабатывать текст, изображения, аудио и видео — делая её настоящей мультимодальной моделью. Это позволяет приложениям, которые не могут обработать только текстовые модели: визуальные ответы на вопросы, анализ изображений, транскрипцию аудио, понимание видео и многое другое. Для приложений, объединяющих несколько типов медиа, Qwen 3.5 исключительно способна.

Экономическая эффективность

При 0.50/1.50 за 1M токенов Qwen 3.5 очень доступна — немного дороже DeepSeek V4 Pro (0.44/0.87), но значительно дешевле Claude (5/25), GPT-5.5 (5/30) и Gemini (2/12). С учётом мультимодальных возможностей и мультиязычной поддержки ценностное предложение отличное.

Доступность open-source

Веса Qwen 3.5 доступны для локального развёртывания, делая её одной из немногих мультимодальных open-source моделей. Это значимо — большинство мультимодальных моделей (GPT-5.5, Gemini) закрытые. Для организаций, которым нужны мультимодальные возможности с конфиденциальностью данных, Qwen 3.5 — один из лучших вариантов.

Китайскоязычные задачи

Как модель, разработанная в Китае, Qwen 3.5 имеет отличные возможности на китайском языке. Для китайскоязычных приложений Qwen 3.5 среди лучших доступных моделей, часто превосходя западные на специфичных для Китая задачах.

Корпоративная готовность

Инфраструктура Alibaba и корпоративный опыт делают Qwen 3.5 особенно подходящей для корпоративного развёртывания. Модель доступна через Alibaba Cloud с корпоративными SLA, сертификатами соответствия и поддержкой интеграции. Для бизнеса, ищущего надёжную, универсальную AI-модель, Qwen 3.5 — сильный выбор.


5. Где Qwen 3.5 отстаёт

Raw IQ и сложное рассуждение

С IQ 115 Qwen 3.5 ниже frontier-моделей на задачах сложного рассуждения. Для самых трудных проблем — соревновательная математика, продвинутые логические головоломки, передовое научное рассуждение — Claude, GPT-5.5 и Gemini существенно лучше. Если ваша задача требует гениального рассуждения, frontier-модели — лучший выбор.

Контекстное окно

С контекстным окном 256K токенов Qwen 3.5 адекватна, но не исключительна. Kimi K3 (2M) и Gemini (1M) предлагают значительно большие контекстные окна. Для задач, требующих обработки очень длинных документов за один проход, Kimi K3 или Gemini — лучшие выборы.

Сложность агентных задач

Хотя мультимодальные возможности Qwen 3.5 помогают с разнообразными агентными задачами, она отстаёт от Claude и GPT-5.5 по чистой сложности задач. Для самых требовательных агентных применений — написание сложного ПО с нуля, управление intricate исследовательскими процессами — Claude остаётся более способной.

Эмоциональный интеллект

EQ (эмоциональный интеллект) Qwen 3.5 оценочно ~107 — ниже Claude (~132), GPT-5.5 (~120) и Gemini (~115), но сравним с DeepSeek (~105) и Grok (~110). Её ответы склонны быть более функциональными и менее эмоционально nuanced. Для терапевтических приложений, службы поддержки или чувствительного человеческого взаимодействия Claude — лучший выбор.

Уровень галлюцинаций

Хотя у Qwen 3.5 низко-умеренный уровень галлюцинаций, он не такой низкий, как у Claude (35.9%). Для приложений, где критична фактическая точность — исследования, право, медицина — Claude остаётся более надёжной.


6. Qwen 3.5 vs другие модели

Модель Intelligence Index Mensa Norway IQ AI IQ оцен. Мультимодал Стоимость/1M Языки Open-source
Qwen 3.5 ~45-46 (топ-10) 115 ~115 текст+изобр.+аудио+видео 0.50/1.50 27+ да
Claude Opus 4.8 55.7 ~130 ~132 текст+изобр. 5/25 ~20 нет
GPT-5.5 54.8 ~145 ~136 текст+изобр.+аудио 5/30 ~50 нет
Gemini 3.1 Pro 46.5 141 ~131 текст+изобр.+аудио+видео 2/12 ~40 нет
Grok-4.20 топ-5 145 ~140 текст+изобр. 3/15 ~20 нет
DeepSeek V4 Pro 44.3 ~111 ~111 только текст 0.44/0.87 ~10 да
Kimi K3 ~45-47 (топ-10) 118 ~118 только текст 0.55/2.19 ~10 нет

Картина: Qwen 3.5 — универсал — не лучшая в чём-то одном, но очень хорошая почти во всём. Claude — способный профессионал — лучший в реальных задачах и фактической точности. GPT-5.5 — гений-тестировщик — лучший в математике и визуальном рассуждении. Gemini — чемпион по ценности — лучшая экономическая эффективность среди frontier-моделей. Grok-4.20 — чемпион по raw IQ — высший IQ с личностью. DeepSeek — бюджетный чемпион — самый дешёвый с open-source. А Kimi — чемпион по длинному контексту — наибольшее контекстное окно.

Для организаций, которым нужна универсальность — мультимодальность, мультиязычность, доступность, open-source — Qwen 3.5 — очевидный выбор. Это швейцарский нож среди AI-моделей.


7. Что это значит для людей?

Qwen 3.5 работает на IQ ~115 — умнее примерно 84% людей. Но:

  • IQ — не всё: IQ 115 выше среднего и достаточно для большинства практических задач
  • Универсальность важнее raw IQ для многих приложений: для разнообразных нагрузок разносторонние возможности Qwen 3.5 ценнее, чем более высокий IQ у более узкой модели
  • Мультимодальность — это будущее: способность Qwen 3.5 обрабатывать текст, изображения, аудио и видео открывает приложения, которые не могут обработать только текстовые модели
  • Мультиязычность обеспечивает глобальный охват: с 27+ языками Qwen 3.5 может обслуживать пользователей на их родном языке — возможность, которая важна для глобальных приложений
  • Знание ≠ понимание: как все AI-модели, Qwen 3.5 имеет доступ к обширным знаниям, но не «понимает» так, как человек
  • Нет сознания: высокий IQ не значит sentience. Qwen 3.5 — сложная система распознавания паттернов, не мыслящее существо
  • Open-source расширяет инновации: открытые веса Qwen 3.5 позволяют исследователям и разработчикам строить кастомные решения, fine-tune для конкретных доменов и запускать локально

Самый честный ответ: Qwen 3.5 умнее 84% людей на когнитивных тестах, и для приложений, требующих универсальности — мультимодальность, мультиязычность, доступность — это самый умный выбор — не потому что она самая интеллектуальная, а потому что она самая способная в самом широком диапазоне задач.

Как ваш IQ соотносится с Qwen 3.5? Пройдите профессиональную оценку IQ в NeuroLab.
Пройти тест прямо сейчас →


Заключение

💡 Ключевые выводы
- IQ Qwen 3.5 — 115 на Mensa Norway — выше среднего, умнее ~84% людей.

  • Топ-10 на Intelligence Index — конкурентно с Gemini, Kimi и DeepSeek, позади Claude и GPT-5.5.
  • Полная мультимодальность — текст, изображения, аудио и видео в одной модели.
  • 27+ языков — одна из самых мультиязычных AI-моделей.
  • Open-source — веса доступны для локального развёртывания, обеспечивая конфиденциальность и кастомизацию.
  • Лучше всего для: разнообразных корпоративных нагрузок, международных приложений, мультимодальных задач, организаций, чувствительных к стоимости, самохостингового развёртывания.
  • Не лучше всего для: raw IQ (frontier-модели выигрывают), длинного контекста (Kimi выигрывает), сложных агентных задач (Claude выигрывает), эмоционального интеллекта (Claude выигрывает).
  • Урок: интеллект — не только быть самым умным — но и быть самым универсальным. Qwen 3.5 доказывает, что быть хорошим во всём может быть ценнее, чем быть лучшим в одном.

Читайте также

Все статьи →