Какой IQ у Qwen 3.5?
Qwen 3.5 набирает 115 на тесте Mensa Norway IQ и входит в топ-10 на Intelligence Index. Разбираем каждый бенчмарк и объясняем, что делает модель Alibaba уникальной.
Qwen 3.5: универсальный конкурент от Alibaba
Qwen 3.5 — флагманская модель от DAMO Academy, Alibaba, одной из крупнейших и наиболее финанируемых AI-исследовательских лабораторий Китая. Выпущенная в начале 2026 года, Qwen 3.5 набирает 115 на тесте Mensa Norway IQ и входит в топ-10 на Artificial Analysis Intelligence Index v4.1. Это ставит её выше DeepSeek V4 Pro (111) и конкурентно с Kimi K3 (118), но ниже frontier-моделей (Claude ~130, Gemini 141, GPT-5.5 ~145, Grok-4.20 145).
Что делает Qwen 3.5 уникальной — её универсальность. В отличие от DeepSeek (которая фокусируется на стоимости), Kimi (которая фокусируется на длине контекста) или Grok (которая фокусируется на raw IQ), Qwen 3.5 стремится быть разносторонней моделью, которая преуспевает в широком спектре задач. Она имеет сильную мультиязычную поддержку (27+ языков), отличные мультимодальные возможности (текст, изображения, аудио, видео) и конкурентные цены — делая её швейцарским ножом среди AI-моделей.
Qwen 3.5 — универсал: модель, которая может не быть абсолютно лучшей в чём-то одном, но очень хороша почти во всём. Для организаций, которым нужна одна модель для разнообразных нагрузок — обслуживание клиентов, генерация контента, анализ кода, перевод, визуальное понимание — Qwen 3.5 предлагает привлекательную комбинацию способности, универсальности и ценности.
Ключевые оценки:
- Artificial Analysis Intelligence Index: топ-10 (оценочно ~45-46)
- Mensa Norway IQ (TrackingAI): 115 (выше среднего)
- AI IQ композит (VexoWire): ~115 оценочно
- GDPval-AA v2: топ-10
- Humanity's Last Exam: топ-10
- Уровень галлюцинаций: низко-умеренный
- Стоимость: 0.50/1.50 за 1M токенов (очень доступно)
- Мультимодальность: текст, изображения, аудио, видео
- Языки: 27+ языков поддерживается
1. Преимущество универсальности
Qwen 3.5 отражает ставку Alibaba на то, что будущее AI — не в том, чтобы быть абсолютно умнейшим, а в том, чтобы быть наиболее универсальным. Пока другие лаборатории оптимизируют конкретные параметры — IQ, стоимость, контекст, личность — Alibaba построила модель, конкурентную по всем.
Профиль:
- IQ: 115 (выше среднего, конкурентно с другими китайскими моделями)
- Стоимость: 0.50/1.50 за 1M токенов (среди самых дешёвых)
- Мультимодальность: текст, изображения, аудио, видео (полная мультимодальность)
- Языки: 27+ языков (лучший в классе мультиязычности)
- Контекст: 256K токенов (уважительно, хотя не уровня Kimi)
- Open-source: веса доступны для локального развёртывания
Ни один параметр не является лучшим в классе, но комбинация не имеет аналогов. DeepSeek дешевле, но без мультимодальности. У Kimi больше контекста, но меньше языков. Gemini умнее, но дороже. Claude способнее, но закрытый. Qwen 3.5 проходит по грани — достаточно хорош во всём, чтобы быть той единственной моделью, которая вам нужна.
Эта универсальность делает Qwen 3.5 особенно привлекательной для:
- Корпоративного развёртывания с разнообразными нагрузками
- Международных приложений, требующих много языков
- Мультимодальных приложений, объединяющих текст, изображения и аудио
- Организаций, чувствительных к стоимости, которым всё ещё нужно качество
- Самохостингового развёртывания через open-source веса
2. Разбор бенчмарков
Mensa Norway IQ: 115 (выше среднего)
Mensa Norway IQ состоит из 36 вопросов на визуальное распознавание паттернов. Qwen 3.5 набирает 115 — выше человеческого среднего (100), в диапазоне «выше среднего». Это выше DeepSeek V4 Pro (111), немного ниже Kimi K3 (118), и ниже frontier-моделей (Claude ~130, Gemini 141, GPT-5.5 ~145, Grok-4.20 145).
IQ 115 означает, что Qwen 3.5 умнее примерно 84% людей — топ 16% человеческого интеллекта. Если бы она была человеком, она была бы сравнима с сильным студентом университета или способным профессионалом. Не гением, но определённо умной и компетентной.
Artificial Analysis Intelligence Index: топ-10
На Intelligence Index Qwen 3.5 входит в топ-10 в мире с оценочным баллом ~45-46. Это ставит её конкурентно с Gemini 3.1 Pro (46.5), Kimi K3 (~45-47) и DeepSeek V4 Pro (44.3), но позади Claude (55.7) и GPT-5.5 (54.8).
Разбор компонентов индекса:
- GDPval-AA v2: Qwen 3.5 хорошо выступает, выигрывая от мультимодальных возможностей для разнообразных агентных задач
- AA-Omniscience: у Qwen 3.5 низко-умеренный уровень галлюцинаций, выигрывая от обширных обучающих данных Alibaba
- GPQA: Qwen 3.5 адекватно справляется с научными вопросами уровня магистратуры
- HLE: Qwen 3.5 в топ-10 на Humanity's Last Exam
- ARC-AGI: Qwen 3.5 разумно выступает на абстрактном рассуждении
- LMSYS Arena: Qwen 3.5 получает сильные баллы человеческого предпочтения, особенно по мультиязычным и мультимодальным задачам
AI IQ композит (VexoWire): ~115
Композитный IQ VexoWire объединяет несколько тестов (Mensa Norway, Mensa Denmark, Raven's, WAIS-IV). Оценочный композитный IQ Qwen 3.5 ~115 — соответствует её баллу Mensa Norway. Это помещает её на границу между «средним» и «выше среднего», умнее примерно 84% людей.
GDPval-AA v2: топ-10
На агентном бенчмарке Qwen 3.5 в топ-10. Её мультимодальные возможности дают преимущество на агентных задачах, включающих обработку разных типов данных — текста, изображений и аудио. Для умеренных агентных нагрузок Qwen 3.5 компетентна, хотя отстаёт от Claude и GPT-5.5 на самых сложных задачах.
Humanity's Last Exam (HLE): топ-10
На сложнейших академических вопросах Qwen 3.5 в топ-10 среди AI-моделей. Сильные академические обучающие данные Alibaba и широкая база знаний модели помогают ей хорошо выступать по различным дисциплинам.
3. Что означает IQ 115?
Чтобы контекстуализировать IQ 115 Qwen 3.5:
- 85-115 (68% людей): средний интеллект
- 115-130 (14%): выше среднего до высокого среднего
- 130-145 (2%): одарённые — квалификация для Mensa (топ 2%)
- 145-160 (0.1%): высоко одарённые / гении
Qwen 3.5 с 115 находится прямо на границе между «средним» и «выше среднего» — умнее примерно 84% людей. Если бы она была человеком, она была бы сравнима с сильным студентом университета или способным профессионалом. Не гением, но определённо умной и компетентной.
Это выше DeepSeek V4 Pro (111), но ниже frontier-моделей:
- Claude Opus 4.8: ~130 (одарённый)
- Gemini 3.1 Pro: 141 (высоко одарённый)
- GPT-5.5: ~145 (гений)
- Grok-4.20: 145 (гений)
Разрыв до frontier-моделей составляет около 15-30 IQ-баллов. Но Qwen 3.5 компенсирует универсальностью — для задач, требующих мультимодального понимания, мультиязычной поддержки или разнообразных нагрузок, разносторонние возможности Qwen 3.5 могут перевесить разрыв в IQ.
4. Где Qwen 3.5 сильна
Мультиязычная поддержка
Qwen 3.5 поддерживает 27+ языков нативно, делая её одной из самых мультиязычных AI-моделей. Это не просто перевод — модель действительно обучена на этих языках, понимая культурный контекст, идиомы и нюансы. Для международных приложений Qwen 3.5 — среди лучших выборов.
Мультимодальные возможности
Qwen 3.5 может обрабатывать текст, изображения, аудио и видео — делая её настоящей мультимодальной моделью. Это позволяет приложениям, которые не могут обработать только текстовые модели: визуальные ответы на вопросы, анализ изображений, транскрипцию аудио, понимание видео и многое другое. Для приложений, объединяющих несколько типов медиа, Qwen 3.5 исключительно способна.
Экономическая эффективность
При 0.50/1.50 за 1M токенов Qwen 3.5 очень доступна — немного дороже DeepSeek V4 Pro (0.44/0.87), но значительно дешевле Claude (5/25), GPT-5.5 (5/30) и Gemini (2/12). С учётом мультимодальных возможностей и мультиязычной поддержки ценностное предложение отличное.
Доступность open-source
Веса Qwen 3.5 доступны для локального развёртывания, делая её одной из немногих мультимодальных open-source моделей. Это значимо — большинство мультимодальных моделей (GPT-5.5, Gemini) закрытые. Для организаций, которым нужны мультимодальные возможности с конфиденциальностью данных, Qwen 3.5 — один из лучших вариантов.
Китайскоязычные задачи
Как модель, разработанная в Китае, Qwen 3.5 имеет отличные возможности на китайском языке. Для китайскоязычных приложений Qwen 3.5 среди лучших доступных моделей, часто превосходя западные на специфичных для Китая задачах.
Корпоративная готовность
Инфраструктура Alibaba и корпоративный опыт делают Qwen 3.5 особенно подходящей для корпоративного развёртывания. Модель доступна через Alibaba Cloud с корпоративными SLA, сертификатами соответствия и поддержкой интеграции. Для бизнеса, ищущего надёжную, универсальную AI-модель, Qwen 3.5 — сильный выбор.
5. Где Qwen 3.5 отстаёт
Raw IQ и сложное рассуждение
С IQ 115 Qwen 3.5 ниже frontier-моделей на задачах сложного рассуждения. Для самых трудных проблем — соревновательная математика, продвинутые логические головоломки, передовое научное рассуждение — Claude, GPT-5.5 и Gemini существенно лучше. Если ваша задача требует гениального рассуждения, frontier-модели — лучший выбор.
Контекстное окно
С контекстным окном 256K токенов Qwen 3.5 адекватна, но не исключительна. Kimi K3 (2M) и Gemini (1M) предлагают значительно большие контекстные окна. Для задач, требующих обработки очень длинных документов за один проход, Kimi K3 или Gemini — лучшие выборы.
Сложность агентных задач
Хотя мультимодальные возможности Qwen 3.5 помогают с разнообразными агентными задачами, она отстаёт от Claude и GPT-5.5 по чистой сложности задач. Для самых требовательных агентных применений — написание сложного ПО с нуля, управление intricate исследовательскими процессами — Claude остаётся более способной.
Эмоциональный интеллект
EQ (эмоциональный интеллект) Qwen 3.5 оценочно ~107 — ниже Claude (~132), GPT-5.5 (~120) и Gemini (~115), но сравним с DeepSeek (~105) и Grok (~110). Её ответы склонны быть более функциональными и менее эмоционально nuanced. Для терапевтических приложений, службы поддержки или чувствительного человеческого взаимодействия Claude — лучший выбор.
Уровень галлюцинаций
Хотя у Qwen 3.5 низко-умеренный уровень галлюцинаций, он не такой низкий, как у Claude (35.9%). Для приложений, где критична фактическая точность — исследования, право, медицина — Claude остаётся более надёжной.
6. Qwen 3.5 vs другие модели
| Модель | Intelligence Index | Mensa Norway IQ | AI IQ оцен. | Мультимодал | Стоимость/1M | Языки | Open-source |
|---|---|---|---|---|---|---|---|
| Qwen 3.5 | ~45-46 (топ-10) | 115 | ~115 | текст+изобр.+аудио+видео | 0.50/1.50 | 27+ | да |
| Claude Opus 4.8 | 55.7 | ~130 | ~132 | текст+изобр. | 5/25 | ~20 | нет |
| GPT-5.5 | 54.8 | ~145 | ~136 | текст+изобр.+аудио | 5/30 | ~50 | нет |
| Gemini 3.1 Pro | 46.5 | 141 | ~131 | текст+изобр.+аудио+видео | 2/12 | ~40 | нет |
| Grok-4.20 | топ-5 | 145 | ~140 | текст+изобр. | 3/15 | ~20 | нет |
| DeepSeek V4 Pro | 44.3 | ~111 | ~111 | только текст | 0.44/0.87 | ~10 | да |
| Kimi K3 | ~45-47 (топ-10) | 118 | ~118 | только текст | 0.55/2.19 | ~10 | нет |
Картина: Qwen 3.5 — универсал — не лучшая в чём-то одном, но очень хорошая почти во всём. Claude — способный профессионал — лучший в реальных задачах и фактической точности. GPT-5.5 — гений-тестировщик — лучший в математике и визуальном рассуждении. Gemini — чемпион по ценности — лучшая экономическая эффективность среди frontier-моделей. Grok-4.20 — чемпион по raw IQ — высший IQ с личностью. DeepSeek — бюджетный чемпион — самый дешёвый с open-source. А Kimi — чемпион по длинному контексту — наибольшее контекстное окно.
Для организаций, которым нужна универсальность — мультимодальность, мультиязычность, доступность, open-source — Qwen 3.5 — очевидный выбор. Это швейцарский нож среди AI-моделей.
7. Что это значит для людей?
Qwen 3.5 работает на IQ ~115 — умнее примерно 84% людей. Но:
- IQ — не всё: IQ 115 выше среднего и достаточно для большинства практических задач
- Универсальность важнее raw IQ для многих приложений: для разнообразных нагрузок разносторонние возможности Qwen 3.5 ценнее, чем более высокий IQ у более узкой модели
- Мультимодальность — это будущее: способность Qwen 3.5 обрабатывать текст, изображения, аудио и видео открывает приложения, которые не могут обработать только текстовые модели
- Мультиязычность обеспечивает глобальный охват: с 27+ языками Qwen 3.5 может обслуживать пользователей на их родном языке — возможность, которая важна для глобальных приложений
- Знание ≠ понимание: как все AI-модели, Qwen 3.5 имеет доступ к обширным знаниям, но не «понимает» так, как человек
- Нет сознания: высокий IQ не значит sentience. Qwen 3.5 — сложная система распознавания паттернов, не мыслящее существо
- Open-source расширяет инновации: открытые веса Qwen 3.5 позволяют исследователям и разработчикам строить кастомные решения, fine-tune для конкретных доменов и запускать локально
Самый честный ответ: Qwen 3.5 умнее 84% людей на когнитивных тестах, и для приложений, требующих универсальности — мультимодальность, мультиязычность, доступность — это самый умный выбор — не потому что она самая интеллектуальная, а потому что она самая способная в самом широком диапазоне задач.
Заключение
- Топ-10 на Intelligence Index — конкурентно с Gemini, Kimi и DeepSeek, позади Claude и GPT-5.5.
- Полная мультимодальность — текст, изображения, аудио и видео в одной модели.
- 27+ языков — одна из самых мультиязычных AI-моделей.
- Open-source — веса доступны для локального развёртывания, обеспечивая конфиденциальность и кастомизацию.
- Лучше всего для: разнообразных корпоративных нагрузок, международных приложений, мультимодальных задач, организаций, чувствительных к стоимости, самохостингового развёртывания.
- Не лучше всего для: raw IQ (frontier-модели выигрывают), длинного контекста (Kimi выигрывает), сложных агентных задач (Claude выигрывает), эмоционального интеллекта (Claude выигрывает).
- Урок: интеллект — не только быть самым умным — но и быть самым универсальным. Qwen 3.5 доказывает, что быть хорошим во всём может быть ценнее, чем быть лучшим в одном.