Какой IQ у DeepSeek V4?
Dr. Daria Dudnik 10 мин чтения 0 просмотров

Какой IQ у DeepSeek V4?

DeepSeek V4 Pro набирает 111 на тесте Mensa Norway IQ и 44.3 на Intelligence Index. Разбираем каждый бенчмарк и объясняем, почему это лучшая бюджетная AI-модель.

DeepSeek V4 Pro: китайский чемпион open-source

DeepSeek V4 Pro — флагманская модель от DeepSeek, китайской AI-лаборатории, которая поразила мир сочетанием низкой цены и высокой производительности. Выпущенная в начале 2026 года, DeepSeek V4 Pro набирает 111 на тесте Mensa Norway IQ и 44.3 на Artificial Analysis Intelligence Index v4.1 — входя в топ-10 в мире, но заметно отставая от frontier-моделей (Claude 55.7, GPT-5.5 54.8).

Что делает DeepSeek V4 Pro замечательной — не её raw интеллект, а её цена. При 0.44/0.87 за 1M токенов она стоит примерно в 10 раз меньше, чем Claude (5/25) и GPT-5.5 (5/30), и в 5 раз меньше, чем Gemini (2/12). За цену одного запроса к Claude можно выполнить десять запросов к DeepSeek V4 Pro. И при этом она набирает 111 на IQ-тесте — выше примерно 25% людей.

DeepSeek V4 Pro — AI для всех: модель, которая не конкурирует на фронте интеллекта, но приносит способный AI каждому по цене, которая практически бесплатна. Для студентов, любителей, малого бизнеса и разработчиков в чувствительных к стоимости рынках DeepSeek V4 Pro часто единственный жизнеспособный вариант.

Ключевые оценки:

  • Artificial Analysis Intelligence Index: 44.3 (топ-10 в мире)
  • Mensa Norway IQ (TrackingAI): 111 (выше среднего человека)
  • AI IQ композит (VexoWire): ~111 оценочно
  • GDPval-AA v2: топ-10
  • Humanity's Last Exam: топ-10
  • Уровень галлюцинаций: умеренный
  • Стоимость: 0.44/0.87 за 1M токенов (самая низкая среди всех крупных моделей)
  • Open-source: веса доступны для локального развёртывания

1. Бюджетная революция

DeepSeek V4 Pro представляет фундаментальный сдвиг в AI-ландшафте: демократизацию интеллекта. В то время как американские лаборатории (OpenAI, Anthropic, Google, xAI) конкурируют на фронте — подталкивая IQ с 130 до 140 до 145 — DeepSeek сосредоточился на другой цели: сделать способный AI доступным для всех.

При 0.44 за 1M входных токенов и0.87 за 1M выходных DeepSeek V4 Pro поразительно дёшев. Для контекста: обработка типичного документа размером с книгу (около 100,000 токенов) стоит примерно 0.04 за ввод и0.09 за вывод. Та же задача стоила бы 0.50-1.00 с Gemini, 1.00-3.00 с Claude или GPT-5.5.

Это не просто скидка — это другая категория продукта. DeepSeek V4 Pro делает AI доступным для:

  • Студентов, которые не могут позволить себе подписку $20/мес
  • Малого бизнеса на развивающихся рынках
  • Любителей и экспериментаторов
  • Разработчиков, создающих высоконагруженные приложения
  • Исследователей, обрабатывающих массивные наборы данных с ограниченным бюджетом

И замечательно то, что DeepSeek V4 Pro действительно способна. Она набирает 111 на Mensa Norway IQ — выше человеческого среднего (100) и выше примерно 25% людей. Она не гений, но достаточно умна для большинства повседневных задач: письма, программирования, анализа, перевода, суммаризации.


2. Разбор бенчмарков

Mensa Norway IQ: 111 (выше среднего)

Mensa Norway IQ состоит из 36 вопросов на визуальное распознавание паттернов. DeepSeek V4 Pro набирает 111 — выше человеческого среднего (100), попадая в диапазон «выше среднего». Это выше примерно 25% людей, но значительно ниже frontier-моделей (Claude ~130, Gemini 141, GPT-5.5 ~145, Grok-4.20 145).

IQ 111 означает, что DeepSeek V4 Pro распознаёт визуальные паттерны и рассуждает абстрактно на уровне способного студента. Она не решит самые сложные головоломки, но справляется с большинством повседневных рассуждений.

Разрыв между DeepSeek V4 Pro (111) и frontier-моделями (130-145) значителен — около 20-35 IQ-баллов, или примерно 1-2 стандартных отклонения. Это означает, что frontier-модели существенно умнее на чистых когнитивных тестах. Но для задач, не требующих гениального рассуждения — а это большинство задач — DeepSeek V4 Pro более чем достаточна.

Artificial Analysis Intelligence Index v4.1: 44.3 (топ-10)

На Intelligence Index DeepSeek V4 Pro набирает 44.3 — входя в топ-10 в мире, но примерно на 10-11 баллов отставая от лидеров (Claude 55.7, GPT-5.5 54.8). Этот разрыв значителен, но ожидаем учитывая разницу в цене.

Разбор компонентов индекса:

  • GDPval-AA v2: DeepSeek забивает разумно, но отстаёт от Claude и GPT-5.5 на сложных многошаговых задачах
  • AA-Omniscience: у DeepSeek умеренный уровень галлюцинаций — не такой низкий как у Claude, но приемлемый для большинства применений
  • GPQA: DeepSeek адекватно справляется с научными вопросами уровня магистратуры
  • HLE: DeepSeek в топ-10 на Humanity's Last Exam
  • ARC-AGI: DeepSeek испытывает трудности с абстрактным рассуждением по сравнению с frontier-моделями
  • LMSYS Arena: DeepSeek получает достойные баллы человеческого предпочтения, особенно по задачам программирования

AI IQ композит (VexoWire): ~111

Композитный IQ VexoWire объединяет несколько тестов (Mensa Norway, Mensa Denmark, Raven's, WAIS-IV). Оценочный композитный IQ DeepSeek V4 Pro ~111 — соответствует её баллу Mensa Norway. Это уверенно помещает её в диапазон «выше среднего», сравнимо со способным человеком, но значительно ниже гениального уровня.

GDPval-AA v2: топ-10

На агентном бенчмарке DeepSeek V4 Pro в топ-10. Она значительно менее способна, чем Claude (1,890 Elo) и GPT-5.5 (1,850 Elo) на сложных многошаговых задачах, но справляется с умеренными агентными нагрузками. Для простой автоматизации, базовых задач программирования и прямых многошаговых инструкций DeepSeek V4 Pro компетентна.

Humanity's Last Exam (HLE): топ-10

На сложнейших академических вопросах DeepSeek V4 Pro в топ-10 среди AI-моделей. Это отражает сильное обучение DeepSeek на академических и научных данных — модель имеет широкие знания по дисциплинам, даже если не может сравниться с глубиной рассуждений frontier-моделей.


3. Что означает IQ 111?

Чтобы контекстуализировать IQ 111 DeepSeek V4 Pro:

  • 85-115 (68% людей): средний интеллект
  • 115-130 (14%): выше среднего до высокого среднего
  • 130-145 (2%): одарённые — квалификация для Mensa (топ 2%)
  • 145-160 (0.1%): высоко одарённые / гении

DeepSeek V4 Pro с 111 находится на верхнем крае среднего диапазона — умнее примерно 25% людей, но не совсем достигая порога «выше среднего» в 115. Если бы она была человеком, она была бы сравнима со способным студентом или компетентным профессионалом — не гением, но определённо умной.

Это заметно ниже frontier-моделей:

  • Claude Opus 4.8: ~130 (одарённый)
  • Gemini 3.1 Pro: 141 (высоко одарённый)
  • GPT-5.5: ~145 (гений)
  • Grok-4.20: 145 (гений)

Разрыв значителен — около 20-35 IQ-баллов. Но вот ключевой вопрос: имеет ли значение разрыв для вашего случая? Для большинства повседневных задач — написание писем, суммаризация документов, базовое программирование, перевод — IQ 111 более чем достаточно. Преимущество frontier-моделей проявляется на самых сложных проблемах: сложные математические доказательства, intricate многошаговые рассуждения, передовые исследовательские вопросы.


4. Где DeepSeek V4 Pro сильна

Экономическая эффективность

Это определяющая черта DeepSeek V4 Pro. При 0.44/0.87 за 1M токенов — это безусловно самая дешёвая крупная AI-модель. Для высоконагруженных приложений — чатботы, обслуживающие тысячи пользователей, массовая обработка документов, крупномасштабный анализ данных — экономия огромна. Можно выполнить 10-30 запросов DeepSeek по цене одного запроса Claude или GPT-5.5.

Программирование и технические задачи

DeepSeek V4 Pro особенно сильна в задачах программирования. DeepSeek активно инвестировал в тренировочные данные по коду, и модель хорошо выступает на бенчмарках вроде HumanEval и MBPP. Для разработчиков, которым нужен помощник по коду, но не могут позволить себе frontier-цены, DeepSeek V4 Pro — отличный выбор.

Open-source доступность

Веса DeepSeek V4 Pro доступны для локального развёртывания. Это означает, что организации могут запускать модель на собственном оборудовании, полностью избегая API-расходов и сохраняя данные приватными. Для организаций, заботящихся о безопасности, исследователей в ограниченных средах и разработчиков, нуждающихся в полном контроле, это большое преимущество.

Многоязычная поддержка

DeepSeek V4 Pro обучена преимущественно на китайском и английском, с сильной поддержкой других основных языков. Для китайскоязычных приложений DeepSeek среди лучших моделей — иногда превосходит западные модели на задачах на китайском языке.

Математическое рассуждение

Хотя не на уровне GPT-5.5, DeepSeek V4 Pro компетентна в математическом рассуждении. Она решает большинство задач школьного и университетского уровня и надёжно справляется с арифметикой и алгеброй. Для повседневных математических задач более чем достаточно.

Скорость

DeepSeek V4 Pro быстрая — меньший размер и оптимизированная архитектура означают быструю генерацию ответов. Для приложений, где важна задержка — реальный чат, интерактивные инструменты, служба поддержки — DeepSeek V4 Pro обеспечивает отзывчивую производительность.


5. Где DeepSeek V4 Pro отстаёт

Raw IQ и сложное рассуждение

С IQ 111 DeepSeek V4 Pro значительно ниже frontier-моделей на задачах сложного рассуждения. Для самых трудных проблем — соревновательная математика, продвинутые логические головоломки, многошаговое абстрактное рассуждение — frontier-модели существенно лучше. Если ваша задача требует гениального рассуждения, DeepSeek V4 Pro будет испытывать трудности там, где Claude или GPT-5.5 справятся.

Агентные задачи

На GDPval-AA v2 DeepSeek V4 Pro в топ-10, но заметно позади Claude и GPT-5.5. Для сложных многошаговых реальных задач — написание крупных программных проектов, управление исследовательскими процессами, выполнение сложных планов — DeepSeek V4 Pro менее надёжна. Она справляется с простыми агентными задачами, но испытывает трудности со сложными.

Уровень галлюцинаций

У DeepSeek V4 Pro умеренный уровень галлюцинаций — выше Claude (35.9%) и Gemini. Она с большей вероятностью уверенно заявит неверную информацию, особенно по нишевым или специализированным темам. Для применений, где фактическая точность критична (исследования, право, медицина), Claude надёжнее.

Эмоциональный интеллект

EQ (эмоциональный интеллект) DeepSeek V4 Pro оценочно ~105 — ниже всех frontier-моделей (Claude ~132, GPT-5.5 ~120, Gemini ~115, Grok ~110). Её ответы склонны быть более механическими и менее nuanced в понимании человеческих эмоций. Для терапевтических приложений, службы поддержки или чувствительного человеческого взаимодействия это ограничение.

Безопасность и алайнмент

DeepSeek V4 Pro подчиняется китайским регуляторным требованиям, что означает возможный отказ отвечать на определённые политически чувствительные вопросы. Это отличается от фильтров безопасности западных моделей (которые фокусируются на вредоносном контенте) и может влиять на полезность для определённых тем.


6. DeepSeek V4 Pro vs другие модели

Модель Intelligence Index Mensa Norway IQ AI IQ оцен. Галлюц. Стоимость/1M Open-source
DeepSeek V4 Pro 44.3 ~111 ~111 умерен. 0.44/0.87 да
Claude Opus 4.8 55.7 ~130 ~132 35.9% (низш.) 5/25 нет
GPT-5.5 54.8 ~145 ~136 умерен. 5/30 нет
Gemini 3.1 Pro 46.5 141 ~131 низкие 2/12 нет
Grok-4.20 топ-5 145 ~140 умерен. 3/15 нет

Картина: DeepSeek V4 Pro — бюджетный чемпион — не самая умная, но безусловно самая доступная. Claude — способный профессионал — лучший в реальных задачах и фактической точности. GPT-5.5 — гений-тестировщик — лучший в математике и визуальном рассуждении. Gemini — чемпион по ценности — лучшая экономическая эффективность среди frontier-моделей. Grok-4.20 — чемпион по raw IQ — высший IQ с уникальной личностью.

Для пользователей, которым нужна способная AI по минимально возможной цене, DeepSeek V4 Pro — очевидный выбор. Она не сравнится с frontier-моделями на самых сложных проблемах, но для 90% повседневных задач более чем достаточно — за малую долю стоимости.


7. Что это значит для людей?

DeepSeek V4 Pro работает на IQ ~111 — умнее примерно 25% людей. Но:

  • IQ — не всё: IQ 111 выше среднего и достаточно для большинства практических задач
  • Стоимость важнее IQ для большинства применений: для повседневных приложений 10-кратная экономия DeepSeek часто важнее 20-35-балльного разрыва в IQ с frontier-моделями
  • Open-source даёт инновации: открытые веса DeepSeek позволяют исследователям и разработчикам строить кастомные решения, fine-tune для специфических доменов и запускать локально
  • Знание ≠ понимание: как все AI-модели, DeepSeek имеет доступ к обширным знаниям, но не «понимает» так, как человек
  • Нет сознания: высокий IQ не значит sentience. DeepSeek — сложная система распознавания паттернов, не мыслящее существо
  • Демократизация AI: DeepSeek V4 Pro доказывает, что способный AI не обязан быть дорогим — он может быть доступен каждому

Самый честный ответ: DeepSeek V4 Pro умнее четверти людей на когнитивных тестах, и для большинства практических целей это самый умный выбор — не потому что она самая интеллектуальная, а потому что доставляет больше всего ценности за доллар.

Как ваш IQ соотносится с DeepSeek V4 Pro? Пройдите профессиональную оценку IQ в NeuroLab.
Пройти тест прямо сейчас →


Заключение

💡 Ключевые выводы
- IQ DeepSeek V4 Pro — 111 на Mensa Norway — выше среднего человека, умнее ~25% людей.

  • 44.3 на Intelligence Index — топ-10 в мире, но ~10 баллов позади frontier-моделей.
  • Самая низкая стоимость среди всех крупных моделей — 0.44/0.87 за 1M токенов, примерно в 10 раз дешевле Claude или GPT-5.5.
  • Open-source — веса доступны для локального развёртывания, обеспечивая приватность и кастомизацию.
  • Лучше всего для: чувствительных к стоимости приложений, программирования, высоконагруженных задач, китайскоязычных приложений, локального развёртывания.
  • Не лучше всего для: сложного рассуждения (frontier-модели выигрывают), агентных задач (Claude выигрывает), фактической точности (Claude выигрывает), эмоционального интеллекта (Claude выигрывает).
  • Урок: интеллект — не только быть самым умным — но быть доступным. DeepSeek V4 Pro демократизирует AI, принося способный интеллект каждому.

Читайте также

Все статьи →