¿Cuál es el IQ de DeepSeek V4?
Dr. Daria Dudnik 10 min read 0 views

¿Cuál es el IQ de DeepSeek V4?

DeepSeek V4 Pro obtiene 111 en el test de IQ Mensa Norway y 44.3 en el Intelligence Index. Analizamos cada benchmark y explicamos por qué es el mejor modelo de IA económico.

DeepSeek V4 Pro: el campeón de código abierto de China

DeepSeek V4 Pro es el modelo insignia de DeepSeek, el laboratorio chino de IA que sorprendió al mundo con su combinación de bajo coste y alto rendimiento. Lanzado a principios de 2026, DeepSeek V4 Pro obtiene 111 en el test de IQ Mensa Norway y 44.3 en el Artificial Analysis Intelligence Index v4.1 — situándose en el top 10 mundial, pero muy por detrás de los modelos de frontera (Claude con 55,7, GPT-5.5 con 54,8).

Lo que hace remarkable a DeepSeek V4 Pro no es su inteligencia bruta — es su precio. A 0,44/0,87 por 1M tokens, cuesta aproximadamente 10 veces menos que Claude (5/25) y GPT-5.5 (5/30), y 5 veces menos que Gemini (2/12). Por el precio de una sola consulta a Claude, podrías hacer diez consultas a DeepSeek V4 Pro. Y aun así, obtiene 111 en un test de IQ — superior a aproximadamente el 25% de los humanos.

DeepSeek V4 Pro es la IA del pueblo: un modelo que no compite en la frontera de la inteligencia, pero que lleva IA capaz a todo el mundo a un precio que es prácticamente gratis. Para estudiantes, aficionados, pequeñas empresas y desarrolladores en mercados sensibles al precio, DeepSeek V4 Pro es a menudo la única opción viable.

Puntuaciones clave:

  • Artificial Analysis Intelligence Index: 44,3 (top 10 mundial)
  • Mensa Norway IQ (TrackingAI): 111 (superior a la media humana)
  • AI IQ compuesto (VexoWire): ~111 estimado
  • GDPval-AA v2: top 10
  • Humanity's Last Exam: top 10
  • Tasa de alucinación: moderada
  • Coste: 0,44/0,87 por 1M tokens (el más bajo entre todos los modelos principales)
  • Código abierto: pesos disponibles para despliegue local

1. La revolución económica

DeepSeek V4 Pro representa un cambio fundamental en el panorama de la IA: la democratización de la inteligencia. Mientras los laboratorios estadounidenses (OpenAI, Anthropic, Google, xAI) compiten en la frontera — empujando las puntuaciones de IQ de 130 a 140 a 145 — DeepSeek se ha centrado en un objetivo diferente: hacer que la IA capaz sea asequible para todos.

A 0,44 por 1M tokens de entrada y0,87 por 1M de salida, DeepSeek V4 Pro es asombrosamente barato. Para ponerlo en perspectiva: procesar un documento típico del tamaño de un libro (unos 100.000 tokens) cuesta aproximadamente 0,04 de entrada y0,09 de salida. La misma tarea costaría 0,50-1,00 con Gemini, 1,00-3,00 con Claude o GPT-5.5.

Esto no es solo un descuento — es una categoría diferente de producto. DeepSeek V4 Pro hace la IA accesible a:

  • Estudiantes que no pueden permitirse suscripciones de $20/mes
  • Pequeñas empresas en mercados en desarrollo
  • Aficionados y experimentadores
  • Desarrolladores que crean aplicaciones de alto volumen
  • Investigadores que procesan conjuntos de datos masivos con presupuestos limitados

Y lo remarkable es: DeepSeek V4 Pro es genuinamente capaz. Obtiene 111 en el test de IQ Mensa Norway — por encima de la media humana de 100, y superior a aproximadamente el 25% de las personas. No es un genio, pero es lo suficientemente inteligente para la mayoría de tareas cotidianas: escritura, programación, análisis, traducción, resumen.


2. Análisis de benchmarks

Test de IQ Mensa Norway: 111 (superior a la media)

Consiste en 36 preguntas de reconocimiento de patrones visuales. DeepSeek V4 Pro obtiene 111 — por encima de la media humana de 100, situándolo en el rango "superior a la media". Esto es mayor que aproximadamente el 25% de los humanos, pero muy por debajo de los modelos de frontera (Claude ~130, Gemini 141, GPT-5.5 ~145, Grok-4.20 145).

Un IQ de 111 significa que DeepSeek V4 Pro puede reconocer patrones visuales y razonar abstractamente a un nivel comparable a un estudiante universitario brillante. No resolverá los puzzles más difíciles, pero maneja la mayoría de tareas de razonamiento cotidiano competentemente.

La brecha entre DeepSeek V4 Pro (111) y los modelos de frontera (130-145) es significativa — unos 20-35 puntos de IQ, o aproximadamente 1-2 desviaciones estándar. Esto significa que los modelos de frontera son sustancialmente más inteligentes en tests cognitivos puros. Pero para tareas que no requieren razonamiento de nivel genio — que es la mayoría — DeepSeek V4 Pro es más que adecuado.

Artificial Analysis Intelligence Index v4.1: 44,3 (top 10)

En el Intelligence Index, DeepSeek V4 Pro obtiene 44,3 — situándose en el top 10 mundial, pero unos 10-11 puntos por detrás de los líderes de frontera (Claude 55,7, GPT-5.5 54,8). Esta brecha es significativa pero esperada dada la diferencia de precio.

Desglose de los componentes del Index:

  • GDPval-AA v2: DeepSeek puntúa razonablemente pero queda por detrás de Claude y GPT-5.5 en tareas complejas multi-paso
  • AA-Omniscience: DeepSeek tiene una tasa de alucinación moderada — no tan baja como Claude, pero aceptable para la mayoría de usos
  • GPQA: DeepSeek rinde adecuadamente en preguntas de ciencia de nivel posgrado
  • HLE: DeepSeek se sitúa en el top 10 en Humanity's Last Exam
  • ARC-AGI: DeepSeek tiene dificultades con el razonamiento abstracto comparado con los modelos de frontera
  • LMSYS Arena: DeepSeek obtiene puntuaciones decentes de preferencia humana, particularmente en tareas de programación

AI IQ compuesto (VexoWire): ~111

El IQ compuesto de VexoWire combina múltiples tests (Mensa Norway, Mensa Denmark, Raven's, WAIS-IV). El IQ compuesto estimado de DeepSeek V4 Pro es ~111 — consistente con su puntuación de Mensa Norway. Esto lo sitúa firmemente en el rango "superior a la media", comparable a un humano brillante pero muy por debajo del nivel de genio.

GDPval-AA v2: top 10

En el benchmark agentivo, DeepSeek V4 Pro se sitúa en el top 10. Es significativamente menos capaz que Claude (1.890 Elo) y GPT-5.5 (1.850 Elo) en tareas complejas multi-paso, pero puede manejar cargas de trabajo agentivas moderadas. Para automatización simple, tareas de programación básicas e instrucciones multi-paso directas, DeepSeek V4 Pro es competente.

Humanity's Last Exam (HLE): top 10

En las preguntas académicas más difíciles, DeepSeek V4 Pro se sitúa en el top 10 entre modelos de IA. Esto refleja el fuerte entrenamiento de DeepSeek en datos académicos y científicos — el modelo tiene un conocimiento amplio en todas las disciplinas, incluso si no puede igualar la profundidad de razonamiento de los modelos de frontera.


3. ¿Qué significa un IQ de 111?

Para poner el IQ de 111 de DeepSeek V4 Pro en contexto:

  • 85-115 (68% de las personas): Inteligencia media
  • 115-130 (14%): Superior a la media a alta
  • 130-145 (2%): Superdotado — clasifica para Mensa (top 2%)
  • 145-160 (0,1%): Altamente superdotado / genio

DeepSeek V4 Pro, con 111, se sitúa en el extremo superior del rango medio — más inteligente que aproximadamente el 25% de los humanos, pero sin llegar del todo al umbral "superior a la media" de 115. Si fuera persona, sería comparable a un estudiante universitario brillante o un profesional capaz — no un genio, pero ciertamente competente.

Esto es notablemente inferior a los modelos de frontera:

  • Claude Opus 4.8: ~130 (superdotado)
  • Gemini 3.1 Pro: 141 (altamente superdotado)
  • GPT-5.5: ~145 (genio)
  • Grok-4.20: 145 (genio)

La brecha es significativa — unos 20-35 puntos de IQ. Pero la pregunta clave es: ¿importa la brecha para tu caso de uso? Para la mayoría de tareas cotidianas — escribir emails, resumir documentos, programación básica, traducción — un IQ de 111 es más que suficiente. La ventaja de los modelos de frontera se muestra en los problemas más difíciles: demostraciones matemáticas complejas, razonamiento multi-paso intrincado, preguntas de investigación punteras.


4. Donde DeepSeek V4 Pro destaca

Rentabilidad

Esta es la característica definitoria de DeepSeek V4 Pro. A 0,44/0,87 por 1M tokens, es con diferencia el modelo de IA principal más barato. Para aplicaciones de alto volumen — chatbots que sirven a miles de usuarios, procesamiento masivo de documentos, análisis de datos a gran escala — el ahorro es enorme. Podrías ejecutar 10-30 consultas de DeepSeek por el precio de una sola consulta a Claude o GPT-5.5.

Programación y tareas técnicas

DeepSeek V4 Pro es particularmente fuerte en tareas de programación. DeepSeek ha invertido fuertemente en datos de entrenamiento de código, y el modelo rinde bien en benchmarks como HumanEval y MBPP. Para desarrolladores que necesitan un asistente de programación pero no pueden permitirse precios de frontera, DeepSeek V4 Pro es una excelente elección.

Disponibilidad de código abierto

Los pesos de DeepSeek V4 Pro están disponibles para despliegue local. Esto significa que las organizaciones pueden ejecutar el modelo en su propio hardware, evitando costes de API por completo y manteniendo los datos privados. Para organizaciones conscientes con la seguridad, investigadores en entornos restringidos y desarrolladores que necesitan control total, esto es una gran ventaja.

Soporte multilingüe

DeepSeek V4 Pro está entrenado extensivamente en chino e inglés, con fuerte soporte para otros idiomas principales. Para aplicaciones en chino, DeepSeek está entre los mejores modelos disponibles — a veces superando a los modelos occidentales en tareas en idioma chino.

Razonamiento matemático

Aunque no al nivel de GPT-5.5, DeepSeek V4 Pro es competente en razonamiento matemático. Puede resolver la mayoría de problemas de matemáticas de secundaria y universitarios, y maneja aritmética y álgebra de forma fiable. Para tareas matemáticas cotidianas, es más que adecuado.

Velocidad

DeepSeek V4 Pro es rápido — su menor tamaño y arquitectura optimizada significan que genera respuestas rápidamente. Para aplicaciones donde la latencia importa — chat en tiempo real, herramientas interactivas, atención al cliente — DeepSeek V4 Pro ofrece un rendimiento responsivo.


5. Donde DeepSeek V4 Pro se queda corto

IQ bruto y razonamiento complejo

Con un IQ de 111, DeepSeek V4 Pro está significativamente por debajo de los modelos de frontera en tareas de razonamiento complejo. Para los problemas más difíciles — matemáticas competitivas, puzzles de lógica avanzados, razonamiento abstracto multi-paso — los modelos de frontera son sustancialmente mejores. Si tu tarea requiere razonamiento de nivel genio, DeepSeek V4 Pro tendrá dificultades donde Claude o GPT-5.5 tendrían éxito.

Tareas agentivas

En GDPval-AA v2, DeepSeek V4 Pro está en el top 10 pero muy por detrás de Claude y GPT-5.5. Para tareas reales complejas y multi-paso — escribir grandes proyectos de software, gestionar flujos de investigación, ejecutar planes intrincados — DeepSeek V4 Pro es menos fiable. Puede manejar tareas agentivas simples pero tiene dificultades con las complejas.

Tasa de alucinación

DeepSeek V4 Pro tiene una tasa de alucinación moderada — superior a Claude (35,9%) y Gemini. Es más propenso a afirmar con confianza información incorrecta, particularmente en temas nicho o especializados. Para aplicaciones donde la precisión factual es crítica (investigación, derecho, medicina), Claude es más fiable.

Inteligencia emocional

El EQ (inteligencia emocional) de DeepSeek V4 Pro se estima en ~105 — inferior a todos los modelos de frontera (Claude ~132, GPT-5.5 ~120, Gemini ~115, Grok ~110). Sus respuestas tienden a ser más mecánicas y menos matizadas en la comprensión de las emociones humanas. Para apps de terapia, atención al cliente o interacciones humanas sensibles, esto es una limitación.

Seguridad y alineación

DeepSeek V4 Pro está sujeto a requisitos regulatorios chinos, lo que significa que puede negarse a responder ciertas preguntas políticamente sensibles. Esto es diferente de los filtros de seguridad de los modelos occidentales (que se centran en contenido dañino) y puede afectar su utilidad para ciertos temas.


6. DeepSeek V4 Pro vs otros modelos

Modelo Intelligence Index Mensa Norway IQ AI IQ est. Alucinación Coste/1M Código abierto
DeepSeek V4 Pro 44,3 ~111 ~111 moderada 0,44/0,87
Claude Opus 4.8 55,7 ~130 ~132 35,9% (mín) 5/25 no
GPT-5.5 54,8 ~145 ~136 moderada 5/30 no
Gemini 3.1 Pro 46,5 141 ~131 baja 2/12 no
Grok-4.20 top 5 145 ~140 moderada 3/15 no

La imagen: DeepSeek V4 Pro es el campeón económico — no el más inteligente, pero con diferencia el más asequible. Claude es el profesional capaz — el mejor en tareas reales y precisión factual. GPT-5.5 es el genio del test — el mejor en matemáticas y razonamiento visual. Gemini es el campeón de valor — mejor rentabilidad entre modelos de frontera. Grok-4.20 es el campeón de IQ bruto — el IQ más alto con una personalidad única.

Para usuarios que necesitan IA capaz al precio más bajo posible, DeepSeek V4 Pro es la opción clara. No igualará a los modelos de frontera en los problemas más difíciles, pero para el 90% de las tareas cotidianas, es más que suficiente — por una fracción del coste.


7. ¿Qué significa esto para los humanos?

DeepSeek V4 Pro opera con un IQ de ~111 — más inteligente que aproximadamente el 25% de los humanos. Pero:

  • El IQ no lo es todo: un IQ de 111 está por encima de la media y es suficiente para la mayoría de tareas prácticas
  • El coste importa más que el IQ para la mayoría de usos: para aplicaciones cotidianas, el ahorro de 10x de DeepSeek a menudo importa más que la brecha de 20-35 puntos de IQ con los modelos de frontera
  • El código abierto permite innovación: los pesos abiertos de DeepSeek permiten a investigadores y desarrolladores construir soluciones personalizadas, ajustar para dominios específicos y ejecutar localmente
  • Conocimiento ≠ comprensión: como todos los modelos de IA, DeepSeek tiene acceso a vasto conocimiento pero no "comprende" verdaderamente como un humano
  • Sin conciencia: un IQ alto no significa consciencia. DeepSeek es un sistema sofisticado de reconocimiento de patrones, no un ser pensante
  • Democratización de la IA: DeepSeek V4 Pro demuestra que la IA capaz no tiene que ser cara — puede ser accesible para todos

La respuesta más honesta: DeepSeek V4 Pro es más inteligente que una cuarta parte de los humanos en tests cognitivos, y para la mayoría de propósitos prácticos, es la opción más inteligente — no porque sea la más inteligente, sino porque ofrece el mayor valor por dólar.

¿Cómo se compara tu IQ con DeepSeek V4 Pro? Realiza la evaluación profesional de IQ de NeuroLab.
Realizar la prueba ahora →


Conclusión

💡 Puntos clave
- El IQ de DeepSeek V4 Pro es 111 en Mensa Norway — superior a la media humana, más inteligente que ~25% de las personas.

  • 44,3 en el Intelligence Index — top 10 mundial, pero ~10 puntos por detrás de los modelos de frontera.
  • El coste más bajo de cualquier modelo principal — 0,44/0,87 por 1M tokens, aproximadamente 10x más barato que Claude o GPT-5.5.
  • Código abierto — pesos disponibles para despliegue local, permitiendo privacidad y personalización.
  • Mejor para: aplicaciones sensibles al coste, programación, tareas de alto volumen, aplicaciones en chino, despliegue local.
  • No mejor para: razonamiento complejo (modelos de frontera ganan), tareas agentivas (Claude gana), precisión factual (Claude gana), inteligencia emocional (Claude gana).
  • La lección: la inteligencia no es solo ser el más inteligente — es ser accesible. DeepSeek V4 Pro democratiza la IA, llevando inteligencia capaz a todos.