Qual é o QI do DeepSeek V4?
Dr. Daria Dudnik 10 min read 0 views

Qual é o QI do DeepSeek V4?

DeepSeek V4 Pro pontua 111 no teste de QI Mensa Norway e 44.3 no Intelligence Index. Analisamos cada benchmark e explicamos por que é o melhor modelo de IA econômico.

DeepSeek V4 Pro: o campeão de código aberto da China

DeepSeek V4 Pro é o modelo flagship da DeepSeek, o laboratório chinês de IA que chocou o mundo com sua combinação de baixo custo e alto desempenho. Lançado no início de 2026, DeepSeek V4 Pro pontua 111 no teste de QI Mensa Norway e 44.3 no Artificial Analysis Intelligence Index v4.1 — colocando-o no top 10 global, mas bem atrás dos modelos de fronteira (Claude com 55.7, GPT-5.5 com 54.8).

O que torna DeepSeek V4 Pro remarkable não é sua inteligência bruta — é seu preço. A 0.44/0.87 por 1M tokens, custa aproximadamente 10x menos que Claude (5/25) e GPT-5.5 (5/30), e 5x menos que Gemini (2/12). Pelo preço de uma única consulta ao Claude, você poderia fazer dez consultas ao DeepSeek V4 Pro. E ainda assim, pontua 111 num teste de QI — superior a aproximadamente 25% dos humanos.

DeepSeek V4 Pro é a IA do povo: um modelo que não compete na fronteira da inteligência, mas que leva IA capaz a todos num preço que é praticamente grátis. Para estudantes, amadores, pequenas empresas e desenvolvedores em mercados sensíveis a preço, DeepSeek V4 Pro é frequentemente a única opção viável.

Pontuações-chave:

  • Artificial Analysis Intelligence Index: 44.3 (top 10 global)
  • QI Mensa Norway (TrackingAI): 111 (acima da média humana)
  • AI IQ composto (VexoWire): ~111 estimado
  • GDPval-AA v2: top 10
  • Humanity's Last Exam: top 10
  • Taxa de alucinação: moderada
  • Custo: 0.44/0.87 por 1M tokens (o mais baixo entre todos os modelos principais)
  • Código aberto: pesos disponíveis para implantação local

1. A revolução econômica

DeepSeek V4 Pro representa uma mudança fundamental no cenário de IA: a democratização da inteligência. Enquanto os laboratórios americanos (OpenAI, Anthropic, Google, xAI) competem na fronteira — empurrando pontuações de QI de 130 para 140 para 145 — DeepSeek focou num objetivo diferente: tornar IA capaz acessível a todos.

A 0.44 por 1M tokens de entrada e0.87 por 1M de saída, DeepSeek V4 Pro é surpreendentemente barato. Para colocar em perspectiva: processar um documento típico do tamanho de um livro (cerca de 100.000 tokens) custa aproximadamente 0.04 de entrada e0.09 de saída. A mesma tarefa custaria 0.50-1.00 com Gemini, 1.00-3.00 com Claude ou GPT-5.5.

Isso não é apenas um desconto — é uma categoria diferente de produto. DeepSeek V4 Pro torna IA acessível a:

  • Estudantes que não podem pagar assinaturas de $20/mês
  • Pequenas empresas em mercados em desenvolvimento
  • Amadores e experimentadores
  • Desenvolvedores construindo aplicações de alto volume
  • Pesquisadores processando conjuntos de dados massivos com orçamentos limitados

E o remarkable é: DeepSeek V4 Pro é genuinamente capaz. Pontua 111 no teste de QI Mensa Norway — acima da média humana de 100, e superior a aproximadamente 25% das pessoas. Não é um gênio, mas é inteligente o suficiente para a maioria das tarefas diárias: escrita, programação, análise, tradução, resumo.


2. Análise de benchmarks

Teste QI Mensa Norway: 111 (acima da média)

Consiste em 36 questões de reconhecimento de padrões visuais. DeepSeek V4 Pro pontua 111 — acima da média humana de 100, colocando-o na faixa "acima da média". Isso é maior que aproximadamente 25% dos humanos, mas bem abaixo dos modelos de fronteira (Claude ~130, Gemini 141, GPT-5.5 ~145, Grok-4.20 145).

Um QI de 111 significa que DeepSeek V4 Pro pode reconhecer padrões visuais e raciocinar abstratamente num nível comparável a um estudante universitário brilhante. Não resolverá os puzzles mais difíceis, mas lida com a maioria das tarefas de raciocínio diário competentemente.

A lacuna entre DeepSeek V4 Pro (111) e os modelos de fronteira (130-145) é significativa — cerca de 20-35 pontos de QI, ou aproximadamente 1-2 desvios padrão. Isso significa que os modelos de fronteira são substancialmente mais inteligentes em testes cognitivos puros. Mas para tarefas que não requerem raciocínio de nível gênio — que é a maioria — DeepSeek V4 Pro é mais do que adequado.

Artificial Analysis Intelligence Index v4.1: 44.3 (top 10)

No Intelligence Index, DeepSeek V4 Pro pontua 44.3 — colocando-o no top 10 global, mas cerca de 10-11 pontos atrás dos líderes de fronteira (Claude 55.7, GPT-5.5 54.8). Esta lacuna é significativa mas esperada dada a diferença de preço.

Decomposição dos componentes do Index:

  • GDPval-AA v2: DeepSeek pontua razoavelmente mas fica atrás de Claude e GPT-5.5 em tarefas complexas multi-etapa
  • AA-Omniscience: DeepSeek tem taxa de alucinação moderada — não tão baixa quanto Claude, mas aceitável para a maioria dos usos
  • GPQA: DeepSeek performa adequadamente em questões científicas de nível pós-graduação
  • HLE: DeepSeek está no top 10 no Humanity's Last Exam
  • ARC-AGI: DeepSeek tem dificuldades com raciocínio abstrato comparado aos modelos de fronteira
  • LMSYS Arena: DeepSeek obtém pontuações decentes de preferência humana, particularmente em tarefas de programação

AI IQ composto (VexoWire): ~111

O QI composto da VexoWire combina múltiplos testes (Mensa Norway, Mensa Denmark, Raven's, WAIS-IV). O QI composto estimado de DeepSeek V4 Pro é ~111 — consistente com sua pontuação Mensa Norway. Isso o coloca firmemente na faixa "acima da média", comparável a um humano brilhante mas bem abaixo do nível de gênio.

GDPval-AA v2: top 10

No benchmark agentivo, DeepSeek V4 Pro está no top 10. É significativamente menos capaz que Claude (1.890 Elo) e GPT-5.5 (1.850 Elo) em tarefas complexas multi-etapa, mas pode lidar com cargas de trabalho agentivas moderadas. Para automação simples, tarefas básicas de programação e instruções multi-etapa diretas, DeepSeek V4 Pro é competente.

Humanity's Last Exam (HLE): top 10

Nas questões acadêmicas mais difíceis, DeepSeek V4 Pro está no top 10 entre modelos de IA. Isso reflete o forte treinamento da DeepSeek em dados acadêmicos e científicos — o modelo tem conhecimento amplo através das disciplinas, mesmo que não possa igualar a profundidade de raciocínio dos modelos de fronteira.


3. O que significa um QI de 111?

Para colocar o QI de 111 de DeepSeek V4 Pro em contexto:

  • 85-115 (68% das pessoas): Inteligência média
  • 115-130 (14%): Acima da média a alta
  • 130-145 (2%): Superdotado — qualifica para Mensa (top 2%)
  • 145-160 (0.1%): Altamente superdotado / gênio

DeepSeek V4 Pro, com 111, situa-se no topo da faixa média — mais inteligente que cerca de 25% dos humanos, mas sem chegar ao limiar "acima da média" de 115. Se fosse pessoa, seria comparável a um estudante universitário brilhante ou um profissional capaz — não um gênio, mas certamente competente.

Isso é notavelmente inferior aos modelos de fronteira:

  • Claude Opus 4.8: ~130 (superdotado)
  • Gemini 3.1 Pro: 141 (altamente superdotado)
  • GPT-5.5: ~145 (gênio)
  • Grok-4.20: 145 (gênio)

A lacuna é significativa — cerca de 20-35 pontos de QI. Mas a questão chave é: a lacuna importa para seu caso de uso? Para a maioria das tarefas diárias — escrever emails, resumir documentos, programação básica, tradução — um QI de 111 é mais que suficiente. A vantagem dos modelos de fronteira aparece nos problemas mais difíceis: demonstrações matemáticas complexas, raciocínio multi-etapa intrincado, questões de pesquisa de ponta.


4. Onde DeepSeek V4 Pro se destaca

Custo-benefício

Esta é a característica definidora de DeepSeek V4 Pro. A 0.44/0.87 por 1M tokens, é de longe o modelo de IA principal mais barato. Para aplicações de alto volume — chatbots servindo milhares de usuários, processamento em massa de documentos, análise de dados em larga escala — a economia é enorme. Você poderia executar 10-30 consultas DeepSeek pelo preço de uma única consulta Claude ou GPT-5.5.

Programação e tarefas técnicas

DeepSeek V4 Pro é particularmente forte em tarefas de programação. DeepSeek investiu pesadamente em dados de treinamento de código, e o modelo performa bem em benchmarks como HumanEval e MBPP. Para desenvolvedores que precisam de um assistente de codificação mas não podem pagar preços de fronteira, DeepSeek V4 Pro é uma excelente escolha.

Disponibilidade de código aberto

Os pesos de DeepSeek V4 Pro estão disponíveis para implantação local. Isso significa que organizações podem executar o modelo em seu próprio hardware, evitando custos de API inteiramente e mantendo dados privados. Para organizações preocupadas com segurança, pesquisadores em ambientes restritos e desenvolvedores que precisam de controle total, isso é uma grande vantagem.

Suporte multilíngue

DeepSeek V4 Pro é treinado extensivamente em chinês e inglês, com forte suporte para outros idiomas principais. Para aplicações em chinês, DeepSeek está entre os melhores modelos disponíveis — às vezes superando modelos ocidentais em tarefas em idioma chinês.

Raciocínio matemático

Embora não no nível do GPT-5.5, DeepSeek V4 Pro é competente em raciocínio matemático. Pode resolver a maioria dos problemas de matemática de nível ensino médio e universitário, e lida com aritmética e álgebra de forma confiável. Para tarefas matemáticas diárias, é mais do que adequado.

Velocidade

DeepSeek V4 Pro é rápido — seu tamanho menor e arquitetura otimizada significam que gera respostas rapidamente. Para aplicações onde latência importa — chat em tempo real, ferramentas interativas, atendimento ao cliente — DeepSeek V4 Pro oferece desempenho responsivo.


5. Onde DeepSeek V4 Pro fica aquém

QI bruto e raciocínio complexo

Com QI de 111, DeepSeek V4 Pro está significativamente abaixo dos modelos de fronteira em tarefas de raciocínio complexo. Para os problemas mais difíceis — matemática competitiva, puzzles de lógica avançados, raciocínio abstrato multi-etapa — os modelos de fronteira são substancialmente melhores. Se sua tarefa requer raciocínio de nível gênio, DeepSeek V4 Pro terá dificuldades onde Claude ou GPT-5.5 teriam sucesso.

Tarefas agentivas

No GDPval-AA v2, DeepSeek V4 Pro está no top 10 mas bem atrás de Claude e GPT-5.5. Para tarefas reais complexas e multi-etapa — escrever grandes projetos de software, gerenciar fluxos de pesquisa, executar planos intrincados — DeepSeek V4 Pro é menos confiável. Pode lidar com tarefas agentivas simples mas tem dificuldades com as complexas.

Taxa de alucinação

DeepSeek V4 Pro tem taxa de alucinação moderada — superior a Claude (35.9%) e Gemini. É mais propenso a afirmar com confiança informações incorretas, particularmente em tópicos nicho ou especializados. Para aplicações onde precisão factual é crítica (pesquisa, direito, medicina), Claude é mais confiável.

Inteligência emocional

O QE (inteligência emocional) de DeepSeek V4 Pro é estimado em ~105 — inferior a todos os modelos de fronteira (Claude ~132, GPT-5.5 ~120, Gemini ~115, Grok ~110). Suas respostas tendem a ser mais mecânicas e menos matizadas na compreensão de emoções humanas. Para apps de terapia, atendimento ao cliente ou interações humanas sensíveis, isso é uma limitação.

Segurança e alinhamento

DeepSeek V4 Pro está sujeito a requisitos regulatórios chineses, o que significa que pode recusar responder a certas questões politicamente sensíveis. Isso é diferente dos filtros de segurança dos modelos ocidentais (que se concentram em conteúdo nocivo) e pode afetar sua utilidade para certos tópicos.


6. DeepSeek V4 Pro vs outros modelos

Modelo Intelligence Index QI Mensa Norway AI IQ est. Alucinação Custo/1M Código aberto
DeepSeek V4 Pro 44.3 ~111 ~111 moderada 0.44/0.87 sim
Claude Opus 4.8 55.7 ~130 ~132 35.9% (mín) 5/25 não
GPT-5.5 54.8 ~145 ~136 moderada 5/30 não
Gemini 3.1 Pro 46.5 141 ~131 baixa 2/12 não
Grok-4.20 top 5 145 ~140 moderada 3/15 não

A imagem: DeepSeek V4 Pro é o campeão econômico — não o mais inteligente, mas de longe o mais acessível. Claude é o profissional capaz — o melhor em tarefas reais e precisão factual. GPT-5.5 é o gênio dos testes — o melhor em matemática e raciocínio visual. Gemini é o campeão de valor — melhor custo-benefício entre modelos de fronteira. Grok-4.20 é o campeão de QI bruto — QI mais alto com personalidade única.

Para usuários que precisam de IA capaz pelo preço mais baixo possível, DeepSeek V4 Pro é a escolha clara. Não igualará os modelos de fronteira nos problemas mais difíceis, mas para 90% das tarefas diárias, é mais do que suficiente — por uma fração do custo.


7. O que isso significa para os humanos?

DeepSeek V4 Pro opera com QI de ~111 — mais inteligente que cerca de 25% dos humanos. Mas:

  • QI não é tudo: um QI de 111 está acima da média e é suficiente para a maioria das tarefas práticas
  • Custo importa mais que QI para a maioria dos usos: para aplicações diárias, a economia de 10x do DeepSeek frequentemente importa mais que a lacuna de 20-35 pontos de QI com os modelos de fronteira
  • Código aberto permite inovação: os pesos abertos do DeepSeek permitem a pesquisadores e desenvolvedores construir soluções personalizadas, ajustar para domínios específicos e executar localmente
  • Conhecimento ≠ compreensão: como todos os modelos de IA, DeepSeek tem acesso a vasto conhecimento mas não "compreende" verdadeiramente como um humano
  • Sem consciência: QI alto não significa consciência. DeepSeek é um sistema sofisticado de reconhecimento de padrões, não um ser pensante
  • Democratização da IA: DeepSeek V4 Pro prova que IA capaz não precisa ser cara — pode ser acessível a todos

A resposta mais honesta: DeepSeek V4 Pro é mais inteligente que um quarto dos humanos em testes cognitivos, e para a maioria dos propósitos práticos, é a escolha mais inteligente — não porque é o mais inteligente, mas porque oferece o maior valor por dólar.

Como seu QI se compara ao DeepSeek V4 Pro? Faça a avaliação profissional de QI da NeuroLab.
Fazer o teste agora →


Conclusão

💡 Pontos-chave
- O QI de DeepSeek V4 Pro é 111 no Mensa Norway — acima da média humana, mais inteligente que ~25% das pessoas.

  • 44.3 no Intelligence Index — top 10 global, mas ~10 pontos atrás dos modelos de fronteira.
  • O custo mais baixo de qualquer modelo principal — 0.44/0.87 por 1M tokens, aproximadamente 10x mais barato que Claude ou GPT-5.5.
  • Código aberto — pesos disponíveis para implantação local, permitindo privacidade e personalização.
  • Melhor para: aplicações sensíveis a custo, programação, tarefas de alto volume, aplicações em chinês, implantação local.
  • Não melhor para: raciocínio complexo (modelos de fronteira ganham), tarefas agentivas (Claude ganha), precisão factual (Claude ganha), inteligência emocional (Claude ganha).
  • A lição: inteligência não é apenas ser o mais inteligente — é ser acessível. DeepSeek V4 Pro democratiza a IA, levando inteligência capaz a todos.