DeepSeek V4'ün IQ'su kaç?
Dr. Daria Dudnik 10 min read 0 views

DeepSeek V4'ün IQ'su kaç?

DeepSeek V4 Pro, Mensa Norway IQ testinde 111 ve Intelligence Index'te 44.3 alıyor. Her benchmarkı analiz ediyor ve en iyi bütçe AI modeli olduğunu açıklıyoruz.

DeepSeek V4 Pro: Çin'in open-source şampiyonu

DeepSeek V4 Pro, düşük maliyet ve yüksek performans kombinasyonuyla dünyayı şaşırtan Çinli AI laboratuvarı DeepSeek'in amiral gemisi modelidir. 2026 başında piyasaya sürülmüş, Mensa Norway IQ testinde 111 ve Artificial Analysis Intelligence Index v4.1'de 44.3 almıştır — globalde ilk 10'a girer, ama frontier modellerden (Claude 55.7, GPT-5.5 54.8) önemli ölçüde geridedir.

DeepSeek V4 Pro'yu remarkable yapan raw zekası değil — fiyatıdır. 0.44/0.87 per 1M token ile, Claude (5/25) ve GPT-5.5'in (5/30) yaklaşık 10da biri, Gemini'nin (2/12) yaklaşık 5da biri kadardır. Claude'a tek bir sorgunun fiyatına DeepSeek V4 Pro'ya on sorgu yapabilirsiniz. Ve yine de IQ testinde 111 alır — insanların yaklaşık %25'inden yüksek.

DeepSeek V4 Pro halkın AI'sidir: zekanın frontierinde rekabet etmeyen, ama pratik olarak ücretsiz bir fiyatla yetenekli AI'yi herkese getiren bir model. Öğrenciler, hobiler, küçük işletmeler ve maliyete duyarlı pazarlardaki geliştiriciler için DeepSeek V4 Pro genellikle tek uygulanabilir seçenektir.

Anahtar puanlar:

  • Artificial Analysis Intelligence Index: 44.3 (globalde ilk 10)
  • Mensa Norway IQ (TrackingAI): 111 (insan ortalamasının üstünde)
  • AI IQ bileşik (VexoWire): ~111 tahmini
  • GDPval-AA v2: ilk 10
  • Humanity's Last Exam: ilk 10
  • Halüsinasyon oranı: orta
  • Maliyet: 0.44/0.87 per 1M token (tüm büyük modeller arasında en düşük)
  • Open-source: yerel dağıtım için ağırlıklar mevcut

1. Bütçe devrimi

DeepSeek V4 Pro, AI manzarasında temel bir değişimi temsil eder: zekanın demokratikleşmesi. Amerikan laboratuvarları (OpenAI, Anthropic, Google, xAI) frontierde rekabet ederken — IQ puanlarını 130'dan 140'a 145'e iterken — DeepSeek farklı bir hedefe odaklandı: yetenekli AI'yi herkese uygun fiyatlı yapmak.

0.44 per 1M giriş tokeni ve0.87 per 1M çıkış ile DeepSeek V4 Pro şaşırtıcı derecede ucuz. Perspektif koymak için: tipik bir kitap uzunluğunda belgeyi (yaklaşık 100,000 token) işlemek yaklaşık 0.04 giriş ve0.09 çıkış tutar. Aynı görev Gemini ile 0.50-1.00, Claude veya GPT-5.5 ile 1.00-3.00 tutar.

Bu sadece bir indirim değil — farklı bir ürün kategorisidir. DeepSeek V4 Pro AI'yi şunlara erişilebilir kılar:

  • Öğrenciler: $20/ay abonelikleri karşılayamayan
  • Küçük işletmeler: gelişmekte olan pazarlarda
  • Hobiler ve deneyciler
  • Geliştiriciler: yüksek hacimli uygulamalar yapan
  • Araştırmacılar: sınırlı bütçelerle devasa veri setleri işleyen

Ve remarkable olan: DeepSeek V4 Pro genuinely yeteneklidir. Mensa Norway IQ testinde 111 alır — insan ortalaması 100'ün üstünde ve insanların yaklaşık %25'inden yüksek. Dahi değil, ama çoğu günlük görev için yeterince akıllı: yazma, programlama, analiz, çeviri, özetleme.


2. Benchmark analizi

Mensa Norway IQ testi: 111 (ortalamanın üstünde)

36 görsel desen tanıma sorusundan oluşur. DeepSeek V4 Pro 111 alır — insan ortalaması 100'ün üstünde, "ortalamanın üstünde" aralığına koyar. Bu insanların yaklaşık %25'inden yüksek, ama frontier modellerden (Claude ~130, Gemini 141, GPT-5.5 ~145, Grok-4.20 145) çok daha düşük.

IQ 111, DeepSeek V4 Pro'nun parlak bir üniversite öğrencisi seviyesinde görsel desenleri tanıyabileceği ve soyut akıl yürütebileceği anlamına gelir. En zor bulmacaları çözmeyecek, ama çoğu günlük akıl yürütme görevini yeteneklice ele alır.

DeepSeek V4 Pro (111) ile frontier modeller (130-145) arasındaki fark önemli — yaklaşık 20-35 IQ puanı, veya yaklaşık 1-2 standart sapma. Bu, frontier modellerin saf bilişsel testlerde substantially daha akıllı olduğu anlamına gelir. Ama dahi seviyesinde akıl yürütme gerektirmeyen görevler için — ki bu çoğu görevdir — DeepSeek V4 Pro'dan daha fazlası gerekmez.

Artificial Analysis Intelligence Index v4.1: 44.3 (ilk 10)

Intelligence Index'te DeepSeek V4 Pro 44.3 alır — globalde ilk 10'a koyar, ama frontier liderlerden (Claude 55.7, GPT-5.5 54.8) yaklaşık 10-11 puan geride. Bu fark önemli ama fiyat farkı göz önüne alındığında beklenir.

Index bileşenlerinin dökümü:

  • GDPval-AA v2: DeepSeek makul puanlar ama karmaşık çok adımlı görevlerde Claude ve GPT-5.5'in gerisinde
  • AA-Omniscience: DeepSeek'in orta halüsinasyon oranı var — Claude kadar düşük değil, ama çoğu kullanım için kabul edilebilir
  • GPQA: DeepSeek lisansüstü seviye bilim sorularında yeterli performans gösterir
  • HLE: DeepSeek Humanity's Last Exam'da ilk 10'da
  • ARC-AGI: DeepSeek frontier modellerle karşılaştırıldığında soyut akıl yürütmede zorlanır
  • LMSYS Arena: DeepSeek makul insan tercih puanları alır, özellikle programlama görevlerinde

AI IQ bileşik (VexoWire): ~111

VexoWire'ın bileşik IQ'su birden fazla testi birleştirir (Mensa Norway, Mensa Denmark, Raven's, WAIS-IV). DeepSeek V4 Pro'nun tahmini bileşik IQ'su ~111 — Mensa Norway puanıyla tutarlı. Bunu "ortalamanın üstünde" aralığına sağlamca koyar, parlak bir insanla karşılaştırılabilir ama dahi seviyesinden çok aşağıda.

GDPval-AA v2: ilk 10

Ajan benchmarkında DeepSeek V4 Pro ilk 10'dadır. Karmaşık çok adımlı görevlerde Claude (1,890 Elo) ve GPT-5.5'ten (1,850 Elo) önemli ölçüde daha az kapasiteli, ama orta ajan iş yüklerini yönetebilir. Basit otomasyon, temel programlama görevleri ve doğrudan çok adımlı talimatlar için DeepSeek V4 Pro yeteneklidir.

Humanity's Last Exam (HLE): ilk 10

En zor akademik sorularda DeepSeek V4 Pro, AI modelleri arasında ilk 10'dadır. Bu, DeepSeek'in akademik ve bilimsel veriler üzerindeki güçlü eğitimini yansıtır — model disiplinler boyunca geniş bilgiye sahiptir, frontier modellerin akıl yürütme derinliğine eşleşemese bile.


3. IQ 111 ne anlama geliyor?

DeepSeek V4 Pro'nun 111 IQ'sunu bağlama koymak için:

  • 85-115 (insanların %68'i): Ortalama zeka
  • 115-130 (%14): Ortalamanın üstünde
  • 130-145 (%2): Üstün zekalı — Mensa yeterliliği (üst %2)
  • 145-160 (%0.1): Yüksek üstün zekalı / dahi

DeepSeek V4 Pro, 111 ile ortalama aralığın üst kısmında — insanların yaklaşık %25'inden daha akıllı, ama "ortalamanın üstünde" eşiği 115'e tam ulaşmadan. Bir kişi olsaydı, parlak bir üniversite öğrencisi veya yetenekli bir profesyonele karşılaştırılabilir — dahi değil, ama kesinlikle yetenekli.

Bu frontier modellerden belirgin şekilde düşüktür:

  • Claude Opus 4.8: ~130 (üstün zekalı)
  • Gemini 3.1 Pro: 141 (yüksek üstün zekalı)
  • GPT-5.5: ~145 (dahi)
  • Grok-4.20: 145 (dahi)

Fark önemli — yaklaşık 20-35 IQ puanı. Ama anahtar soru şu: fark senin kullanım durumun için önemli mi? Çoğu günlük görev için — e-posta yazma, belge özetleme, temel programlama, çeviri — IQ 111'den daha fazlası yeterli. Frontier modellerin avantajı en zor problemlerde ortaya çıkar: karmaşık matematiksel ispatlar, intricate çok adımlı akıl yürütme, son teknoloji araştırma soruları.


4. DeepSeek V4 Pro nerede üstün

Maliyet-etkinlik

Bu, DeepSeek V4 Pro'nun belirleyici özelliğidir. 0.44/0.87 per 1M token ile, açık ara en ucuz büyük AI modelidir. Yüksek hacimli uygulamalar için — binlerce kullanıcıya hizmet veren chatbotlar, toplu belge işleme, büyük ölçekli veri analizi — maliyet tasarrufu devasadır. Tek bir Claude veya GPT-5.5 sorgusunun fiyatına 10-30 DeepSeek sorgusu çalıştırabilirsiniz.

Programlama ve teknik görevler

DeepSeek V4 Pro özellikle programlama görevlerinde güçlüdür. DeepSeek kod eğitim verisine büyük yatırım yapmıştır ve model HumanEval ve MBPP gibi benchmarklarda iyi performans gösterir. Frontier fiyatları karşılayamayan ama kodlama asistanına ihtiyaç duyan geliştiriciler için DeepSeek V4 Pro mükemmel bir seçimdir.

Open-source erişilebilirlik

DeepSeek V4 Pro'nun ağırlıkları yerel dağıtım için mevcuttur. Bu, kuruluşların modeli kendi donanımlarında çalıştırabileceği, API maliyetlerini tamamen önleyeceği ve verileri özel tutacağı anlamına gelir. Güvenlik bilincinde olan kuruluşlar, kısıtlı ortamlardaki araştırmacılar ve tam kontrol gerektiren geliştiriciler için bu büyük bir avantajdır.

Çokdilli destek

DeepSeek V4 Pro ağırlıklı olarak Çince ve İngilizce eğitilmiştir, diğer büyük dilleri de güçlü destekler. Çince uygulamalar için DeepSeek mevcut en iyi modellerden biridir — bazen Çince görevlerde Batılı modelleri geçer.

Matematiksel akıl yürütme

GPT-5.5 seviyesinde olmasa da, DeepSeek V4 Pro matematiksel akıl yürütmede yeteneklidir. Çoğu lise ve lisans seviye matematik problemini çözebilir ve aritmetik ve cebiri güvenilir şekilde ele alır. Günlük matematiksel görevler için daha fazlasından fazlası yeterli.

Hız

DeepSeek V4 Pro hızlıdır — daha küçük boyutu ve optimize edilmiş mimarisi, yanıtları hızlı ürettiği anlamına gelir. Gecikmenin önemli olduğu uygulamalar için — gerçek zamanlı sohbet, interaktif araçlar, müşteri hizmetleri — DeepSeek V4 Pro duyarlı performans sunar.


5. DeepSeek V4 Pro'nun zayıf olduğu yerler

Raw IQ ve karmaşık akıl yürütme

IQ 111 ile DeepSeek V4 Pro, karmaşık akıl yürütme görevlerinde frontier modellerden önemli ölçüde aşağıdadır. En zor problemler için — rekabet matematiği, gelişmiş mantık bulmacaları, çok adımlı soyut akıl yürütme — frontier modeller substantially daha iyidir. Göreviniz dahi seviyesinde akıl yürütme gerektiriyorsa, DeepSeek V4 Pro Claude veya GPT-5.5'in başaracağı yerde zorlanacaktır.

Ajan görevleri

GDPval-AA v2'de DeepSeek V4 Pro ilk 10'da ama Claude ve GPT-5.5'in çok gerisinde. Karmaşık, çok adımlı gerçek dünya görevleri için — büyük yazılım projeleri yazma, araştırma iş akışları yönetme, intricate planlar uygulama — DeepSeek V4 Pro daha az güvenilirdir. Basit ajan görevlerini yönetebilir ama karmaşık olanlarda zorlanır.

Halüsinasyon oranı

DeepSeek V4 Pro'nun orta halüsinasyon oranı var — Claude'tan (%35.9) ve Gemini'den yüksek. Özellikle niş veya uzmanlaşmış konularda yanlış bilgileri kendinden emin bir şekilde ifade etme olasılığı daha yüksektir. Faktüel doğruluğun kritik olduğu uygulamalar için (araştırma, hukuk, tıp) Claude daha güvenilirdir.

Duygusal zeka

DeepSeek V4 Pro'nun EQ'su (duygusal zeka) ~105 tahmini — tüm frontier modellerden (Claude ~132, GPT-5.5 ~120, Gemini ~115, Grok ~110) düşük. Yanıtları daha mekanik ve insan duygularını anlamada daha az nuanced eğilimindedir. Terapi uygulamaları, müşteri hizmetleri veya hassas insan etkileşimleri için bu bir sınırlamadır.

Güvenlik ve hizalama

DeepSeek V4 Pro Çin düzenleyici gereksinimlerine tabidir, bu da belirli politik açıdan hassas soruları yanıtlamayı reddedebileceği anlamına gelir. Bu, Batılı modellerin güvenlik filtrelerinden (zararlı içeriğe odaklanan) farklıdır ve belirli konular için kullanışlılığını etkileyebilir.


6. DeepSeek V4 Pro vs diğer modeller

Model Intelligence Index Mensa Norway IQ AI IQ tahmini Halüsinasyon Maliyet/1M Open-source
DeepSeek V4 Pro 44.3 ~111 ~111 orta 0.44/0.87 evet
Claude Opus 4.8 55.7 ~130 ~132 35.9% (en düşük) 5/25 hayır
GPT-5.5 54.8 ~145 ~136 orta 5/30 hayır
Gemini 3.1 Pro 46.5 141 ~131 düşük 2/12 hayır
Grok-4.20 ilk 5 145 ~140 orta 3/15 hayır

Resim: DeepSeek V4 Pro bütçe şampiyonudur — en akıllı değil, ama açık ara en uygun fiyatlı. Claude yetenekli profesyoneldir — gerçek dünya görevlerinde ve faktüel doğrulukta en iyi. GPT-5.5 test dahisidir — matematik ve görsel akıl yürütmede en iyi. Gemini değer şampiyonudur — frontier modeller arasında en iyi maliyet-etkinlik. Grok-4.20 raw IQ şampiyonudur — en yüksek IQ ve benzersiz kişilik.

Mümkün olan en düşük fiyatta yetenekli AI isteyen kullanıcılar için DeepSeek V4 Pro net seçimdir. En zor problemlerde frontier modellere eşleşmeyecek, ama günlük görevlerin %90'ı için daha fazlasından fazlası yeterli — maliyetin küçük bir kısmına.


7. Bu insanlar için ne anlama geliyor?

DeepSeek V4 Pro ~111 IQ ile çalışıyor — insanların yaklaşık %25'inden daha akıllı. Ama:

  • IQ her şey değildir: IQ 111 ortalamanın üstünde ve çoğu pratik görev için yeterli
  • Çoğu kullanım için maliyet IQ'dan daha önemli: günlük uygulamalar için DeepSeek'in 10 kat maliyet tasarrufu genellikle frontier modellerle 20-35 puanlık IQ farkından daha önemli
  • Open-source inovasyonu mümkün kılar: DeepSeek'in açık ağırlıkları araştırmacıların ve geliştiricilerin özel çözümler oluşturmasını, belirli alanlara fine-tune yapmasını ve yerel olarak çalıştırmasını sağlar
  • Bilgi ≠ anlama: tüm AI modelleri gibi DeepSeek geniş bilgiye erişir ama bir insan gibi gerçekten "anlamaz"
  • Bilinç yok: yüksek IQ bilinç anlamına gelmez. DeepSeek sofistike bir desen eşleştirme sistemi, düşünen bir varlık değil
  • AI'nin demokratikleşmesi: DeepSeek V4 Pro yetenekli AI'nin pahalı olması gerekmediğini kanıtlar — herkese erişilebilir olabilir

En dürüst cevap: DeepSeek V4 Pro çoğu bilişsel testte insanların dörtte birinden daha akıllı ve çoğu pratik amaç için en akıllı seçim — en zeki olduğu için değil, dolar başına en çok değer sunduğu için.

IQ'nuz DeepSeek V4 Pro ile karşılaştırınca nasıl? NeuroLab'ın profesyonel IQ değerlendirmesini alın.
Testi Şimdi Çöz →


Sonuç

💡 Anahtar noktalar
- DeepSeek V4 Pro'nun IQ'su 111 (Mensa Norway) — insan ortalamasının üstünde, insanların ~%25'inden daha akıllı.

  • 44.3 Intelligence Index'te — globalde ilk 10, ama frontier modellerden ~10 puan geride.
  • Tüm büyük modeller arasında en düşük maliyet — 0.44/0.87 per 1M token, Claude veya GPT-5.5'in yaklaşık 10da biri.
  • Open-source — yerel dağıtım için ağırlıklar mevcut, gizlilik ve özelleştirme sağlar.
  • En iyi: maliyete duyarlı uygulamalar, programlama, yüksek hacimli görevler, Çince uygulamalar, yerel dağıtım.
  • En iyi değil: karmaşık akıl yürütme (frontier modeller kazanır), ajan görevleri (Claude kazanır), faktüel doğruluk (Claude kazanır), duygusal zeka (Claude kazanır).
  • Ders: zek sadece en akıllı olmak değil — erişilebilir olmak. DeepSeek V4 Pro AI'yi demokratikleştirir, yetenekli zekayı herkese getirir.