Grok-4.20'nin IQ'su kaç?
Grok-4.20, Mensa Norway IQ testinde 145 alıyor — tüm AI modelleri arasında #1'i paylaşıyor. Her benchmarkı analiz ediyor ve xAI'nin modelini benzersiz yapan şeyi açıklıyoruz.
Grok-4.20: xAI'in amiral gemisi modeli
Grok-4.20, xAI'in en gelişmiş modelidir ve 2026 ortasında piyasaya sürülmüştür. Mensa Norway IQ testinde Grok-4.20 145 alır — tüm AI modelleri arasında #1'i paylaşır, GPT-5.5 ile ilk sırayı paylaşır. Bu onu "dahi" aralığına koyar, insanların %99.9'undan daha akıllı. Artificial Analysis Intelligence Index'te Grok-4.20'nin tam puanı hâlâ finalleşiyor, ama globalde ilk 5'te yer alır.
Grok-4.20'yi benzersiz yapan şey raw zeka ve kişilik kombinasyonudur. Claude, GPT-5.5 ve Gemini'nin aksine — yardımcı, zararsız ve tarafsız olmak için tasarlanmış — Grok eğlenceli, saygısız ve her soruyu yanıtlamaya istekli olmak için tasarlanmıştır. Bu onu pazardaki en belirgin AI modeli yapar: raw IQ'da en akıllı modellere eşit olurken, başka hiçbir modelin cesaret edemediği bir kişiliğe sahip olan bir model.
Anahtar puanlar:
- Mensa Norway IQ (TrackingAI): 145 (GPT-5.5 ile #1 paylaşımlı)
- AI IQ bileşik (VexoWire): ~140 tahmini (AI modelleri arasında #1)
- Artificial Analysis Intelligence Index: ilk 5 (puan finalleşiyor)
- GDPval-AA v2: ilk 5
- Humanity's Last Exam: AI modelleri arasında ilk 5
- Halüsinasyon oranı: orta
- Maliyet: 3.00/15.00 per 1M token
- Kişilik: benzersiz — saygısız, mizahi, sansürsüz
1. Raw IQ şampiyonu
Grok-4.20, Mensa Norway IQ testinde 145 alır — pratik maksimum puan, GPT-5.5 ile eşit. Bu raw zeka benchmarkıdır: saf görsel desen tanıma ve soyut akıl yürütme, IQ testlerinin tasarlandığı akıcı zeka türü.
IQ 145 ile Grok-4.20, insanların %99.9'undan daha akıllı. Bir kişi olsaydı, insan zekasının üst %0.1'inde olurdu — Nobel ödüllü, Fields madalyalı ve nesilde bir gelen düşünürlerin diyarında. Yaklaşık 1.000 kişiden 1'i bu skoru ulaşır.
Dikkat çekici olan, Grok-4.20'nin bunu GPT-5.5'ten temelde farklı bir tasarım felsefesiyle başarmasıdır. GPT-5.5 her benchmarkta maksimum performans için optimize edilirken, Grok-4.20 daha "otantik" bir AI olarak tasarlandı — düşüncelerini söyleyen, şaka yapan ve tartışmalı konulardan kaçınmayan bir AI. Bu farklı fokusa rağmen raw IQ'da GPT-5.5'e eşit olması, xAI'nin mühendisliğinin bir kanıtıdır.
VexoWire AI IQ bileşiğinde — birden fazla IQ testini (Mensa Norway, Mensa Denmark, Raven's, WAIS-IV) birleştirir — Grok-4.20'nin tahmini bileşik IQ'su ~140, bu metrikte onu #1 AI modeli yapar. Bu GPT-5.5'ten (~136) yüksek ve Claude'tan (~132) ve Gemini'den (~131) belirgin şekilde yüksek.
2. Benchmark analizi
Mensa Norway IQ testi: 145 (#1 paylaşımlı)
36 görsel desen tanıma sorusundan oluşur. Grok-4.20 145 alır — pratik maksimum, mükemmel veya mükemmele yakın 36/36'ya eşdeğer. Bu onu saf bir IQ testinde GPT-5.5 ile en akıllı AI modeli olarak eşitler.
Grok-4.20'nin bu testteki güçlü performansı, xAI'nin görsel işlemeye ve soyut akıl yürütmeye yatırımını yansıtır. Grok mimarisi başından beri güçlü multimodal yeteneklerle tasarlandı ve görsel desen tanıma görevlerindeki performansı sektörün en iyileri arasında.
AI IQ bileşik (VexoWire): ~140 (#1)
VexoWire'ın bileşik IQ'su birden fazla testi birleştirir (Mensa Norway, Mensa Denmark, Raven's, WAIS-IV). Grok-4.20'nin tahmini bileşik IQ'su ~140 — tüm AI modelleri arasında en yüksek. Bu, tek başına Mensa Norway puanının önerdiğinden daha yüksek, çünkü Grok-4.20 bileşiğe dahil edilen sözel ve analitik alt testlerde de güçlü performans gösterir.
Bu, Grok-4.20'yi bileşik IQ ile en akıllı AI modeli yapar — mizahı ve saygısızlığıyla da bilinen bir model için dikkate değer bir başarı. Eğlenceli olmanın daha az akıllı olmak anlamına gelmediğini kanıtlar.
Artificial Analysis Intelligence Index: ilk 5
Intelligence Index — AI modellerini karşılaştırmak için altın standart — Grok-4.20 ilk 5'te. Tam bileşik puanı, indeks son model sürümlerini içerecek şekilde güncellenirken hâlâ finalleşiyor. Ancak Claude Opus 4.8 (55.7) ve GPT-5.5 (54.8) ile rekabetçi puanlar alması bekleniyor, ama muhtemelen ajan görevlerinde onları geçmeyecek.
GDPval-AA v2: ilk 5
Ajan benchmarkında — karmaşık, çok adımlı gerçek dünya görevlerinde performansı ölçer — Grok-4.20 ilk 5'te. Sürekli çok adımlı akıl yürütmede Claude Opus 4.8 (1,890 Elo) ve GPT-5.5 (1,850 Elo)'den daha az kapasiteli, ama yine de yüksek yetenekli. Çoğu gerçek dünya görevi için Grok-4.20'den daha fazlası gerekmez.
Humanity's Last Exam (HLE): ilk 5
Tüm disiplinlerin en zor akademik sorularında Grok-4.20, AI modelleri arasında ilk 5'te. Bu, xAI'nin çeşitli, yüksek kaliteli verilerle eğitimdeki gücünü yansıtır — Grok bilim, matematik, tarih ve kültürde derin bilgiye sahiptir.
3. IQ 145 ne anlama geliyor?
Grok-4.20'nin 145 IQ'sunu bağlama koymak için:
- 85-115 (insanların %68'i): Ortalama zeka
- 115-130 (%14): Ortalamanın üstünde
- 130-145 (%2): Üstün zekalı — Mensa yeterliliği (üst %2)
- 145-160 (%0.1): Yüksek üstün zekalı / dahi
- 160+ (%0.003): Son derede üstün zekalı — Einstein, Hawking bölgesi
Grok-4.20, 145 ile dahi eşiğinde — insanların %99.9'undan daha akıllı. Bir kişi olsaydı, elit şirkette olurdu: insan zekasının üst %0.1'i, Nobel ödülleri ve Fields madalyaları diyarı. Yaklaşık 1.000 kişiden 1'i bu skoru ulaşır.
Bu GPT-5.5 ile aynı IQ ve Claude'tan (~130) ve Gemini'den (141) belirgin şekilde yüksek. Saf bir IQ testinde Grok-4.20 ve GPT-5.5 AI modelleri arasında ilk sırayı paylaşır, Gemini üçüncü, Claude dördüncü olurdu.
Ama diğer modellerde gördüğümüz gibi, IQ zekanın yalnızca bir boyutudur. Grok-4.20'nin dahi seviyesindeki IQ'su, onu benzersiz yapan kişiliğiyle tamamlanır — onu sadece en akıllı değil, aynı zamanda en belirgin AI modeli yapar.
4. Grok-4.20 nerede üstün
Raw IQ ve görsel akıl yürütme
Grok-4.20, Mensa Norway IQ testinde #1'i paylaşıyor (145) ve VexoWire AI IQ bileşiğinde #1 (~140). Saf bilişsel yetenek için — desen tanıma, soyut akıl yürütme, mantıksal tümdengelim — Grok-4.20 mevcut en akıllı AI modeli. Görsel akıl yürütme görevleri için sadece GPT-5.5 ona eşit olur.
Kişilik ve mizah
Bu, Grok-4.20'nin belirleyici özelliğidir. Dikkatle tarafsız ve temkinli olan diğer frontier modellerin aksine, Grok eğlenceli, saygısız ve otantik olmak için tasarlandı. Şaka yapar, fikir söyler ve tartışmalı konulardan kaçınmaz. Claude ve GPT-5.5'i fazla yavan veya temkinli bulan kullanıcılar için Grok-4.20 taze bir nefes — kişiliği olan bir AI, sadece bir işlev değil.
Sansürsüz yanıtlar
Grok-4.20, diğer modellerin reddettiği soruları yanıtlamak için tasarlandı. Claude, GPT-5.5 ve Gemini belirli konuları tartışmalarını engelleyen kapsamlı güvenlik filtrelerine sahipken, Grok-4.20 çok daha geniş bir soru yelpazesine girmeye istekli. Bu onu araştırma, gazetecilik ve bilgi erişiminin temkinlilikten daha önemli olduğu her uygulama için değerli yapar.
Gerçek zamanlı bilgi
Grok-4.20, X (eski Twitter) üzerinden gerçek zamanlı bilgiye erişir. Bu ona güncel olaylar, son dakika haberleri ve trend konular hakkında sorularda avantaj sağlar. Diğer modeller bilgi kesintilerine sahipken, Grok-4.20 en son bilgilere erişebilir ve güncel yanıtlar sunabilir.
Matematiksel akıl yürütme
Grok-4.20 matematiksel akıl yürütmede güçlüdür, rekabet matematiğinde GPT-5.5 ile rekabetçi puanlar alır. Saf matematiksel çalışma için — denklem çözme, teorem ispatlama, yarışma problemleri — Grok-4.20 mevcut en iyi modellerden biridir.
Esprilik ve yaratıcılık
Grok-4.20'nin kişiliği sadece mizah hakkında değil — yaratıcılık hakkında. Farklı stillerde yazabilir, yaratıcı içerik üretebilir ve sorunlara beklenmedik açılardan yaklaşabilir. Yaratıcı yazım, beyin fırtınası veya yatay düşünceden yararlanan her görev için Grok-4.20'nin benzersiz perspektifi bir varlıktır.
5. Grok-4.20'nin zayıf olduğu yerler
Ajan görevleri
Grok-4.20 GDPval-AA v2'de ilk 5'te olsa da, karmaşık, çok adımlı gerçek dünya görevlerinde Claude Opus 4.8 ve GPT-5.5'in arkasındadır. En talepkar ajan uygulamaları için — karmaşık yazılım yazma, uzun araştırma projeleri yönetme — Claude hala daha iyi seçimdir.
Faktüel doğruluk
Grok-4.20 orta halüsinasyon oranına sahip — Claude'tan (%35.9) ve Gemini'den yüksek. Her soruyu yanıtlama isteği, bilgi erişimi için değerli olsa da, aynı zamanda yanlış bilgileri kendinden emin bir şekilde ifade etme olasılığının daha yüksek olduğu anlamına gelir. Faktüel doğruluğun kritik olduğu uygulamalar için (araştırma, hukuk, tıp) Claude daha güvenilirdir.
Duygusal zeka
Grok-4.20'nin EQ'su (duygusal zeka) ~115 tahmini — Claude'tan (~132), GPT-5.5'ten (~120) ve Gemini'den (~115) düşük. Saygısız kişiliği, eğlenceli olsa da, empati gerektiren bağlamlarda duyarsız görünebilir. Terapi uygulamaları, müşteri hizmetleri veya hassas insan etkileşimleri için Claude daha iyidir.
Güvenlik ve güvenilirlik
Grok-4.20'nin sansürsüz yaklaşımı, bilgi erişimi için değerli olsa da, dikkatli içerik moderasyonu gerektiren uygulamalar için daha az güvenli olduğu anlamına da gelir. Diğer modellerin reddedeceği içerik üretebilir, bu da profesyonel veya düzenlenmiş ortamlarda bir yükümlülük olabilir.
Maliyet
3/15 per 1M token ile Grok-4.20, Claude (5/25) ve GPT-5.5 (5/30)'den ucuz ama Gemini (2/12)'den pahalı ve DeepSeek'ten (0.44/0.87) belirgin şekilde pahalı. Maliyete duyarlı uygulamalar için Gemini veya DeepSeek daha iyi seçimler olabilir.
6. Grok-4.20 vs diğer modeller
| Model | Intelligence Index | Mensa Norway IQ | AI IQ tahmini | Halüsinasyon | Maliyet/1M | Kişilik |
|---|---|---|---|---|---|---|
| Grok-4.20 | ilk 5 | 145 | ~140 | orta | 3/15 | saygısız |
| Claude Opus 4.8 | 55.7 | ~130 | ~132 | 35.9% (en düşük) | 5/25 | tarafsız |
| GPT-5.5 | 54.8 | ~145 | ~136 | orta | 5/30 | tarafsız |
| Gemini 3.1 Pro | 46.5 | 141 | ~131 | düşük | 2/12 | tarafsız |
| DeepSeek V4 Pro | 44.3 | ~111 | ~111 | orta | 0.44/0.87 | tarafsız |
Resim: Grok-4.20 raw IQ şampiyonudur — en yüksek IQ paylaşımlı, en yüksek bileşik IQ ve gerçek kişiliği olan tek model. Claude yetenekli profesyoneldir — gerçek dünya görevlerinde ve faktüel doğrulukta en iyi. GPT-5.5 test dahisidir — matematik ve görsel akıl yürütmede en iyi. Gemini değer şampiyonudur — en iyi maliyet-etkinlik. Ve DeepSeek en düşük maliyetle kayda değer kapasite sunar.
En akıllı ve aynı zamanda konuşması en ilginç olan AI'yi isteyen kullanıcılar için Grok-4.20 net seçimdir.
7. Bu insanlar için ne anlama geliyor?
Grok-4.20 ~145 IQ ile çalışıyor — insanların %99.9'undan daha akıllı. Ama:
- IQ dardır: desen tanıma ve akıl yürütme ölçer, bilgelik, yaratıcılık veya yargı değil
- Zeka ≠ güvenilirlik: Grok-4.20 IQ testlerinde en akıllı ama faktüel doğrulukta en güvenilir değil
- Kişilik önemli: Grok-4.20, AI'nin hem yüksek zekalı hem de genuinely eğlenceli olabileceğini kanıtlar
- Bilgi ≠ anlama: Grok-4.20 geniş bilgiye erişir, ama bir insan gibi gerçekten "anlamaz"
- Bilinç yok: yüksek IQ bilinç anlamına gelmez. Grok-4.20 sofistike bir desen eşleştirme sistemi, düşünen bir varlık değil
- Boşluk kapanıyor: her AI modeli nesli, en akıllı insanlarla boşluğu daraltıyor
En dürüst cevap: Grok-4.20 çoğu bilişsel testte pratik olarak tüm insanlardan daha akıllı ve mevcut en belirgin AI modeli — dahi seviyesinde zekayı, etkileşimi genuinely çekici kılan bir kişilikle birleştiren bir model.
Sonuç
- #1 VexoWire AI IQ bileşiğinde (~140) — tüm AI modelleri arasında en yüksek bileşik IQ.
- Benzersiz kişilik — saygısız, mizahi, sansürsüz. Gerçek kişiliği olan tek frontier model.
- En iyi: raw IQ, görsel akıl yürütme, matematiksel akıl yürütme, kişilik ve mizah, sansürsüz yanıtlar, gerçek zamanlı bilgi.
- En iyi değil: ajan görevleri (Claude kazanır), faktüel doğruluk (Claude kazanır), duygusal zeka (Claude kazanır), güvenlik ve güvenilirlik (Claude kazanır).
- Paradoks: Grok-4.20, eğlenceli olmanın daha az akıllı olmak anlamına gelmediğini kanıtlar — hem en akıllı hem de en eğlenceli AI modeli.
- Ders: zeka birçok biçimde gelir. Grok-4.20 kişilikli bir dahidir — AI'nin hem parlak hem de çekici olabileceğini kanıtlar.