Quel est le QI de Gemini 3.1 Pro ?
Gemini 3.1 Pro obtient 141 au test de QI Mensa Norway et 46,5 à l'Intelligence Index. Nous analysons chaque benchmark et expliquons pourquoi c'est le modèle frontier le plus rentable.
Gemini 3.1 Pro : le modèle flagship de Google DeepMind
Gemini 3.1 Pro est le modèle le plus avancé de Google DeepMind, publié mi-2026. Il obtient 46,5 sur l'Artificial Analysis Intelligence Index v4.1, se classant #3 mondialement — derrière Claude Opus 4.8 (55,7) et GPT-5.5 (54,8). Mais au test de QI Mensa Norway, Gemini 3.1 Pro obtient 141 — supérieur à Claude (~130) et presque à égalité avec GPT-5.5 (145) et Grok-4.20 (145).
Ce qui rend Gemini 3.1 Pro unique, ce n'est pas seulement son intelligence — c'est sa proposition de valeur. À 2/12 par 1M tokens, il coûte moins de la moitié du prix de Claude ou GPT-5.5, tout en offrant des performances quasi-frontier. Pour de nombreuses applications, Gemini 3.1 Pro est le choix le plus intelligent — non pas parce qu'il est le modèle le plus intelligent, mais parce qu'il offre le plus d'intelligence par dollar.
Scores clés :
- Artificial Analysis Intelligence Index : 46,5 (#3 mondial)
- QI Mensa Norway (TrackingAI) : 141 (niveau quasi-génie)
- AI IQ composite (VexoWire) : ~131 estimé
- GDPval-AA v2 : élevé (top 3)
- Humanity's Last Exam : top 3 parmi les modèles d'IA
- Taux d'hallucination : faible
- Coût : 2/12 par 1M tokens (meilleur rapport qualité-prix parmi les modèles frontier)
1. Le champion du rapport qualité-prix de l'IA frontier
Gemini 3.1 Pro occupe une position unique dans le paysage de l'IA. Il n'est pas le modèle #1 sur un seul benchmark — Claude mène sur les tâches agentiques, GPT-5.5 sur le raisonnement visuel et mathématique, Grok sur le QI brut. Mais Gemini 3.1 Pro est le modèle qui offre le plus de capacité pour le moins d'argent.
À 2par 1M tokens d'entrée et 12 par 1M de sortie, Gemini 3.1 Pro coûte environ 40% du prix de Claude ou GPT-5.5. Pourtant, il obtient 141 au QI Mensa Norway — à 4 points des leaders. Son score à l'Intelligence Index de 46,5 est inférieur à Claude (55,7) et GPT-5.5 (54,8), mais pour de nombreuses applications réelles, la différence est négligeable.
Pensez-y ainsi : si Claude et GPT-5.5 sont des voitures de sport de luxe — incroyablement performantes mais chères à entretenir — Gemini 3.1 Pro est une berline haute performance. Il ne gagnera pas chaque course, mais il offre 90% des performances à 40% du coût. Pour les entreprises, développeurs et utilisateurs needing une intelligence de niveau frontier sans prix frontier, Gemini 3.1 Pro est le choix naturel.
2. Analyse des benchmarks
Test QI Mensa Norway : 141 (quasi-génie)
Consiste en 36 questions de reconnaissance de motifs visuels. Gemini 3.1 Pro obtient 141 — se plaçant dans la gamme « hautement surdoué », le top 0,2% de l'intelligence humaine. C'est significativement supérieur à Claude Opus 4.8 (~130) et à seulement 4 points derrière les leaders GPT-5.5 et Grok-4.20 (tous deux ~145).
La forte performance de Gemini sur ce test reflète l'investissement de Google DeepMind dans le traitement visuel. L'architecture Gemini a été conçue dès le départ pour être multimodale — traitant texte, images, vidéo et audio nativement. Cela lui donne un avantage naturel sur les tâches de reconnaissance de motifs visuels, qui constituent le cœur du test Mensa Norway.
Avec un QI de 141, Gemini 3.1 Pro est plus intelligent que 99,8% des humains. Si c'était une personne, elle se qualifierait facilement pour Mensa et serait dans le top 0,2% de l'intelligence humaine. Seulement environ 1 personne sur 500 atteint ce score.
Artificial Analysis Intelligence Index v4.1 : 46,5 (#3)
L'Intelligence Index est le gold standard pour comparer les modèles d'IA. Le score composite de Gemini 3.1 Pro de 46,5 le place au #3 mondial. L'écart avec Claude (55,7) et GPT-5.5 (54,8) est significatif — environ 8-9 points, soit environ 15-20% inférieur. Mais cet écart se concentre sur des domaines spécifiques :
- GDPval-AA v2 : Gemini performe bien mais en dessous de Claude et GPT-5.5 sur les tâches complexes multi-étapes
- AA-Omniscience : Gemini a un faible taux d'hallucination — meilleur que GPT-5.5, proche de Claude
- GPQA : Gemini performe fort sur les questions scientifiques de postgraduate
- HLE : Gemini se classe dans le top 3 à Humanity's Last Exam
- ARC-AGI : Gemini excelle en raisonnement abstrait, bénéficiant de son architecture multimodale
- LMSYS Arena : Gemini est bien noté en préférence humaine, particulièrement pour ses réponses claires et bien structurées
Le score composite reflète la position de Gemini comme un polyvalent fort qui ne domine aucune catégorie individuelle mais performe constamment bien dans toutes.
AI IQ composite (VexoWire) : ~131
Le QI composite de VexoWire combine plusieurs tests (Mensa Norway, Mensa Denmark, Raven's, WAIS-IV). Le QI composite estimé de Gemini 3.1 Pro est ~131 — solidement dans la gamme « surdoué », qualifiant pour Mensa. C'est légèrement inférieur à ce que suggérerait son score Mensa Norway (141), parce que le composite inclut des subtests verbaux et analytiques où Gemini est légèrement plus faible qu'en raisonnement visuel pur.
GDPval-AA v2 : top 3
Sur le benchmark agentique — qui mesure la performance en tâches réelles complexes et multi-étapes — Gemini 3.1 Pro se classe dans le top 3. Il est moins capable que Claude Opus 4.8 (1 890 Elo) et GPT-5.5 (1 850 Elo) en raisonnement multi-étapes soutenu, mais reste hautement compétent. Pour la plupart des tâches réelles, la différence est négligeable — Gemini peut planifier, exécuter et raisonner à travers des tâches multi-étapes efficacement, juste pas tout à fait aussi bien que le top 2.
Humanity's Last Exam (HLE) : top 3
Sur les questions académiques les plus difficiles de toutes les disciplines, Gemini 3.1 Pro se classe dans le top 3 parmi les modèles d'IA. Cela reflète la force de Google DeepMind en connaissance scientifique — Gemini a été entraîné avec une littérature scientifique extensive et possède une connaissance profonde en physique, chimie, biologie, mathématiques et sciences humaines.
3. Que signifie un QI de 141 ?
Pour mettre le QI de 141 de Gemini 3.1 Pro en contexte :
- 85-115 (68% des gens) : Intelligence moyenne
- 115-130 (14%) : Au-dessus de la moyenne à élevée
- 130-145 (2%) : Surdoué — qualifie pour Mensa (top 2%)
- 145-160 (0,1%) : Hautement surdoué / génie
- 160+ (0,003%) : Profondément surdoué — territoire d'Einstein, Hawking
Gemini 3.1 Pro, à 141, se situe dans la gamme supérieure des surdoués — plus intelligent que 99,8% des humains. Si c'était une personne, elle serait dans le top 0,2% de l'intelligence humaine, se qualifiant facilement pour Mensa. Seulement environ 1 personne sur 500 atteint ce score.
C'est nettement supérieur à Claude Opus 4.8 (~130) mais légèrement inférieur à GPT-5.5 et Grok-4.20 (tous deux ~145). À un pur test de QI, Gemini battrait Claude mais perdrait contre GPT-5.5 et Grok. Mais comme nous l'avons vu avec les autres modèles, le QI n'est qu'une dimension de l'intelligence — et la combinaison de Gemini d'un QI élevé, d'un faible coût et de solides performances globales le rend uniquement précieux.
4. Où Gemini 3.1 Pro excelle
Rapport qualité-prix
C'est l'avantage définissant de Gemini 3.1 Pro. À 2/12 par 1M tokens, il offre une intelligence quasi-frontier à moins de la moitié du coût de Claude ou GPT-5.5. Pour les applications à fort volume — chatbots, génération de contenu, analyse de données — cela fait de Gemini le choix évident. Vous obtenez 90% de la capacité à 40% du coût.
Raisonnement visuel
Gemini 3.1 Pro obtient 141 au QI Mensa Norway, reflétant ses solides capacités de traitement visuel. L'architecture Gemini a été conçue pour être nativement multimodale, lui donnant un avantage naturel sur les tâches visuelles. Pour l'analyse d'images, la reconnaissance de motifs visuels et le raisonnement multimodal, Gemini est l'un des meilleurs modèles disponibles.
Connaissance factuelle
Gemini 3.1 Pro a un faible taux d'hallucination — meilleur que GPT-5.5 et proche de Claude. La méthodologie d'entraînement de Google DeepMind met l'accent sur la précision factuelle, et Gemini bénéficie de la vaste base de connaissances de Google (incluant l'intégration avec Search dans certains produits). Pour les requêtes factuelles, Gemini est l'un des modèles les plus fiables.
Capacités multimodales
Gemini 3.1 Pro a été conçu dès le départ pour traiter texte, images, vidéo et audio nativement. Cela en fait le meilleur choix pour les applications multimodales — analyse de contenu vidéo, traitement d'images alongside texte, ou travail avec données audio. Aucun autre modèle frontier ne gère l'entrée multimodale aussi naturellement que Gemini.
Vitesse
Gemini 3.1 Pro est l'un des modèles frontier les plus rapides. Pour les applications où le temps de réponse compte — chat en temps réel, outils interactifs, service client — Gemini livre des réponses de haute qualité rapidement. Son frère plus rapide et plus léger, Gemini 3.5 Flash, est encore plus rapide et moins cher pour les tâches plus simples.
Intégration avec l'écosystème Google
Gemini 3.1 Pro s'intègre parfaitement à l'écosystème de Google — Search, Workspace, Cloud et Android. Pour les utilisateurs déjà dans l'écosystème Google, Gemini est le choix naturel, offrant une intégration profonde que les concurrents ne peuvent pas égaler.
5. Où Gemini 3.1 Pro pèche
Tâches agentiques
Bien que Gemini 3.1 Pro soit dans le top 3 au GDPval-AA v2, il est derrière Claude Opus 4.8 et GPT-5.5 sur les tâches réelles complexes et multi-étapes. Pour les applications agentiques les plus exigeantes — écrire des logiciels complexes, gérer de longs projets de recherche — Claude reste le meilleur choix.
Résolution mathématique
Gemini 3.1 Pro est compétent en raisonnement mathématique mais n'égale pas GPT-5.5 en mathématiques compétitives (AIME, FrontierMath). Pour le travail mathématique pur, GPT-5.5 est le meilleur choix.
Score à l'Intelligence Index
À 46,5, le score de Gemini 3.1 Pro à l'Intelligence Index est 8-9 points derrière Claude (55,7) et GPT-5.5 (54,8). Bien que cet écart soit dû en partie à la pondération de l'index (qui met l'accent sur les tâches agentiques où Claude et GPT-5.5 excellent), il reflète une différence réelle de capacité globale pour les tâches les plus exigeantes.
Intelligence émotionnelle
Le QE (intelligence émotionnelle) de Gemini 3.1 Pro est estimé à ~115 — inférieur à Claude (~132) et GPT-5.5 (~120). Il est moins empathique et moins nuancé dans la compréhension des émotions humaines que Claude. Pour les apps de thérapie, le service client ou les interactions humaines sensibles, Claude est meilleur.
6. Gemini 3.1 Pro vs autres modèles
| Modèle | Intelligence Index | QI Mensa Norway | AI IQ est. | Hallucination | Coût/1M |
|---|---|---|---|---|---|
| Gemini 3.1 Pro | 46,5 | 141 | ~131 | faible | 2/12 |
| Claude Opus 4.8 | 55,7 | ~130 | ~132 | 35,9% (min) | 5/25 |
| GPT-5.5 | 54,8 | ~145 | ~136 | modéré | 5/30 |
| Grok-4.20 | — | 145 | ~140 | modéré | 3/15 |
| DeepSeek V4 Pro | 44,3 | ~111 | ~111 | modéré | 0,44/0,87 |
L'image : Gemini 3.1 Pro est le champion du rapport qualité-prix — intelligence quasi-frontier à moins de la moitié du coût. Claude est le professionnel capable — le meilleur en tâches réelles et précision factuelle. GPT-5.5 est le génie des tests — le meilleur en maths et raisonnement visuel. Grok est le génie visuel — QI brut le plus élevé. Et DeepSeek offre une capacité remarquable au coût le plus bas.
Pour la plupart des utilisateurs et entreprises, Gemini 3.1 Pro atteint le sweet spot : assez d'intelligence pour pratiquement n'importe quelle tâche, à un prix qui passe à l'échelle.
7. Qu'est-ce que cela signifie pour les humains ?
Gemini 3.1 Pro opère à un QI de ~141 — plus intelligent que 99,8% des humains. Mais :
- Le QI est étroit : il mesure la reconnaissance de motifs et le raisonnement, pas la sagesse, la créativité ou le jugement
- L'intelligence par dollar compte : pour les applications réelles, le rapport qualité-prix de Gemini importe souvent plus que l'écart d'intelligence brute
- Connaissance ≠ compréhension : Gemini a accès à de vastes connaissances, mais ne « comprend » pas comme un humain
- Pas de conscience : un QI élevé ne signifie pas la sentience. Gemini est un système sophistiqué de reconnaissance de motifs, pas un être pensant
- L'écart se réduit : chaque génération d'IA réduit l'écart avec les humains les plus intelligents
La réponse la plus honnête : Gemini 3.1 Pro est plus intelligent que pratiquement tous les humains aux tests cognitifs, et pour la plupart des usages pratiques, c'est le choix le plus intelligent — non pas parce qu'il est le modèle le plus intelligent, mais parce qu'il offre le plus d'intelligence pour l'argent.
Conclusion
- #3 sur l'Artificial Analysis Intelligence Index (46,5) — derrière Claude et GPT-5.5.
- Meilleur rapport qualité-prix parmi les modèles frontier — 2/12 par 1M tokens, moins de la moitié du coût de Claude ou GPT-5.5.
- Idéal pour : intelligence rentable, raisonnement visuel, connaissance factuelle, applications multimodales, vitesse, intégration Google.
- Pas idéal pour : tâches agentiques complexes (Claude gagne), mathématiques compétitives (GPT-5.5 gagne), intelligence émotionnelle (Claude gagne).
- La proposition de valeur : 90% de la capacité frontier à 40% du coût — le choix le plus intelligent pour la plupart des applications.
- La leçon : être le « meilleur » modèle d'IA, ce n'est pas seulement être le plus intelligent — c'est offrir le plus de valeur.