En 2026, Claude Opus 4.8 domine notre indice d’intelligence avec un score de 55,7, devançant légèrement GPT-5.5 d’OpenAI (54,8). Gemini 3.5 Flash de Google (50,2) et le modèle open-weight GLM-5.2 (51,1) suivent de près, tandis que Gemini 3.1 Pro (46,5) et DeepSeek V4 Pro (44,3) complètent ce peloton de pointe. Si votre choix porte réellement sur l’un ou l’autre assistant plutôt que sur les modèles bruts eux-mêmes, la comparaison Claude vs ChatGPT traite précisément ce face-à-face. Le « meilleur » modèle unique dépend de la manière dont vous équilibrez intelligence, prix et vitesse.
La colonne Intelligence correspond à un score composite allant de 0 à 100, fondé sur l’Artificial Analysis Intelligence Index version 4.1, qui intègre neuf évaluations exigeantes d’évaluation couvrant le raisonnement, la programmation, l’utilisation d’outils par des agents autonomes et les connaissances scientifiques. Plus le score est élevé, plus le modèle est intelligent — toutefois, à ce niveau très élevé, un écart de deux points a rarement un impact mesurable sur la qualité réelle des sorties ; considérez donc les groupes de modèles comme globalement équivalents, plutôt que d’interpréter des différences minimes comme décisives.
Consultez l’intelligence en regard du prix et de la vitesse. Un modèle de pointe tel qu’Opus 4.8 coûte bien plus cher par jeton que DeepSeek V4 Flash (40,3) ou GLM-5.2, qui offrent 70 à 90 % de l’intelligence à une fraction du coût. Pour les tâches à fort volume ou sensibles à la latence, un modèle moins coûteux et plus rapide s’impose généralement ; pour les tâches les plus complexes en matière de raisonnement ou d’agentivité, le haut du classement justifie pleinement sa prime. Triez selon la métrique qui correspond le mieux à votre cas d’usage.
| # | Modèle ↓ | Développeur | Intelligence ↓ | Contexte ↓ | Entrée : $/1 million ↓ | Sortie : $/1 million ↓ | Poids ouverts |
|---|---|---|---|---|---|---|---|
| 1 | Claude Opus 5 | Anthropic | 61 | 1 million | $5.00 | $25.00 | Non |
| 2 | GPT-6 Astra | OpenAI | 61 | 1,05 million | $10.00 | $50.00 | Non |
| 3 | Claude Fable 5 | Anthropic | 60 | 1 million | $10.00 | $50.00 | Non |
| 4 | GPT-5.6 Sol | OpenAI | 59 | 1,05 million | $5.00 | $30.00 | Non |
| 5 | Kimi K3 | Moonshot AI | 57 | 1 million | $3.00 | $15.00 | Oui |
| 6 | Claude Opus 4.8 | Anthropic | 55.7 | 1 million | $5.00 | $25.00 | Non |
| 7 | GPT-5.5 | OpenAI | 54.8 | 1,05 million | $5.00 | $30.00 | Non |
| 8 | GLM 5.2 | Zhipu AI | 51.1 | 1 million | $1.40 | $4.40 | Oui |
| 9 | Gemini 3.5 Flash | 50.2 | 1 million | $1.50 | $9.00 | Non | |
| 10 | Claude Sonnet 4.6 | Anthropic | 47 | 1 million | $3.00 | $15.00 | Non |
| 11 | Gemini 3.1 Pro | 46.5 | 1,05 million | $2.00 | $12.00 | Non | |
| 12 | DeepSeek V4-Pro | DeepSeek | 44.3 | 1 million | $0.44 | $0.87 | Oui |
| 13 | Kimi K2.7 Code | Moonshot AI | 42 | 256 K | $0.60 | $2.50 | Oui |
| 14 | DeepSeek V4-Flash | DeepSeek | 40.3 | 1 million | $0.14 | $0.28 | Oui |
| 15 | Claude Haiku 4.5 | Anthropic | 37 | 200 000 | $1.00 | $5.00 | Non |
| 16 | DeepSeek R1 | DeepSeek | 20.1 | 128 K | $0.50 | $2.15 | Oui |
| 17 | Mistral Large 3 | Mistral AI | 15.9 | 256 K | $2.00 | $6.00 | Oui |
| 18 | Llama 4 Maverick | Meta | 14.3 | 1 million | $0.20 | $0.80 | Oui |
| 19 | Qwen3 235B-A22B | Alibaba | 13 | 128 K | $0.45 | $1.80 | Oui |
| 20 | Qwen3 32B | Alibaba | 12 | 128 K | $0.08 | $0.28 | Oui |
| 21 | Llama 4 Scout | Meta | 10.0 | 10 M | $0.10 | $0.30 | Oui |
| 22 | Gemma 3 27B | 7.4 | 128 K | $0.08 | $0.16 | Oui | |
| 23 | Phi-4 | Microsoft | 4.9 | 16 K | $0.07 | $0.14 | Oui |
| 24 | Claude Opus 5.5 | Anthropic | — | — | $4.00 | $20.00 | Non |
| 25 | Claude Sonnet 5 | Anthropic | — | 1 million | $2.00 | $10.00 | Non |
| 26 | Claude Sonnet 5.5 | Anthropic | — | — | $2.00 | $10.00 | Non |
| 27 | DeepSeek R1 Distill Llama 70B | DeepSeek | — | 128 K | $0.80 | $0.80 | Oui |
| 28 | Gemini 2.5 Pro | — | 1 million (1 048 576 jetons) | $1.25 | $10.00 | Non | |
| 29 | Gemini 3.6 Flash | — | 1 million | $1.50 | $7.50 | Non | |
| 30 | Gemini 3.8 Flash | — | 1 million | $0.75 | $3.75 | Non | |
| 31 | Gemini 4 Argon | Google DeepMind | — | — | $2.00 | $10.00 | Non |
| 32 | Gemma 3 12B | — | 128 K | $0.05 | $0.15 | Oui | |
| 33 | Gemma 3 4B | — | 128 K | $0.05 | $0.10 | Oui | |
| 34 | GPT-6 Luna | OpenAI | — | 1,05 million | $0.10 | $0.50 | Non |
| 35 | GPT-6 Sol | OpenAI | — | 1,05 million | $2.00 | $10.00 | Non |
| 36 | GPT-6.1 Sol | OpenAI | — | — | $2.00 | $10.00 | Non |
| 37 | Grok 4 | xAI | — | 256 000 jetons | $3.00 | $15.00 | Non |
| 38 | Kling 2.5 Turbo Pro | Kuaishou | — | — | — | — | Non |
| 39 | Llama 3.1 8B | Meta | — | 128 K | $0.02 | $0.03 | Oui |
| 40 | Llama 3.3 70B | Meta | — | 128 K | $0.10 | $0.32 | Oui |
| 41 | MiniMax H3 (Hailuo 3.0) | MiniMax | — | — | — | — | Oui |
| 42 | Mistral 7B | Mistral AI | — | 32 K | $0.02 | $0.03 | Oui |
| 43 | Mistral NeMo 12B | Mistral AI | — | 128 K | $0.02 | $0.04 | Oui |
| 44 | NVIDIA Nemotron 3 Nano Omni | NVIDIA | — | 256 K | — | — | Oui |
| 45 | Qwen3 14B | Alibaba | — | 128 K | $0.12 | $0.24 | Oui |
| 46 | Qwen3 30B-A3B | Alibaba | — | 128 K | $0.12 | $0.50 | Oui |
| 47 | Qwen3 8B | Alibaba | — | 128 K | $0.04 | $0.14 | Oui |
| 48 | Seedance 2.5 | ByteDance | — | — | — | — | Non |
| 49 | Sora 2 | OpenAI | — | — | — | — | Non |
| 50 | Sora 2 Pro | OpenAI | — | — | — | — | Non |
| 51 | Veo 3.1 | — | — | — | — | Non | |
| 52 | Wan 2.5 | Alibaba | — | — | — | — | Non |
Click any column heading to re-sort. Intelligence = a 0–100 composite of public reasoning/knowledge benchmarks; — means not yet scored. Prices are USD per 1M tokens. Updated October 2026.
FAQ
Quel est actuellement le meilleur grand modèle linguistique ?
À mi-2026, Claude Opus 4.8 est le modèle obtenant le score le plus élevé sur l’Indice d’intelligence Artificial Analysis (55,7), devançant de peu GPT-5.5 (54,8). Tous deux excellent dans les domaines du raisonnement, de la programmation et des tâches d’agentivité, si bien que le choix pratique entre eux repose généralement davantage sur le prix, la vitesse et l’écosystème que sur une différence réelle d’intelligence.
Quel est le modèle open-source le plus intelligent ?
GLM-5.2 est actuellement le modèle open-weight le plus intelligent, obtenant un score de 51,1 sur l’indice d’intelligence — devant DeepSeek V4 Pro (44,3) et DeepSeek V4 Flash (40,3). Cela place les meilleurs modèles open-source à environ quatre points des modèles propriétaires de pointe tels que GPT-5.5, tout en restant gratuits à héberger soi-même ou à exécuter via des API à faible coût.
Quel modèle IA offre le meilleur rapport qualité-prix ?
DeepSeek V4 Flash et GLM-5.2 offrent le meilleur rapport intelligence/prix. DeepSeek V4 Flash obtient un score de 40,3 à une fraction infinitésimale du prix d’Opus 4.8, fournissant environ 70 % du score maximal pour un pourcentage très faible du coût. Pour les charges de travail à fort volume ou soumises à des contraintes budgétaires, ces modèles open-source constituent clairement les leaders en matière de valeur.
Comment est calculé le score d’intelligence ?
Nos scores reflètent l’Indice d’intelligence Artificial Analysis version 4.1, un score composite de 0 à 100 issu de neuf évaluations exigeantes — notamment Humanity’s Last Exam, GPQA Diamond, Terminal-Bench, SciCode et des tâches d’utilisation d’outils par des agents autonomes. Il mesure le raisonnement, les connaissances, la programmation et les capacités d’agentivité en un seul chiffre : un score plus élevé signifie donc une capacité globalement supérieure face à des tâches difficiles et réelles.
