Saturday, 10 October 2026 | Mise à jour quotidienne L'intelligence artificielle au service des constructeurs

Classement des grands modèles linguistiques 2026 — Indice d’intelligence des modèles IA

En 2026, Claude Opus 4.8 domine notre indice d’intelligence avec un score de 55,7, devançant légèrement GPT-5.5 d’OpenAI (54,8). Gemini 3.5 Flash de Google (50,2) et le modèle open-weight GLM-5.2 (51,1) suivent de près, tandis que Gemini 3.1 Pro (46,5) et DeepSeek V4 Pro (44,3) complètent ce peloton de pointe. Si votre choix porte réellement sur l’un ou l’autre assistant plutôt que sur les modèles bruts eux-mêmes, la comparaison Claude vs ChatGPT traite précisément ce face-à-face. Le « meilleur » modèle unique dépend de la manière dont vous équilibrez intelligence, prix et vitesse.

La colonne Intelligence correspond à un score composite allant de 0 à 100, fondé sur l’Artificial Analysis Intelligence Index version 4.1, qui intègre neuf évaluations exigeantes d’évaluation couvrant le raisonnement, la programmation, l’utilisation d’outils par des agents autonomes et les connaissances scientifiques. Plus le score est élevé, plus le modèle est intelligent — toutefois, à ce niveau très élevé, un écart de deux points a rarement un impact mesurable sur la qualité réelle des sorties ; considérez donc les groupes de modèles comme globalement équivalents, plutôt que d’interpréter des différences minimes comme décisives.

Consultez l’intelligence en regard du prix et de la vitesse. Un modèle de pointe tel qu’Opus 4.8 coûte bien plus cher par jeton que DeepSeek V4 Flash (40,3) ou GLM-5.2, qui offrent 70 à 90 % de l’intelligence à une fraction du coût. Pour les tâches à fort volume ou sensibles à la latence, un modèle moins coûteux et plus rapide s’impose généralement ; pour les tâches les plus complexes en matière de raisonnement ou d’agentivité, le haut du classement justifie pleinement sa prime. Triez selon la métrique qui correspond le mieux à votre cas d’usage.

# Modèle ↓ Développeur Intelligence ↓ Contexte ↓ Entrée : $/1 million ↓ Sortie : $/1 million ↓ Poids ouverts
1 Claude Opus 5 Anthropic 61 1 million $5.00 $25.00 Non
2 GPT-6 Astra OpenAI 61 1,05 million $10.00 $50.00 Non
3 Claude Fable 5 Anthropic 60 1 million $10.00 $50.00 Non
4 GPT-5.6 Sol OpenAI 59 1,05 million $5.00 $30.00 Non
5 Kimi K3 Moonshot AI 57 1 million $3.00 $15.00 Oui
6 Claude Opus 4.8 Anthropic 55.7 1 million $5.00 $25.00 Non
7 GPT-5.5 OpenAI 54.8 1,05 million $5.00 $30.00 Non
8 GLM 5.2 Zhipu AI 51.1 1 million $1.40 $4.40 Oui
9 Gemini 3.5 Flash Google 50.2 1 million $1.50 $9.00 Non
10 Claude Sonnet 4.6 Anthropic 47 1 million $3.00 $15.00 Non
11 Gemini 3.1 Pro Google 46.5 1,05 million $2.00 $12.00 Non
12 DeepSeek V4-Pro DeepSeek 44.3 1 million $0.44 $0.87 Oui
13 Kimi K2.7 Code Moonshot AI 42 256 K $0.60 $2.50 Oui
14 DeepSeek V4-Flash DeepSeek 40.3 1 million $0.14 $0.28 Oui
15 Claude Haiku 4.5 Anthropic 37 200 000 $1.00 $5.00 Non
16 DeepSeek R1 DeepSeek 20.1 128 K $0.50 $2.15 Oui
17 Mistral Large 3 Mistral AI 15.9 256 K $2.00 $6.00 Oui
18 Llama 4 Maverick Meta 14.3 1 million $0.20 $0.80 Oui
19 Qwen3 235B-A22B Alibaba 13 128 K $0.45 $1.80 Oui
20 Qwen3 32B Alibaba 12 128 K $0.08 $0.28 Oui
21 Llama 4 Scout Meta 10.0 10 M $0.10 $0.30 Oui
22 Gemma 3 27B Google 7.4 128 K $0.08 $0.16 Oui
23 Phi-4 Microsoft 4.9 16 K $0.07 $0.14 Oui
24 Claude Opus 5.5 Anthropic — — $4.00 $20.00 Non
25 Claude Sonnet 5 Anthropic — 1 million $2.00 $10.00 Non
26 Claude Sonnet 5.5 Anthropic — — $2.00 $10.00 Non
27 DeepSeek R1 Distill Llama 70B DeepSeek — 128 K $0.80 $0.80 Oui
28 Gemini 2.5 Pro Google — 1 million (1 048 576 jetons) $1.25 $10.00 Non
29 Gemini 3.6 Flash Google — 1 million $1.50 $7.50 Non
30 Gemini 3.8 Flash Google — 1 million $0.75 $3.75 Non
31 Gemini 4 Argon Google DeepMind — — $2.00 $10.00 Non
32 Gemma 3 12B Google — 128 K $0.05 $0.15 Oui
33 Gemma 3 4B Google — 128 K $0.05 $0.10 Oui
34 GPT-6 Luna OpenAI — 1,05 million $0.10 $0.50 Non
35 GPT-6 Sol OpenAI — 1,05 million $2.00 $10.00 Non
36 GPT-6.1 Sol OpenAI — — $2.00 $10.00 Non
37 Grok 4 xAI — 256 000 jetons $3.00 $15.00 Non
38 Kling 2.5 Turbo Pro Kuaishou — — — — Non
39 Llama 3.1 8B Meta — 128 K $0.02 $0.03 Oui
40 Llama 3.3 70B Meta — 128 K $0.10 $0.32 Oui
41 MiniMax H3 (Hailuo 3.0) MiniMax — — — — Oui
42 Mistral 7B Mistral AI — 32 K $0.02 $0.03 Oui
43 Mistral NeMo 12B Mistral AI — 128 K $0.02 $0.04 Oui
44 NVIDIA Nemotron 3 Nano Omni NVIDIA — 256 K — — Oui
45 Qwen3 14B Alibaba — 128 K $0.12 $0.24 Oui
46 Qwen3 30B-A3B Alibaba — 128 K $0.12 $0.50 Oui
47 Qwen3 8B Alibaba — 128 K $0.04 $0.14 Oui
48 Seedance 2.5 ByteDance — — — — Non
49 Sora 2 OpenAI — — — — Non
50 Sora 2 Pro OpenAI — — — — Non
51 Veo 3.1 Google — — — — Non
52 Wan 2.5 Alibaba — — — — Non

Click any column heading to re-sort. Intelligence = a 0–100 composite of public reasoning/knowledge benchmarks; — means not yet scored. Prices are USD per 1M tokens. Updated October 2026.

FAQ

Quel est actuellement le meilleur grand modèle linguistique ?

À mi-2026, Claude Opus 4.8 est le modèle obtenant le score le plus élevé sur l’Indice d’intelligence Artificial Analysis (55,7), devançant de peu GPT-5.5 (54,8). Tous deux excellent dans les domaines du raisonnement, de la programmation et des tâches d’agentivité, si bien que le choix pratique entre eux repose généralement davantage sur le prix, la vitesse et l’écosystème que sur une différence réelle d’intelligence.

Quel est le modèle open-source le plus intelligent ?

GLM-5.2 est actuellement le modèle open-weight le plus intelligent, obtenant un score de 51,1 sur l’indice d’intelligence — devant DeepSeek V4 Pro (44,3) et DeepSeek V4 Flash (40,3). Cela place les meilleurs modèles open-source à environ quatre points des modèles propriétaires de pointe tels que GPT-5.5, tout en restant gratuits à héberger soi-même ou à exécuter via des API à faible coût.

Quel modèle IA offre le meilleur rapport qualité-prix ?

DeepSeek V4 Flash et GLM-5.2 offrent le meilleur rapport intelligence/prix. DeepSeek V4 Flash obtient un score de 40,3 à une fraction infinitésimale du prix d’Opus 4.8, fournissant environ 70 % du score maximal pour un pourcentage très faible du coût. Pour les charges de travail à fort volume ou soumises à des contraintes budgétaires, ces modèles open-source constituent clairement les leaders en matière de valeur.

Comment est calculé le score d’intelligence ?

Nos scores reflètent l’Indice d’intelligence Artificial Analysis version 4.1, un score composite de 0 à 100 issu de neuf évaluations exigeantes — notamment Humanity’s Last Exam, GPQA Diamond, Terminal-Bench, SciCode et des tâches d’utilisation d’outils par des agents autonomes. Il mesure le raisonnement, les connaissances, la programmation et les capacités d’agentivité en un seul chiffre : un score plus élevé signifie donc une capacité globalement supérieure face à des tâches difficiles et réelles.

Défiler vers le haut