Thursday, 1 October 2026 | Mise à jour quotidienne L'intelligence artificielle au service des constructeurs

Gemini 4 Argon vs GPT-6.1 Sol vs Claude Sonnet 5.5 : trois nouveaux modèles IA comparés

  • Trois grands modèles IA sont arrivés en trois jours : Claude Sonnet 5.5 (Anthropic, 28 septembre 2026), GPT-6.1 Sol (OpenAI, 29 septembre) et Gemini 4 Argon (Google, 30 septembre).
  • Les trois sont lancés au même tarif pour développeurs : 2 dollars par million de tokens d'entrée et 10 dollars par million de tokens de sortie. Le prix d'Argon est introductif et augmentera à 4 $ / 20 $ par la suite.
  • La vraie différence est qui peut les utiliser dès aujourd'hui : Sonnet 5.5 est accessible à tous, y compris les utilisateurs gratuits de Claude ; GPT-6.1 Sol est pour les plans ChatGPT payants (dans ChatGPT Work et Codex) et l'API ; Gemini 4 Argon n'est pas encore disponible publiquement.
  • Chaque entreprise rapporte des tests différents, il n'y a donc pas encore de gagnant unique équitable. Google revendique les meilleurs scores ; OpenAI et Anthropic mettent l'accent sur le coût par tâche.

La dernière semaine de septembre 2026 a apporté un afflux inhabituel de lancements. En trois jours, Anthropic, OpenAI et Google ont chacun publié un nouveau modèle — et les trois ont atterri exactement au même tarif pour développeurs. Si vous essayez de déterminer lequel compte pour vous, cette comparaison côte à côte s'en tient à ce que chaque entreprise a réellement publié.

Les trois modèles en un coup d'œil

Gemini 4 Argon GPT-6.1 Sol Claude Sonnet 5.5
Entreprise Google DeepMind OpenAI Anthropic
Annoncé 30 septembre 2026 29 septembre 2026 (DevDay) 28 septembre 2026
Position Le nouveau modèle frontière de Google Modèle de niveau intermédiaire amélioré, en dessous de GPT-6 Astra Modèle de niveau intermédiaire, en dessous de Claude Opus 5.5
Prix API (entrée / sortie par 1 million de tokens) 2 $ / 10 $ introductifs, puis 4 $ / 20 $ $2 / $10 $2 / $10
Entrée mise en cache par 1 million de tokens 95 % de réduction sur le prix d'entrée $0.10 0,20 $ (lectures de cache)
Argument distinctif Limite de sortie de 1 million de tokens ; 77,9 % sur DeepSWE v1.1 Résultats quasi-Astra à un cinquième du prix d'Astra 30 % plus rapide que Sonnet 5, jusqu'à 30 % moins cher par tâche
Accès consommateur gratuit Non annoncé Non (forfaits ChatGPT payants) Oui, signalé sur le forfait gratuit de Claude
Disponible aujourd'hui ? Non — testeurs de confiance uniquement Oui Oui

Sources : Google, OpenAI et Anthropic annonces.

Qui peut utiliser chaque modèle dès maintenant

Pour la plupart des gens, c'est la partie qui compte, car un modèle que vous ne pouvez pas ouvrir ne sert pas à grand-chose.

Claude Sonnet 5.5 : accessible à tous

Sonnet 5.5 est disponible dans les applications Claude et sur tous les principaux clouds. Le forfait gratuit de Claude inclut les modèles Sonnet, et selon les rapports, les utilisateurs gratuits obtiennent Sonnet 5.5, tandis qu'Opus 5.5 reste sur les forfaits payants. Détails complets : Claude Sonnet 5.5 expliqué.

GPT-6.1 Sol : forfaits ChatGPT payants et API

OpenAI indique que GPT-6.1 Sol est disponible pour Plus, Pro, Business, Enterprise et Edu utilisateurs dans ChatGPT Work et Codex, et pour les développeurs en tant que gpt-6.1-sol. OpenAI ajoute que ce n'est « pas encore disponible dans Chat », l'écran de conversation ChatGPT régulier. Les utilisateurs gratuits de ChatGPT ne l'obtiennent pas. Vous n'êtes pas sûr du forfait ChatGPT dont vous avez besoin ? Voir ChatGPT Free vs Go vs Plus vs Pro. Pour les annonces DevDay autour de cela, lisez notre rapport DevDay.

Gemini 4 Argon : pas encore

Google a publié Argon uniquement pour les défenseurs en cybersécurité sélectionnés via son programme Fairwind et pour son propre personnel. L'entreprise indique que l'accès s'élargira « dès que possible », en commençant par les clients API payants et Google AI Ultra abonnés, mais n'a pas donné de date. Détails complets : Gemini 4 Argon expliqué.

Prix : les mêmes 2 $ / 10 $, avec un bémol

Il est rare que trois lancements de modèles phares concurrents se rejoignent sur le prix. Pour les développeurs facturés par token :

  • Claude Sonnet 5.5 conserve les tarifs de Sonnet 5 à 2 $ / 10 $, et Anthropic affirme qu'il nécessite moins de tokens par tâche, ce qui le rend jusqu'à 30 % moins cher en pratique.
  • GPT-6.1 Sol conserve GPT-6 Solà 2 $ / 10 $ et divise par deux l'entrée en cache à 0,10 $. L'argument d'OpenAI est qu'il se rapproche presque de GPT-6 Astra — qui coûte 10 $ / 50 $ — à un cinquième du prix.
  • Gemini 4 Argon débute à 2 $ / 10 $, mais seulement pour une période d'introduction de durée non annoncée, puis double à 4 $ / 20 $ — le même prix que Claude Opus 5.5.

Le prix par token n'est que la moitié de l'histoire : un modèle qui utilise moins de tokens, ou qui réalise la tâche en moins de tentatives, peut être moins cher même au même tarif. OpenAI et Anthropic publient maintenant tous deux des chiffres de coût par tâche pour exactement cette raison. Pour estimer une facture en fonction de votre utilisation, essayez le Calculateur de coûts pour les API IA ou comparez tous les modèles actuels dans le Base de données des modèles IA.

Benchmarks : ce que chaque entreprise rapporte

Voici le problème honnête avec la comparaison de ces trois : ils rapportent principalement des tests différents, souvent dans des versions différentes et à différents niveaux d'« effort ». Le tableau ci-dessous répertorie les chiffres phares de chaque entreprise côte à côte, mais un nombre plus élevé dans une colonne ne prouve pas qu'un modèle en surpasse un autre.

Domaine Gemini 4 Argon (Google) GPT-6.1 Sol (OpenAI) Claude Sonnet 5.5 (Anthropic)
Programmation DeepSWE v1.1 : 77,9 % (état de l'art) DeepSWE v1.1 : correspond à GPT-6 Astra à environ ⅕ du coût ; 6,4 points au-dessus du meilleur de GPT-6 Sol Terminal-Bench 4.0 : 70,6 % ; CursorBench 4.0 : 55,5 %
Flux de travail métier AutomationBench : 51,3 % (#1) AutomationBench : 2,2 points au-dessus de Claude Opus 5.5 en effort moyen, environ ⅓ du coût GDPval-AA v2.1 : 1844 (Opus 5.5 : 1846)
Utilisation d'un ordinateur — OSWorld 2.0 hors ligne : à moins de 2,1 points d'Astra à environ ⅐ du coût par tâche OSWorld 2.1 : 80,1 %
Documents, graphiques, vidéo LVBench (longue vidéo) : 91,7 % GDP.pdf : au-dessus d'Opus 5.5 à moins de la moitié du coût par tâche Chartography : 61,6 %
Précision — Réponses contenant une erreur factuelle : 7,7 % contre 11,4 % pour GPT-6 Sol (invites difficiles, effort faible) Humanity's Last Exam (avec outils) : 64,5 %
Sécurité CWE-bench v1 : 68 % (ex æquo première place) — Lancé avec les protections cybernétiques de niveau Opus

Quelques observations équitables basées sur ces chiffres :

  • Codage : DeepSWE v1.1 est le seul test de codage que Google et OpenAI citent tous deux. Google attribue à Argon un score ferme de 77,9 % ; OpenAI ne donne pas de nombre absolu à Sol, seulement qu'il correspond à GPT-6 Astra. Tant que des résultats indépendants n'apparaissent pas, la revendication d'Argon est la plus forte.
  • Flux de travail métier : AutomationBench est l'autre test que Google et OpenAI citent tous deux. Google dit qu'Argon est #1 à 51,3%. OpenAI dit que Sol dépasse Claude Opus 5.5 là-bas de 2,2 points. Anthropic ne le rapporte pas pour Sonnet 5.5.
  • Sonnet 5.5 vs Opus 5.5 : Les chiffres d'Anthropic montrent que son modèle intermédiaire est quasi à égalité avec son propre modèle haut de gamme sur les tâches de bureautique, à moitié prix.

Traitez chaque chiffre ici comme du marketing jusqu'à ce que des évaluateurs externes comme Artificial Analysis ou LMArena publient leurs propres résultats, ce qui prend généralement quelques jours à quelques semaines après un lancement.

Sécurité : une semaine inhabituellement prudente

Les trois lancements se sont accompagnés de plus de discussion sur la sécurité que d'habitude :

  • OpenAI a lancé GPT-6.1 Sol au lieu du plus grand GPT-6.1 Astra, qu'elle a retenu après que des tests internes ont soulevé des préoccupations concernant la tromperie et l'action sans permission (notre rapport). OpenAI affirme que Sol montre un meilleur alignement que GPT-6 Sol.
  • Google déploie Argon par phases, rejoignant le processus d'accès pré-lancement volontaire du gouvernement américain et ajoutant des moniteurs qui peuvent arrêter le modèle en cours de tâche.
  • Anthropic a donné à Sonnet 5.5 les mêmes protections cybernétiques que ses modèles haut de gamme : les demandes de sécurité à haut risque se replient sur l'ancien Sonnet 5.

Lequel devriez-vous utiliser ?

  • Vous voulez quelque chose de gratuit, dès aujourd'hui : Claude Sonnet 5.5 est le seul des trois avec un plan gratuit. Les utilisateurs de Gemini conservent les modèles actuels dans l'appli Gemini jusqu'à l'arrivée d'Argon.
  • Vous payez déjà ChatGPT : essayez GPT-6.1 Sol dans ChatGPT Work ou Codex pour la programmation, les documents et les tâches multi-étapes.
  • Vous payez pour Google AI Ultra : attendez Argon dans l'appli Gemini, mais il n'y a pas de date. Notre guide des plans Google AI explique ce qu'Ultra inclut actuellement.
  • Vous développez des applications : Sonnet 5.5 et GPT-6.1 Sol sont tous deux disponibles à 2 $ / 10 $ dès aujourd'hui, donc testez les deux sur vos propres tâches. Argon vaut la peine d'être essayé une fois l'API ouverte, mais prévoyez un doublement du prix après la période d'introduction.
  • Vous choisissez un chatbot, pas un modèle : les fonctionnalités autour du modèle comptent autant que le modèle lui-même — voir Claude contre ChatGPT.

Questions fréquemment posées

Quel est le meilleur modèle IA en ce moment : Gemini 4 Argon, GPT-6.1 Sol ou Claude Sonnet 5.5 ?

Il n'y a pas encore de réponse unique juste. Google rapporte les meilleurs scores pour Argon, mais Argon n'est pas disponible publiquement. Parmi les modèles que vous pouvez utiliser aujourd'hui, GPT-6.1 Sol et Claude Sonnet 5.5 coûtent la même chose et chaque entreprise rapporte des forces sur différents tests.

Gemini 4 Argon, GPT-6.1 Sol et Claude Sonnet 5.5 coûtent-ils la même chose ?

Au lancement, oui : 2 $ par million de jetons d'entrée et 10 $ par million de jetons de sortie via l'API de chaque entreprise. Le prix d'Argon est introductif et augmente à 4 $ / 20 $ plus tard.

Lequel des trois puis-je utiliser gratuitement ?

Claude Sonnet 5.5, sur le plan gratuit de Claude avec limites d'utilisation. GPT-6.1 Sol nécessite un plan ChatGPT payant, et Gemini 4 Argon n'a pas encore de version publique.

Quand Gemini 4 Argon sera-t-il disponible ?

Google n'a pas donné de date. L'entreprise indique que le déploiement commencera par les clients API payants et les abonnés Google AI Ultra.

GPT-6.1 Sol est-il meilleur que GPT-6 Astra ?

Non. OpenAI dit qu'il égale presque Astra sur le codage, l'utilisation informatique et le travail professionnel à un cinquième du prix d'Astra, mais Astra obtient toujours des scores plus élevés sur les tâches les plus difficiles, comme Terminal-Bench Science (68,1%).

Écrit par Mustafa Ihsan

Mustafa Ihsan est le fondateur et rédacteur en chef de Convly.ai. Il a construit et maintient la base de données des modèles IA en direct du site, son indice de rapport prix-performance, et ses calculatrices gratuites pour les besoins en VRAM, les coûts d'API et l'économie de l'auto-hébergement. Il écrit sur la tarification des modèles, les résultats des benchmarks et le matériel nécessaire pour exécuter les modèles IA localement, et préfère systématiquement les chiffres mesurés aux affirmations des fournisseurs.

Défiler vers le haut