Thursday, 17 September 2026 | Mise à jour quotidienne L'intelligence artificielle au service des constructeurs

Gemini 3.6 Flash

Gemini 3.6 Flash — Spécifications

Rédigé par Mustafa Ihsan d’après la documentation officielle du fournisseur · Dernière mise à jour

Développeur Google
Type Rapide / généraliste
Modalité Texte, vision, audio
Paramètres Non divulgué
Fenêtre de contexte 1 million
Sortie maximale 64 K
Licence Propriétaire
Poids ouverts Non
Publié 2026-07
Prix de l’entrée $1.50 /1M
Prix de la sortie $7.50 /1M
Fournisseurs d'API Google AI Studio, Vertex AI

Page officielle →

Qu’est-ce que Gemini 3.6 Flash ?

Gemini 3.6 Flash est le tout dernier modèle de la gamme Flash de Google, lancé le 21 juillet 2026, doté d’un
contexte de 1 million de jetons et d’un tarif de 1,50 $ en entrée / 7,50 $ en sortie par million de jetons. Pour lever une confusion fréquente
dans les recherches : il n’existe pas de Gemini 4 en juillet 2026 — Gemini 3.6 Flash est bien la version la plus récente de Gemini
actuellement disponible, et toute affirmation contraire relève de la spéculation.

Par rapport à Gemini 3.5 Flash, le tarif d’entrée reste inchangé à 1,50 $, tandis que le tarif de sortie passe de 9 $
à 7,50 $ — soit une réduction de 17 % sur la partie de la facture qui domine généralement. Pour les charges de travail axées sur la génération,
cette baisse représente une économie directe, sans compromis apparent sur les capacités, ce qui fait de Gemini 3.6 Flash le choix par défaut
au sein de la gamme Flash pour les nouveaux projets. En revanche, cette différence ne se fera pas sentir sur les charges de travail axées sur les prompts
(récupération), puisque le tarif d’entrée est identique ; dans ce cas, les deux modèles sont interchangeables sur le plan des coûts, et le choix
dépendra uniquement des résultats de vos propres évaluations. Comme pour l’ensemble de la famille Gemini, veuillez vérifier le traitement facturé
des prompts dépassant 200 000 jetons avant de concevoir une fonctionnalité exploitant pleinement la fenêtre contextuelle maximale.
traitement des invites comportant plus de 200 000 jetons avant de concevoir une fonctionnalité exploitant l’intégralité du contexte
fenêtre.

Tarification de Gemini 3.6 Flash : coût de l’API par million de jetons

Entrée (par million de jetons)$1.50
Sortie (par million de jetons)$7.50
Ratio sortie/entrée
Moyenne pondérée (4:1 entrée:sortie)$2.70 par 1 million de jetons

Coût mensuel de Gemini 3.6 Flash

Dépense mensuelle réelle pour un ratio entrée-sortie de 4:1 — le rapport effectivement observé dans une charge de travail type (chat ou RAG).

Charge de travailJetons/moisCoût par mois
Projet secondaire 1 million en entrée / 0,25 million en sortie $3.38
Petite équipe 20 millions en entrée / 5 millions en sortie $68
Production 200 millions en entrée / 50 millions en sortie $675

Calculez vos propres coûts dans le Calculateur de coûts pour les API IA.

Alternatives moins chères à Gemini 3.6 Flash

ModèleCoût combiné par million de dollarsVous économisez
Mistral 7B ouverte $0.0220 99 % moins cher
Llama 3.1 8B ouverte $0.0220 99 % moins cher
Mistral NeMo 12B ouverte $0.0240 99 % moins cher

Questions fréquemment posées

Combien coûte Gemini 3.6 Flash par million de jetons ?

Gemini 3.6 Flash coûte 1,50 $ par million de jetons en entrée et 7,50 $ par million de jetons en sortie. Avec un ratio typique entrée/sortie de 4:1, le coût moyen s’établit à environ 2,70 $ par million de jetons.

Combien coûte Gemini 3.6 Flash par mois ?

Une charge de travail mensuelle modeste (20 millions de jetons en entrée et 5 millions en sortie) coûte environ 68 $ avec Gemini 3.6 Flash. Un projet personnel (1 million en entrée / 0,25 million en sortie) coûte environ 3,38 $.

Quelle est une alternative moins chère à Gemini 3.6 Flash ?

Mistral 7B constitue l’option la plus performante et la moins coûteuse de notre base de données, à 0,0220 $ par million de jetons combinés — soit environ 99 % moins cher que Gemini 3.6 Flash. Il s’agit également d’un modèle open-weight, ce qui permet son hébergement privé.

Puis-je exécuter Gemini 3.6 Flash localement ?

Non. Gemini 3.6 Flash est un modèle fermé, accessible uniquement via API — ses poids ne sont pas publiés, ce qui rend impossible son hébergement privé.

Pourquoi Gemini 3.6 Flash facture-t-il davantage les jetons de sortie que ceux d’entrée ?

Les jetons de sortie sont générés un par un et ne peuvent pas être traités en lot comme un prompt, ce qui augmente leur coût de fourniture pour le prestataire. Gemini 3.6 Flash facture ainsi cinq fois plus cher les jetons de sortie, ce qui explique pourquoi les charges de travail axées sur les prompts sont nettement moins coûteuses que celles axées sur la génération.

Comparez les prix de tous les modèles Gemini côte à côte : Tarification de l'API Gemini.

Les prix indiqués correspondent aux tarifs publics officiels pour l’API principale du modèle et sont mis à jour régulièrement à mesure que les fournisseurs les modifient. Les remises liées aux volumes, aux traitements par lots ou aux entrées mises en cache ne sont pas prises en compte. Comparez tous les modèles côte à côte dans le Base de données des modèles IA ou le Classement des grands modèles linguistiques (LLM).

Défiler vers le haut