Gemini 3.6 Flash — Spécifications
Rédigé par Mustafa Ihsan d’après la documentation officielle du fournisseur · Dernière mise à jour
| Développeur | |
|---|---|
| Type | Rapide / généraliste |
| Modalité | Texte, vision, audio |
| Paramètres | Non divulgué |
| Fenêtre de contexte | 1 million |
| Sortie maximale | 64 K |
| Licence | Propriétaire |
| Poids ouverts | Non |
| Publié | 2026-07 |
| Prix de l’entrée | $1.50 /1M |
| Prix de la sortie | $7.50 /1M |
| Fournisseurs d'API | Google AI Studio, Vertex AI |
Qu’est-ce que Gemini 3.6 Flash ?
Gemini 3.6 Flash est le tout dernier modèle de la gamme Flash de Google, lancé le 21 juillet 2026, doté d’un
contexte de 1 million de jetons et d’un tarif de 1,50 $ en entrée / 7,50 $ en sortie par million de jetons. Pour lever une confusion fréquente
dans les recherches : il n’existe pas de Gemini 4 en juillet 2026 — Gemini 3.6 Flash est bien la version la plus récente de Gemini
actuellement disponible, et toute affirmation contraire relève de la spéculation.
Par rapport à Gemini 3.5 Flash, le tarif d’entrée reste inchangé à 1,50 $, tandis que le tarif de sortie passe de 9 $
à 7,50 $ — soit une réduction de 17 % sur la partie de la facture qui domine généralement. Pour les charges de travail axées sur la génération,
cette baisse représente une économie directe, sans compromis apparent sur les capacités, ce qui fait de Gemini 3.6 Flash le choix par défaut
au sein de la gamme Flash pour les nouveaux projets. En revanche, cette différence ne se fera pas sentir sur les charges de travail axées sur les prompts
(récupération), puisque le tarif d’entrée est identique ; dans ce cas, les deux modèles sont interchangeables sur le plan des coûts, et le choix
dépendra uniquement des résultats de vos propres évaluations. Comme pour l’ensemble de la famille Gemini, veuillez vérifier le traitement facturé
des prompts dépassant 200 000 jetons avant de concevoir une fonctionnalité exploitant pleinement la fenêtre contextuelle maximale.
traitement des invites comportant plus de 200 000 jetons avant de concevoir une fonctionnalité exploitant l’intégralité du contexte
fenêtre.
Tarification de Gemini 3.6 Flash : coût de l’API par million de jetons
| Entrée (par million de jetons) | $1.50 |
|---|---|
| Sortie (par million de jetons) | $7.50 |
| Ratio sortie/entrée | 5× |
| Moyenne pondérée (4:1 entrée:sortie) | $2.70 par 1 million de jetons |
Coût mensuel de Gemini 3.6 Flash
Dépense mensuelle réelle pour un ratio entrée-sortie de 4:1 — le rapport effectivement observé dans une charge de travail type (chat ou RAG).
| Charge de travail | Jetons/mois | Coût par mois |
|---|---|---|
| Projet secondaire | 1 million en entrée / 0,25 million en sortie | $3.38 |
| Petite équipe | 20 millions en entrée / 5 millions en sortie | $68 |
| Production | 200 millions en entrée / 50 millions en sortie | $675 |
Calculez vos propres coûts dans le Calculateur de coûts pour les API IA.
Alternatives moins chères à Gemini 3.6 Flash
| Modèle | Coût combiné par million de dollars | Vous économisez |
|---|---|---|
| Mistral 7B ouverte | $0.0220 | 99 % moins cher |
| Llama 3.1 8B ouverte | $0.0220 | 99 % moins cher |
| Mistral NeMo 12B ouverte | $0.0240 | 99 % moins cher |
Questions fréquemment posées
Combien coûte Gemini 3.6 Flash par million de jetons ?
Gemini 3.6 Flash coûte 1,50 $ par million de jetons en entrée et 7,50 $ par million de jetons en sortie. Avec un ratio typique entrée/sortie de 4:1, le coût moyen s’établit à environ 2,70 $ par million de jetons.
Combien coûte Gemini 3.6 Flash par mois ?
Une charge de travail mensuelle modeste (20 millions de jetons en entrée et 5 millions en sortie) coûte environ 68 $ avec Gemini 3.6 Flash. Un projet personnel (1 million en entrée / 0,25 million en sortie) coûte environ 3,38 $.
Quelle est une alternative moins chère à Gemini 3.6 Flash ?
Mistral 7B constitue l’option la plus performante et la moins coûteuse de notre base de données, à 0,0220 $ par million de jetons combinés — soit environ 99 % moins cher que Gemini 3.6 Flash. Il s’agit également d’un modèle open-weight, ce qui permet son hébergement privé.
Puis-je exécuter Gemini 3.6 Flash localement ?
Non. Gemini 3.6 Flash est un modèle fermé, accessible uniquement via API — ses poids ne sont pas publiés, ce qui rend impossible son hébergement privé.
Pourquoi Gemini 3.6 Flash facture-t-il davantage les jetons de sortie que ceux d’entrée ?
Les jetons de sortie sont générés un par un et ne peuvent pas être traités en lot comme un prompt, ce qui augmente leur coût de fourniture pour le prestataire. Gemini 3.6 Flash facture ainsi cinq fois plus cher les jetons de sortie, ce qui explique pourquoi les charges de travail axées sur les prompts sont nettement moins coûteuses que celles axées sur la génération.
Comparez les prix de tous les modèles Gemini côte à côte : Tarification de l'API Gemini.
Les prix indiqués correspondent aux tarifs publics officiels pour l’API principale du modèle et sont mis à jour régulièrement à mesure que les fournisseurs les modifient. Les remises liées aux volumes, aux traitements par lots ou aux entrées mises en cache ne sont pas prises en compte. Comparez tous les modèles côte à côte dans le Base de données des modèles IA ou le Classement des grands modèles linguistiques (LLM).
