Gemini 3.6 Flash — Especificaciones
Compiled by Mustafa Ihsan from the vendor’s published documentation · Last updated
| Desarrollador | |
|---|---|
| Tipo | Rápido / general |
| Modalidad | Texto, visión y audio |
| Parámetros | No revelado |
| Ventana de contexto | 1 millón |
| Salida máxima | 64 K |
| Licencia | Propietario |
| Pesos abiertos | No |
| Lanzado | 2026-07 |
| Precio de entrada | $1.50 /1M |
| Precio de salida | $7.50 /1M |
| Proveedores de API | Google AI Studio, Vertex AI |
¿Qué es Gemini 3.6 Flash?
Gemini 3.6 Flash es el modelo más reciente de Google en la categoría Flash, lanzado el 21 de julio de 2026, con un
contexto de 1 millón de tokens y un precio de 1,50 $ por millón de tokens de entrada y 7,50 $ por millón de tokens de salida. Para aclarar una confusión frecuente
en búsquedas: no existe ningún modelo Gemini 4 hasta julio de 2026; Gemini 3.6 Flash es el lanzamiento más reciente de Gemini
y cualquier afirmación en contrario corresponde a especulaciones.
En comparación con Gemini 3.5 Flash, el precio de entrada se mantiene sin cambios en 1,50 $, mientras que el precio de salida baja de 9 $
a 7,50 $: una reducción del 17 % en el lado de la factura que normalmente representa la mayor parte del costo. Para cargas de trabajo centradas en generación,
esto supone un ahorro directo sin implicar ninguna pérdida de capacidades según lo indicado por su estructura de precios, lo que convierte a Gemini 3.6 Flash
en la opción predeterminada dentro de la línea Flash para nuevos proyectos. Donde esta diferencia no será perceptible es en cargas de trabajo basadas principalmente en prompts y recuperación de información, ya que el precio de entrada
es idéntico; en ese caso, ambos modelos son intercambiables desde el punto de vista de coste y la decisión dependerá
de los resultados de sus propias evaluaciones. Como ocurre con el resto de la familia Gemini, verifique el tratamiento facturable de los prompts que superen los 200 000 tokens antes de diseñar una función que aproveche toda la ventana de contexto.
a lo que muestren sus evaluaciones. Como ocurre con el resto de la familia Gemini, confirme la facturación
del tratamiento de indicaciones con más de 200 000 tokens antes de diseñar una función basada en el contexto completo
de la ventana.
Precio de Gemini 3.6 Flash: costo de la API por cada millón de tokens
| Entrada (por cada millón de tokens) | $1.50 |
|---|---|
| Salida (por cada millón de tokens) | $7.50 |
| Relación salida/entrada | 5× |
| Combinada (4:1 entrada:salida) | $2.70 por 1 millón de tokens |
Cuánto cuesta Gemini 3.6 Flash al mes
Gasto mensual real con una mezcla entrada:salida de 4:1, es decir, la proporción que realmente genera una carga de trabajo típica de chat o RAG.
| Carga de trabajo | Tokens/mes | Coste mensual |
|---|---|---|
| Proyecto secundario | 1 millón de tokens de entrada / 0,25 millones de tokens de salida | $3.38 |
| Pequeño equipo | 20 millones de tokens de entrada / 5 millones de tokens de salida | $68 |
| Producción | 200 millones de tokens de entrada / 50 millones de tokens de salida | $675 |
Calcule sus propios números en la Calculadora de costos de API de IA.
Alternativas más económicas a Gemini 3.6 Flash
| Modelo | Dólares por millón combinados | Usted ahorra |
|---|---|---|
| Mistral 7B abierta | $0.0220 | 99 % más barato |
| Llama 3.1 8B abierta | $0.0220 | 99 % más barato |
| Mistral NeMo 12B abierta | $0.0240 | 99 % más barato |
Preguntas frecuentes
¿Cuánto cuesta Gemini 3.6 Flash por cada millón de tokens?
Gemini 3.6 Flash cuesta 1,50 $ por cada millón de tokens de entrada y 7,50 $ por cada millón de tokens de salida. Con una mezcla típica entrada/salida de 4:1, el costo promedio resultante es de aproximadamente 2,70 $ por cada millón de tokens.
¿Cuánto cuesta Gemini 3.6 Flash al mes?
Una carga de trabajo mensual de un pequeño equipo de 20 millones de tokens de entrada y 5 millones de tokens de salida tiene un costo aproximado de 68 $ con Gemini 3.6 Flash. Un proyecto secundario (1 millón de tokens de entrada y 0,25 millones de tokens de salida) cuesta aproximadamente 3,38 $.
¿Cuál es una alternativa más económica a Gemini 3.6 Flash?
Mistral 7B es la opción más potente y económica disponible en nuestra base de datos, con un costo combinado de 0,0220 $ por millón de tokens, es decir, aproximadamente un 99 % menos que Gemini 3.6 Flash. Además, es un modelo de pesos abiertos, por lo que también es posible alojarlo localmente.
¿Puedo ejecutar Gemini 3.6 Flash localmente?
No. Gemini 3.6 Flash es un modelo cerrado disponible únicamente mediante API; sus pesos no están disponibles públicamente, por lo que no puede alojarse localmente.
¿Por qué Gemini 3.6 Flash cobra más por los tokens de salida que por los de entrada?
Los tokens de salida se generan uno a uno y no pueden agruparse («batched») como sí puede hacerse con un prompt, por lo que su procesamiento implica mayores costos para el proveedor. Gemini 3.6 Flash cobra cinco veces más por los tokens de salida, razón por la cual las cargas de trabajo centradas en prompts son mucho más económicas que las centradas en generación.
Compare los precios de todos los modelos Gemini uno al lado del otro: Precios de la API Gemini.
Los precios corresponden a las tarifas oficiales publicadas para la API principal del modelo y se revisan periódicamente conforme los proveedores los actualicen. No incluyen descuentos por volumen, procesamiento por lotes ni entradas en caché. Compare todos los modelos uno al lado del otro en la Base de datos de modelos de IA o el Clasificación de modelos de lenguaje grande (LLM).
