InicioModelosGemini 1.5 Flash
GoogleFast Nivel Vision

Gemini 1.5 Flash

Google · Released April 2024

Precio de Entrada

$0.07

por 1M tokens

Precio de Salida

$0.30

por 1M tokens

Ventana de Contexto

1.0M

tokens

Puntuacion de Velocidad

99

de 100

Benchmarks

Prom. 81/100
Coding72/100
Reasoning76/100
Extraction93/100
Creative78/100
Vision85/100

Precios

Entrada

Tokens de prompt / contexto

$0.07/ 1M

Salida

Tokens generados

$0.30/ 1M

Ideal Para

extractionchatbotvisionanalysis

Gemini 1.5 Flash en contexto

En una mezcla típica de 70% entrada / 30% salida, Gemini 1.5 Flash sale a $0.14 por millón de tokens. Eso lo sitúa por encima del 3% de los 32 modelos que seguimos aquí, y 1 modelos más de la misma capa económica quedan por debajo. La capa es una etiqueta de capacidad, no una banda de precio: la horquilla dentro de una capa suele ser más ancha que la distancia entre capas, y por eso elegir solo por capa tiende a hacer gastar de más.

La entrada cuesta $0.07 por millón y la salida $0.30, una proporción de 4.0x. Esa proporción importa más que cualquiera de las dos cifras por separado: una carga de resumen o clasificación lee mucho más de lo que escribe y seguirá el precio de entrada, mientras que la generación de código o la escritura larga lo invierten y seguirán el de salida. Compara modelos según la proporción real de tu tráfico, no según el precio de entrada.

El perfil de benchmarks es irregular, no plano: extracción de datos con 93/100 frente a programación con 72/100, una horquilla de 21 puntos. La media lo oculta. Si tu carga cae en el extremo fuerte, este modelo rinde por encima de su precio; si cae en el débil, un modelo más barato con un perfil más plano te servirá mejor.

La ventana de contexto es de 1M tokens y la puntuación de rendimiento, 99/100. El contexto solo se gana su sitio si lo llenas, y llenarlo es justo lo que encarece una petición: una ventana grande es una opción, no un descuento. Para un modelo de capa económica, juzga la velocidad según lo que hagas: lo decide todo en chat interactivo y casi nada en procesos nocturnos por lotes.

Nada más barato en la tabla iguala a Gemini 1.5 Flash en programación y razonamiento combinados, así que su precio mezclado de $0.14 compra una capacidad que ahora mismo no consigues por menos. Ese es el argumento para pagarlo, y conviene revisarlo, porque esta es exactamente la posición que se lleva por delante cualquier lanzamiento nuevo.

La comparación más cercana es GPT-5 Nano, de OpenAI, a $0.11 por millón frente a $0.14. 8 modelos de esta capa puntúan más alto en programación y razonamiento combinados, que es el encuadre útil: la pregunta rara vez es si un modelo es bueno, sino si es lo más barato que resulta suficientemente bueno para el trabajo concreto que le envías.

Lo que cuesta en producción

Con 10M + 2M tokens al mes —una carga de producción mediana realista— Gemini 1.5 Flash cuesta unos $1.35. Este modelo no tiene descuento por lotes, así que esa cifra es el suelo: aquí no está disponible la palanca habitual de mover el trabajo de fondo a una capa asíncrona más barata.

Historial de Precios

DateInput / 1MOutput / 1MChange
Apr 2024$0.35$1.05Launch
Sep 2024Current$0.07$0.3079% cut

Fortalezas

  • Cheapest model with strong vision capabilities
  • 1M token context at minimal cost
  • Very fast response times
  • Good structured output

Evitar Para

  • Advanced code generation
  • Complex multi-step reasoning