G
Google · Gemini 3

Gemini 3.1 Flash-Lite

alto volumen · latencia · coste

Ficha técnica

API / IDgemini-3.1-flash-lite
Contexto1 M tokens
Salida máxima64 k tokens
Modalidadestext, image, video, audio, pdf → text

Precio verificado

INPUT / 1M$0.25
OUTPUT / 1M$1.5
ESCENARIO$40.00100M input + 10M output

Precio de referencia por 1M tokens; audio puede tener tarifa de entrada distinta.

Abrir calculadora de coste →

Capacidades documentadas

Una etiqueta significa que la documentación de la fuente o la ficha del modelo declara esa capacidad. No significa que todos los proveedores la implementen igual ni que el modelo sea el mejor en ella.

Cómo compararlo con otro modelo

  1. Define 10–30 casos reales y una rúbrica antes de probar.
  2. Calcula coste completo: input, output, reintentos, herramientas, caching y contexto largo.
  3. Mide latencia p50/p95, no sólo una respuesta rápida.
  4. Revisa modalidad, límites, disponibilidad regional y políticas de datos.
  5. Vuelve a verificar esta ficha si la fecha de revisión ha vencido.

Comparar modelos con datos →

Fuente y procedencia

Guía Gemini 3

Datos revisados el 2026-08-22. Los campos de precio, contexto y disponibilidad pueden cambiar.

Abrir fuente oficial ↗
EVIDENCIA12 claims · 12 primarios · 12 fresh
Auditar datos →