La Gemini 3.1 Flash-Lite API es nuestra opción predeterminada para alto volumen: calidad de última generación, rápida y lo bastante económica para evitar el buque insignia en la mayoría de las llamadas. El 5% de descuento de RouterBase es margen puro.
La Gemini 3.1 Flash-Lite API es el modelo Gemini 3.1 más rápido y rentable de Google —— ventana de contexto de 1M tokens, entrada nativa de texto/imagen/audio/vídeo/PDF, function calling y salidas JSON estructuradas, optimizado para baja latencia y alto rendimiento. La Gemini 3.1 Flash-Lite API es compatible con OpenAI: apunta cualquier SDK a RouterBase y configura el modelo como gemini-3-1-flash-lite. Entrada a $0.2375 / 1M, salida a $1.425 / 1M, lecturas en caché a $0.02375 / 1M —— 5% por debajo de la tarifa oficial publicada, todo por un endpoint REST.
Gemini 3.1 Flash-Lite API: Chat
Usa la Gemini 3.1 Flash-Lite API para ejecutar el modelo Gemini 3.1 más rápido y económico de Google: contexto de 1M tokens, entrada multimodal nativa y salidas estructuradas.
La Gemini 3.1 Flash-Lite API es el modelo Gemini 3.1 más rápido y rentable de Google: una ventana de contexto de 1M tokens, entrada nativa para texto, imágenes, audio, video y PDF, function calling y salidas JSON estructuradas, ajustado para baja latencia y alto rendimiento. Enrutada a través de RouterBase, la Gemini 3.1 Flash-Lite API es totalmente compatible con OpenAI: apunta cualquier SDK existente a la URL base de RouterBase, configura el modelo como gemini-3-1-flash-lite y tu primera llamada se procesa al instante.
El precio es de $0.2375 / 1M tokens de entrada, $1.425 / 1M tokens de salida y $0.02375 / 1M lecturas de entrada en caché: un 5% por debajo de la tarifa oficial publicada. Una sola clave de RouterBase, sin necesidad de credenciales de Google.
Seis razones por las que los equipos lanzan con la Gemini 3.1 Flash-Lite API
Desde la velocidad de última generación hasta un precio con 5% de descuento: lo que hace destacar a la Gemini 3.1 Flash-Lite API.
El Gemini 3.1 más rápido y económico
La Gemini 3.1 Flash-Lite API es el modelo ligero más nuevo de Google, creado para el menor costo y el mayor rendimiento de la familia Gemini 3.1.
Contexto de 1M tokens
Acepta hasta 1 millón de tokens por solicitud: documentos extensos, código de múltiples archivos o transcripciones de video caben en una sola llamada a la Gemini 3.1 Flash-Lite API sin fragmentación.
Entrada multimodal nativa
La Gemini 3.1 Flash-Lite API entiende texto, imágenes, audio, video y PDF. Envía contenido mixto en una sola solicitud para analizar, transcribir o razonar entre modalidades.
Function calling y JSON
Define herramientas y solicita un esquema JSON; la Gemini 3.1 Flash-Lite API devuelve llamadas a herramientas estructuradas y JSON estrictamente válido para pipelines confiables de agentes y extracción.
Endpoint compatible con OpenAI
La Gemini 3.1 Flash-Lite API habla el formato de chat-completions de OpenAI. Apunta cualquier SDK de OpenAI a RouterBase: sin necesidad de SDK de Google ni credenciales aparte.
Una clave para más de 200 modelos
La misma clave de RouterBase que llama a la Gemini 3.1 Flash-Lite API también enruta a GPT-5, Claude Opus 4.8, Gemini 3.1 Pro y más de 200 modelos adicionales, sin gestionar credenciales por proveedor.

Comienza con la Gemini 3.1 Flash-Lite API en 3 pasos
Del registro a tu primera respuesta en menos de 5 minutos.
Crea una clave de API de RouterBase
Regístrate y genera una clave de API: una sola clave alcanza la Gemini 3.1 Flash-Lite API y todos los demás modelos del catálogo.
Envía tu primer mensaje
Apunta cualquier SDK compatible con OpenAI a routerbase.com/v1 y configura el modelo como gemini-3-1-flash-lite. La respuesta sigue el esquema estándar de chat-completions, con soporte para streaming y entrada multimodal.
Inspecciona el uso
Cada respuesta incluye un desglose detallado de tokens (entrada, salida y lectura de caché), de modo que el costo y la tasa de aciertos de caché son visibles en cada llamada.
Paga sólo por lo que usas
RouterBase repercute precios de nivel partner. Comparado con la tarifa pública oficial del modelo.
Lo que los equipos construyen con la Gemini 3.1 Flash-Lite API
Cargas de producción reales ejecutándose sobre la Gemini 3.1 Flash-Lite API y el catálogo de modelos de RouterBase.
El multimodal nativo de la Gemini 3.1 Flash-Lite API lee video y audio directamente: una sola llamada rápida transcribe y razona sobre el contenido en conjunto.
Las salidas JSON estructuradas de la Gemini 3.1 Flash-Lite API acabaron con nuestro frágil análisis con regex. JSON estrictamente válido siempre, cero reintentos.
Movimos la clasificación y el enrutamiento a la Gemini 3.1 Flash-Lite API y la latencia bajó mientras la calidad subió. RouterBase lo hace un 5% más barato y enruta alrededor de las caídas automáticamente.
1M tokens de contexto a precios de Flash-Lite significa que puedo lanzarle documentos completos de forma económica. La Gemini 3.1 Flash-Lite API simplemente los procesa rápido.
RouterBase pone la Gemini 3.1 Flash-Lite API y más de 200 modelos detrás de una sola clave. Nuestro equipo dejó de tramitar solicitudes de nuevas cuentas de proveedores.
Hacemos pruebas A/B de la Gemini 3.1 Flash-Lite API frente a 3.1 Pro por solicitud: el mismo SDK, un solo campo de modelo. La mayor parte del tráfico se queda en Flash-Lite y la factura bajó drásticamente.
Enrutamos nuestros endpoints de alto volumen a la Gemini 3.1 Flash-Lite API en un fin de semana. El único comentario en el PR fue: 'espera, ¿eso es todo?'.
A $0.2375 / 1M de entrada menos 5%, la Gemini 3.1 Flash-Lite API nos dio inferencia multimodal de última generación a un precio que escala. El cálculo del ROI fue instantáneo.
Preguntas frecuentes
Preguntas comunes sobre la Gemini 3.1 Flash-Lite API.
Es el acceso directo de RouterBase a Gemini 3.1 Flash-Lite de Google: el modelo Gemini 3.1 más rápido y rentable de Google, con un contexto de 1M tokens, entrada nativa de visión/audio/video, function calling y salidas estructuradas, servido a través de una interfaz REST compatible con OpenAI.