Enrutamos el 90% de nuestro tráfico a través de la Gemini 2.5 Flash Lite API: clasificación y extracción a una fracción del costo. El 5% de descuento de RouterBase es margen puro.
La Gemini 2.5 Flash Lite API es el modelo Gemini 2.5 más rápido y económico de Google —— ventana de contexto de 1M tokens, entrada nativa de texto/imagen/audio/video/PDF, function calling y salidas JSON estructuradas, optimizado para baja latencia y alto rendimiento. La Gemini 2.5 Flash Lite API es compatible con OpenAI: apunta cualquier SDK a RouterBase y configura el modelo en gemini-2-5-flash-lite. Entrada a $0.095 / 1M, salida a $0.34 / 1M, lecturas en caché a $0.0095 / 1M —— 5% por debajo de la tarifa oficial publicada, todo por un endpoint REST.
Gemini 2.5 Flash Lite API: Chat
Usa la Gemini 2.5 Flash Lite API para ejecutar el modelo Gemini 2.5 más rápido y rentable de Google, con una ventana de contexto de 1M tokens y entrada multimodal.
La Gemini 2.5 Flash Lite API es el modelo Gemini 2.5 más pequeño y rentable de Google: una ventana de contexto de 1M tokens, entrada nativa de texto, imágenes, audio, video y PDF, function calling y salidas estructuradas en JSON, optimizado para la menor latencia y el mayor rendimiento a escala. Enrutada a través de RouterBase, la Gemini 2.5 Flash Lite API es totalmente compatible con OpenAI: apunta cualquier SDK existente a la URL base de RouterBase, define el modelo como gemini-2-5-flash-lite y tu primera llamada se ejecuta de inmediato.
El precio es de $0.095 / 1M tokens de entrada, $0.34 / 1M tokens de salida y $0.0095 / 1M lecturas de entrada en caché, un 5% por debajo de la tarifa oficial publicada. Una sola clave de RouterBase, sin necesidad de credenciales de Google.
Seis razones por las que los equipos lanzan con la Gemini 2.5 Flash Lite API
De una ventana de contexto de 1M tokens a un precio con 5% de descuento: lo que hace destacar a la Gemini 2.5 Flash Lite API.
Contexto de 1M tokens
Acepta hasta 1 millón de tokens por solicitud: documentos largos, código de múltiples archivos o transcripciones de video caben en una sola llamada a la Gemini 2.5 Flash Lite API sin fragmentar.
El nivel 2.5 más rápido y económico
Diseñada para cargas de gran volumen: la Gemini 2.5 Flash Lite API es el modelo Gemini 2.5 de menor costo, a $0.095 / 1M tokens de entrada, ideal para clasificación, resumen, extracción y enrutamiento a escala.
Entrada multimodal nativa
La Gemini 2.5 Flash Lite API entiende texto, imágenes, audio, video y PDF. Pasa medios mixtos en una sola solicitud para analizar, transcribir o razonar entre modalidades.
Function calling y JSON
Define herramientas y solicita un esquema JSON; la Gemini 2.5 Flash Lite API devuelve llamadas a herramientas estructuradas y JSON estrictamente válido para pipelines confiables de agentes y extracción.
Endpoint compatible con OpenAI
La Gemini 2.5 Flash Lite API habla el formato de chat-completions de OpenAI. Apunta cualquier SDK de OpenAI a RouterBase: sin SDK de Google ni credenciales aparte.
Una clave para más de 200 modelos
La misma clave de RouterBase que llama a la Gemini 2.5 Flash Lite API también enruta a GPT-5, Claude Opus 4.8, Gemini 2.5 Pro y 200+ modelos más, sin gestionar credenciales por proveedor.

Empieza con la Gemini 2.5 Flash Lite API en 3 pasos
Del registro a tu primera respuesta en menos de 5 minutos.
Crea una clave de API de RouterBase
Regístrate y genera una clave de API: una sola clave llega a la Gemini 2.5 Flash Lite API y a todos los demás modelos del catálogo.
Envía tu primer mensaje
Apunta cualquier SDK compatible con OpenAI a routerbase.com/v1 y define el modelo como gemini-2-5-flash-lite. La respuesta sigue el esquema estándar de chat-completions, con soporte para streaming y entrada multimodal.
Inspecciona el uso
Cada respuesta incluye un desglose detallado de tokens (entrada, salida y lecturas de caché), de modo que el costo y la tasa de aciertos de caché son visibles en cada llamada.
Paga sólo por lo que usas
RouterBase repercute precios de nivel partner. Comparado con la tarifa pública oficial del modelo.
Lo que los equipos construyen con la Gemini 2.5 Flash Lite API
Cargas reales de producción funcionando sobre la Gemini 2.5 Flash Lite API y el catálogo de modelos de RouterBase.
El multimodal nativo de la Gemini 2.5 Flash Lite API lee imágenes y audio directamente: una sola llamada rápida y económica subtitula y transcribe a la vez.
Las salidas en JSON estructurado de la Gemini 2.5 Flash Lite API acabaron con nuestro frágil parseo por regex. JSON estrictamente válido siempre, cero reintentos.
Con nuestro volumen, Flash-Lite es el único modelo Gemini 2.5 que sale a cuenta. RouterBase lo hace un 5% más barato todavía.
La Gemini 2.5 Flash Lite API gestiona mi bucle de resumen de gran volumen. Tan barato que dejé de contar tokens.
RouterBase pone la Gemini 2.5 Flash Lite API y más de 200 modelos detrás de una sola clave. Nuestro equipo dejó de solicitar cuentas de nuevos proveedores.
Hacemos A/B de la Gemini 2.5 Flash Lite API contra Gemini 2.5 Pro por solicitud: el mismo SDK, un solo campo de modelo. La mayor parte del tráfico se queda en Flash-Lite y la factura bajó un 70%.
Migramos 42 servicios a la Gemini 2.5 Flash Lite API en un fin de semana. El único comentario en el PR fue: '¿espera, eso es todo?'.
A $0.095 / 1M de entrada menos 5%, la Gemini 2.5 Flash Lite API hizo que nuestras funciones de gran volumen fueran realmente rentables. El cálculo del ROI fue instantáneo.
Preguntas frecuentes
Preguntas comunes sobre la Gemini 2.5 Flash Lite API.
Es el acceso directo de RouterBase a Gemini 2.5 Flash-Lite de Google: el endpoint de chat Gemini 2.5 más rápido y económico, con un contexto de 1M tokens, entrada nativa de visión/audio/video, function calling y salidas estructuradas, servido a través de una interfaz REST compatible con OpenAI.