chat.gemini_2_5_flash_lite
google/gemini-2-5-flash-lite

La Gemini 2.5 Flash Lite API es el modelo Gemini 2.5 más rápido y económico de Google —— ventana de contexto de 1M tokens, entrada nativa de texto/imagen/audio/video/PDF, function calling y salidas JSON estructuradas, optimizado para baja latencia y alto rendimiento. La Gemini 2.5 Flash Lite API es compatible con OpenAI: apunta cualquier SDK a RouterBase y configura el modelo en gemini-2-5-flash-lite. Entrada a $0.095 / 1M, salida a $0.34 / 1M, lecturas en caché a $0.0095 / 1M —— 5% por debajo de la tarifa oficial publicada, todo por un endpoint REST.

Input
Gemini 2.5 Flash-Lite
max_tokens4096
temperature1
top_p1
presence_penalty0
frequency_penalty0
Gemini 2.5 Flash-Lite Online
Hi! I'm a helpful AI assistant. What can I do for you?

Gemini 2.5 Flash Lite API: Chat

Usa la Gemini 2.5 Flash Lite API para ejecutar el modelo Gemini 2.5 más rápido y rentable de Google, con una ventana de contexto de 1M tokens y entrada multimodal.

La Gemini 2.5 Flash Lite API es el modelo Gemini 2.5 más pequeño y rentable de Google: una ventana de contexto de 1M tokens, entrada nativa de texto, imágenes, audio, video y PDF, function calling y salidas estructuradas en JSON, optimizado para la menor latencia y el mayor rendimiento a escala. Enrutada a través de RouterBase, la Gemini 2.5 Flash Lite API es totalmente compatible con OpenAI: apunta cualquier SDK existente a la URL base de RouterBase, define el modelo como gemini-2-5-flash-lite y tu primera llamada se ejecuta de inmediato.

El precio es de $0.095 / 1M tokens de entrada, $0.34 / 1M tokens de salida y $0.0095 / 1M lecturas de entrada en caché, un 5% por debajo de la tarifa oficial publicada. Una sola clave de RouterBase, sin necesidad de credenciales de Google.

Por qué este modelo

Seis razones por las que los equipos lanzan con la Gemini 2.5 Flash Lite API

De una ventana de contexto de 1M tokens a un precio con 5% de descuento: lo que hace destacar a la Gemini 2.5 Flash Lite API.

Contexto de 1M tokens

Acepta hasta 1 millón de tokens por solicitud: documentos largos, código de múltiples archivos o transcripciones de video caben en una sola llamada a la Gemini 2.5 Flash Lite API sin fragmentar.

El nivel 2.5 más rápido y económico

Diseñada para cargas de gran volumen: la Gemini 2.5 Flash Lite API es el modelo Gemini 2.5 de menor costo, a $0.095 / 1M tokens de entrada, ideal para clasificación, resumen, extracción y enrutamiento a escala.

Entrada multimodal nativa

La Gemini 2.5 Flash Lite API entiende texto, imágenes, audio, video y PDF. Pasa medios mixtos en una sola solicitud para analizar, transcribir o razonar entre modalidades.

Function calling y JSON

Define herramientas y solicita un esquema JSON; la Gemini 2.5 Flash Lite API devuelve llamadas a herramientas estructuradas y JSON estrictamente válido para pipelines confiables de agentes y extracción.

Endpoint compatible con OpenAI

La Gemini 2.5 Flash Lite API habla el formato de chat-completions de OpenAI. Apunta cualquier SDK de OpenAI a RouterBase: sin SDK de Google ni credenciales aparte.

Una clave para más de 200 modelos

La misma clave de RouterBase que llama a la Gemini 2.5 Flash Lite API también enruta a GPT-5, Claude Opus 4.8, Gemini 2.5 Pro y 200+ modelos más, sin gestionar credenciales por proveedor.

RouterBase dashboard preview
Inicio rápido

Empieza con la Gemini 2.5 Flash Lite API en 3 pasos

Del registro a tu primera respuesta en menos de 5 minutos.

  1. Crea una clave de API de RouterBase

    Regístrate y genera una clave de API: una sola clave llega a la Gemini 2.5 Flash Lite API y a todos los demás modelos del catálogo.

  2. Envía tu primer mensaje

    Apunta cualquier SDK compatible con OpenAI a routerbase.com/v1 y define el modelo como gemini-2-5-flash-lite. La respuesta sigue el esquema estándar de chat-completions, con soporte para streaming y entrada multimodal.

  3. Inspecciona el uso

    Cada respuesta incluye un desglose detallado de tokens (entrada, salida y lecturas de caché), de modo que el costo y la tasa de aciertos de caché son visibles en cada llamada.

Precios

Paga sólo por lo que usas

RouterBase repercute precios de nivel partner. Comparado con la tarifa pública oficial del modelo.

Historias de clientes

Lo que los equipos construyen con la Gemini 2.5 Flash Lite API

Cargas reales de producción funcionando sobre la Gemini 2.5 Flash Lite API y el catálogo de modelos de RouterBase.

Marcus Reyes
Marcus ReyesCTO, Paradigm AI

Enrutamos el 90% de nuestro tráfico a través de la Gemini 2.5 Flash Lite API: clasificación y extracción a una fracción del costo. El 5% de descuento de RouterBase es margen puro.

Priya Lakshmi
Priya LakshmiFounder, Quillo

El multimodal nativo de la Gemini 2.5 Flash Lite API lee imágenes y audio directamente: una sola llamada rápida y económica subtitula y transcribe a la vez.

Thomas Beck
Thomas BeckStaff Engineer, Northbeam

Las salidas en JSON estructurado de la Gemini 2.5 Flash Lite API acabaron con nuestro frágil parseo por regex. JSON estrictamente válido siempre, cero reintentos.

Aoi Tanaka
Aoi TanakaML Lead, Daybreak Robotics

Con nuestro volumen, Flash-Lite es el único modelo Gemini 2.5 que sale a cuenta. RouterBase lo hace un 5% más barato todavía.

Jonas Keller
Jonas KellerIndie Developer

La Gemini 2.5 Flash Lite API gestiona mi bucle de resumen de gran volumen. Tan barato que dejé de contar tokens.

Ethan Nguyen
Ethan NguyenHead of Engineering, Compound Studio

RouterBase pone la Gemini 2.5 Flash Lite API y más de 200 modelos detrás de una sola clave. Nuestro equipo dejó de solicitar cuentas de nuevos proveedores.

Sophia Martín
Sophia MartínCTO, Relay

Hacemos A/B de la Gemini 2.5 Flash Lite API contra Gemini 2.5 Pro por solicitud: el mismo SDK, un solo campo de modelo. La mayor parte del tráfico se queda en Flash-Lite y la factura bajó un 70%.

Lucas Fernandes
Lucas FernandesEngineering Manager, Light

Migramos 42 servicios a la Gemini 2.5 Flash Lite API en un fin de semana. El único comentario en el PR fue: '¿espera, eso es todo?'.

David Okonkwo
David OkonkwoCo-founder, Figment

A $0.095 / 1M de entrada menos 5%, la Gemini 2.5 Flash Lite API hizo que nuestras funciones de gran volumen fueran realmente rentables. El cálculo del ROI fue instantáneo.

Preguntas frecuentes

Preguntas comunes sobre la Gemini 2.5 Flash Lite API.

Es el acceso directo de RouterBase a Gemini 2.5 Flash-Lite de Google: el endpoint de chat Gemini 2.5 más rápido y económico, con un contexto de 1M tokens, entrada nativa de visión/audio/video, function calling y salidas estructuradas, servido a través de una interfaz REST compatible con OpenAI.