chat.gemini_3_1_flash_lite_preview
google/gemini-3-1-flash-lite

La Gemini 3.1 Flash-Lite API es el modelo Gemini 3.1 más rápido y rentable de Google —— ventana de contexto de 1M tokens, entrada nativa de texto/imagen/audio/vídeo/PDF, function calling y salidas JSON estructuradas, optimizado para baja latencia y alto rendimiento. La Gemini 3.1 Flash-Lite API es compatible con OpenAI: apunta cualquier SDK a RouterBase y configura el modelo como gemini-3-1-flash-lite. Entrada a $0.2375 / 1M, salida a $1.425 / 1M, lecturas en caché a $0.02375 / 1M —— 5% por debajo de la tarifa oficial publicada, todo por un endpoint REST.

Input
Gemini 3.1 Flash-Lite
max_tokens4096
temperature1
top_p1
presence_penalty0
frequency_penalty0
Gemini 3.1 Flash-Lite Online
Hi! I'm a helpful AI assistant. What can I do for you?

Gemini 3.1 Flash-Lite API: Chat

Usa la Gemini 3.1 Flash-Lite API para ejecutar el modelo Gemini 3.1 más rápido y económico de Google: contexto de 1M tokens, entrada multimodal nativa y salidas estructuradas.

La Gemini 3.1 Flash-Lite API es el modelo Gemini 3.1 más rápido y rentable de Google: una ventana de contexto de 1M tokens, entrada nativa para texto, imágenes, audio, video y PDF, function calling y salidas JSON estructuradas, ajustado para baja latencia y alto rendimiento. Enrutada a través de RouterBase, la Gemini 3.1 Flash-Lite API es totalmente compatible con OpenAI: apunta cualquier SDK existente a la URL base de RouterBase, configura el modelo como gemini-3-1-flash-lite y tu primera llamada se procesa al instante.

El precio es de $0.2375 / 1M tokens de entrada, $1.425 / 1M tokens de salida y $0.02375 / 1M lecturas de entrada en caché: un 5% por debajo de la tarifa oficial publicada. Una sola clave de RouterBase, sin necesidad de credenciales de Google.

Por qué este modelo

Seis razones por las que los equipos lanzan con la Gemini 3.1 Flash-Lite API

Desde la velocidad de última generación hasta un precio con 5% de descuento: lo que hace destacar a la Gemini 3.1 Flash-Lite API.

El Gemini 3.1 más rápido y económico

La Gemini 3.1 Flash-Lite API es el modelo ligero más nuevo de Google, creado para el menor costo y el mayor rendimiento de la familia Gemini 3.1.

Contexto de 1M tokens

Acepta hasta 1 millón de tokens por solicitud: documentos extensos, código de múltiples archivos o transcripciones de video caben en una sola llamada a la Gemini 3.1 Flash-Lite API sin fragmentación.

Entrada multimodal nativa

La Gemini 3.1 Flash-Lite API entiende texto, imágenes, audio, video y PDF. Envía contenido mixto en una sola solicitud para analizar, transcribir o razonar entre modalidades.

Function calling y JSON

Define herramientas y solicita un esquema JSON; la Gemini 3.1 Flash-Lite API devuelve llamadas a herramientas estructuradas y JSON estrictamente válido para pipelines confiables de agentes y extracción.

Endpoint compatible con OpenAI

La Gemini 3.1 Flash-Lite API habla el formato de chat-completions de OpenAI. Apunta cualquier SDK de OpenAI a RouterBase: sin necesidad de SDK de Google ni credenciales aparte.

Una clave para más de 200 modelos

La misma clave de RouterBase que llama a la Gemini 3.1 Flash-Lite API también enruta a GPT-5, Claude Opus 4.8, Gemini 3.1 Pro y más de 200 modelos adicionales, sin gestionar credenciales por proveedor.

RouterBase dashboard preview
Inicio rápido

Comienza con la Gemini 3.1 Flash-Lite API en 3 pasos

Del registro a tu primera respuesta en menos de 5 minutos.

  1. Crea una clave de API de RouterBase

    Regístrate y genera una clave de API: una sola clave alcanza la Gemini 3.1 Flash-Lite API y todos los demás modelos del catálogo.

  2. Envía tu primer mensaje

    Apunta cualquier SDK compatible con OpenAI a routerbase.com/v1 y configura el modelo como gemini-3-1-flash-lite. La respuesta sigue el esquema estándar de chat-completions, con soporte para streaming y entrada multimodal.

  3. Inspecciona el uso

    Cada respuesta incluye un desglose detallado de tokens (entrada, salida y lectura de caché), de modo que el costo y la tasa de aciertos de caché son visibles en cada llamada.

Precios

Paga sólo por lo que usas

RouterBase repercute precios de nivel partner. Comparado con la tarifa pública oficial del modelo.

Historias de clientes

Lo que los equipos construyen con la Gemini 3.1 Flash-Lite API

Cargas de producción reales ejecutándose sobre la Gemini 3.1 Flash-Lite API y el catálogo de modelos de RouterBase.

Marcus Reyes
Marcus ReyesCTO, Paradigm AI

La Gemini 3.1 Flash-Lite API es nuestra opción predeterminada para alto volumen: calidad de última generación, rápida y lo bastante económica para evitar el buque insignia en la mayoría de las llamadas. El 5% de descuento de RouterBase es margen puro.

Priya Lakshmi
Priya LakshmiFounder, Quillo

El multimodal nativo de la Gemini 3.1 Flash-Lite API lee video y audio directamente: una sola llamada rápida transcribe y razona sobre el contenido en conjunto.

Thomas Beck
Thomas BeckStaff Engineer, Northbeam

Las salidas JSON estructuradas de la Gemini 3.1 Flash-Lite API acabaron con nuestro frágil análisis con regex. JSON estrictamente válido siempre, cero reintentos.

Aoi Tanaka
Aoi TanakaML Lead, Daybreak Robotics

Movimos la clasificación y el enrutamiento a la Gemini 3.1 Flash-Lite API y la latencia bajó mientras la calidad subió. RouterBase lo hace un 5% más barato y enruta alrededor de las caídas automáticamente.

Jonas Keller
Jonas KellerIndie Developer

1M tokens de contexto a precios de Flash-Lite significa que puedo lanzarle documentos completos de forma económica. La Gemini 3.1 Flash-Lite API simplemente los procesa rápido.

Ethan Nguyen
Ethan NguyenHead of Engineering, Compound Studio

RouterBase pone la Gemini 3.1 Flash-Lite API y más de 200 modelos detrás de una sola clave. Nuestro equipo dejó de tramitar solicitudes de nuevas cuentas de proveedores.

Sophia Martín
Sophia MartínCTO, Relay

Hacemos pruebas A/B de la Gemini 3.1 Flash-Lite API frente a 3.1 Pro por solicitud: el mismo SDK, un solo campo de modelo. La mayor parte del tráfico se queda en Flash-Lite y la factura bajó drásticamente.

Lucas Fernandes
Lucas FernandesEngineering Manager, Light

Enrutamos nuestros endpoints de alto volumen a la Gemini 3.1 Flash-Lite API en un fin de semana. El único comentario en el PR fue: 'espera, ¿eso es todo?'.

David Okonkwo
David OkonkwoCo-founder, Figment

A $0.2375 / 1M de entrada menos 5%, la Gemini 3.1 Flash-Lite API nos dio inferencia multimodal de última generación a un precio que escala. El cálculo del ROI fue instantáneo.

Preguntas frecuentes

Preguntas comunes sobre la Gemini 3.1 Flash-Lite API.

Es el acceso directo de RouterBase a Gemini 3.1 Flash-Lite de Google: el modelo Gemini 3.1 más rápido y rentable de Google, con un contexto de 1M tokens, entrada nativa de visión/audio/video, function calling y salidas estructuradas, servido a través de una interfaz REST compatible con OpenAI.