Enrutamos chat de alto volumen a través de la API de Gemini 3.5 Flash: respuestas multimodales rápidas a escala, y el 5% de descuento de RouterBase es margen puro.
La Gemini 3.5 Flash API es el modelo multimodal rápido y eficiente de Google —— ventana de contexto de 1M tokens, entrada nativa de texto/imagen/audio/video/PDF, function calling y salidas JSON estructuradas, optimizado para baja latencia y alto rendimiento. La Gemini 3.5 Flash API es compatible con OpenAI: apunta cualquier SDK a RouterBase y configura el modelo en gemini-3-5-flash. Entrada a $1.05 / 1M, salida a $6.30 / 1M, lecturas en caché a $0.105 / 1M —— 5% por debajo de la tarifa estándar, todo por un endpoint REST.
API de Gemini 3.5 Flash: Chat
Usa la API de Gemini 3.5 Flash para ejecutar el modelo multimodal rápido y eficiente de Google con una ventana de contexto de 1M de tokens.
La API de Gemini 3.5 Flash es el modelo multimodal de Google optimizado para la velocidad: una ventana de contexto de 1M de tokens, entrada nativa de texto, imágenes, audio, video y PDF, function calling y salidas estructuradas en JSON, ajustado para baja latencia y alto rendimiento. Enrutado a través de RouterBase, es totalmente compatible con OpenAI: apunta cualquier SDK existente a la URL base de RouterBase, define el modelo como gemini-3-5-flash y tu primera llamada se procesa de inmediato.
El precio es de $1.05 / 1M de tokens de entrada, $6.30 / 1M de tokens de salida y $0.105 / 1M de lecturas de entrada en caché, un 5% por debajo de la tarifa estándar. Una sola clave de RouterBase, sin necesidad de credenciales de Google.
Seis razones por las que los equipos lanzan con la API de Gemini 3.5 Flash
Desde la inferencia multimodal rápida hasta un precio con 5% de descuento: lo que hace destacar a Gemini 3.5 Flash.
Contexto de 1M de tokens
Acepta hasta 1 millón de tokens por solicitud: documentos largos, código de varios archivos o transcripciones de video caben en una sola llamada a la API de Gemini 3.5 Flash.
Entrada multimodal nativa
La API de Gemini 3.5 Flash entiende texto, imágenes, audio, video y PDF. Envía medios mixtos en una sola solicitud para analizar, transcribir o razonar entre modalidades.
Rápido y de alto rendimiento
Ajustado para baja latencia y alto volumen: la API de Gemini 3.5 Flash ofrece velocidad de nivel Flash para chat, clasificación, extracción y enrutamiento a escala.
Function calling y JSON
Define herramientas y solicita un esquema JSON; la API de Gemini 3.5 Flash devuelve llamadas a herramientas estructuradas y JSON estrictamente válido para pipelines de agentes y extracción confiables.
Endpoint compatible con OpenAI
La API de Gemini 3.5 Flash habla el formato de chat-completions de OpenAI. Apunta cualquier SDK de OpenAI a RouterBase: sin SDK de Google ni credenciales separadas.
Una clave para más de 200 modelos
La misma clave de RouterBase que llama a la API de Gemini 3.5 Flash también enruta a GPT-5, Claude Opus 4.8, GPT-4o mini y más de 200 modelos adicionales, sin gestionar credenciales por proveedor.

Comienza con la API de Gemini 3.5 Flash en 3 pasos
Desde el registro hasta tu primera respuesta en menos de 5 minutos.
Crea una clave de API de RouterBase
Regístrate y genera una clave de API: una sola clave alcanza la API de Gemini 3.5 Flash y todos los demás modelos del catálogo.
Envía tu primer mensaje
Apunta cualquier SDK compatible con OpenAI a routerbase.com/v1 y define el modelo como gemini-3-5-flash. La respuesta sigue el esquema estándar de chat-completions, con soporte para streaming y entrada multimodal.
Inspecciona el uso
Cada respuesta incluye un desglose detallado de tokens (entrada, salida y lecturas de caché), de modo que el costo y la tasa de aciertos de caché son visibles en cada llamada.
Paga sólo por lo que usas
RouterBase repercute precios de nivel partner. Comparado con la tarifa pública oficial del modelo.
Lo que los equipos construyen con la API de Gemini 3.5 Flash
Cargas reales de producción ejecutándose sobre la API de Gemini 3.5 Flash y el catálogo de modelos de RouterBase.
La visión nativa en la API de Gemini 3.5 Flash reemplazó un pipeline de OCR: una sola llamada rápida describe y extrae, texto e imagen juntos.
Las salidas JSON estructuradas de la API de Gemini 3.5 Flash acabaron con nuestro análisis inestable: JSON estrictamente válido siempre, incluso con entradas multimodales.
La latencia de nivel Flash en la API de Gemini 3.5 Flash nos permitió pasar la clasificación a tiempo real. RouterBase la hace un 5% más barata todavía.
El contexto de 1M en la API de Gemini 3.5 Flash significa que puedo lanzarle documentos enteros y aun así obtener respuestas rápidas. Sin pegamento de fragmentación.
RouterBase pone la API de Gemini 3.5 Flash y más de 200 modelos adicionales detrás de una sola clave. Nuestro equipo dejó de pedir cuentas de nuevos proveedores.
Hacemos pruebas A/B de la API de Gemini 3.5 Flash contra Pro por solicitud: el mismo SDK, un solo campo de modelo. La mayoría del tráfico se queda en Flash y la latencia bajó.
Migramos 42 servicios a la API de Gemini 3.5 Flash en un fin de semana. El único comentario en el PR fue: '¿espera, eso es todo?'.
Las lecturas de caché a $0.105 / 1M en la API de Gemini 3.5 Flash hicieron asequibles nuestras funciones de contexto largo. El cálculo del ROI fue instantáneo.
Preguntas frecuentes
Preguntas comunes sobre la API de Gemini 3.5 Flash.
Es el acceso directo de RouterBase a Gemini 3.5 Flash de Google: un endpoint de chat multimodal rápido y eficiente con un contexto de 1M de tokens, entrada nativa de visión/audio/video, function calling y salidas estructuradas, servido mediante una interfaz REST compatible con OpenAI.