chat.gemini_3_5_flash
google/gemini-3-5-flash

La Gemini 3.5 Flash API es el modelo multimodal rápido y eficiente de Google —— ventana de contexto de 1M tokens, entrada nativa de texto/imagen/audio/video/PDF, function calling y salidas JSON estructuradas, optimizado para baja latencia y alto rendimiento. La Gemini 3.5 Flash API es compatible con OpenAI: apunta cualquier SDK a RouterBase y configura el modelo en gemini-3-5-flash. Entrada a $1.05 / 1M, salida a $6.30 / 1M, lecturas en caché a $0.105 / 1M —— 5% por debajo de la tarifa estándar, todo por un endpoint REST.

Input
Gemini 3.5 Flash
max_tokens4096
temperature1
top_p1
presence_penalty0
frequency_penalty0
Gemini 3.5 Flash Online
Hi! I'm a helpful AI assistant. What can I do for you?

API de Gemini 3.5 Flash: Chat

Usa la API de Gemini 3.5 Flash para ejecutar el modelo multimodal rápido y eficiente de Google con una ventana de contexto de 1M de tokens.

La API de Gemini 3.5 Flash es el modelo multimodal de Google optimizado para la velocidad: una ventana de contexto de 1M de tokens, entrada nativa de texto, imágenes, audio, video y PDF, function calling y salidas estructuradas en JSON, ajustado para baja latencia y alto rendimiento. Enrutado a través de RouterBase, es totalmente compatible con OpenAI: apunta cualquier SDK existente a la URL base de RouterBase, define el modelo como gemini-3-5-flash y tu primera llamada se procesa de inmediato.

El precio es de $1.05 / 1M de tokens de entrada, $6.30 / 1M de tokens de salida y $0.105 / 1M de lecturas de entrada en caché, un 5% por debajo de la tarifa estándar. Una sola clave de RouterBase, sin necesidad de credenciales de Google.

Por qué este modelo

Seis razones por las que los equipos lanzan con la API de Gemini 3.5 Flash

Desde la inferencia multimodal rápida hasta un precio con 5% de descuento: lo que hace destacar a Gemini 3.5 Flash.

Contexto de 1M de tokens

Acepta hasta 1 millón de tokens por solicitud: documentos largos, código de varios archivos o transcripciones de video caben en una sola llamada a la API de Gemini 3.5 Flash.

Entrada multimodal nativa

La API de Gemini 3.5 Flash entiende texto, imágenes, audio, video y PDF. Envía medios mixtos en una sola solicitud para analizar, transcribir o razonar entre modalidades.

Rápido y de alto rendimiento

Ajustado para baja latencia y alto volumen: la API de Gemini 3.5 Flash ofrece velocidad de nivel Flash para chat, clasificación, extracción y enrutamiento a escala.

Function calling y JSON

Define herramientas y solicita un esquema JSON; la API de Gemini 3.5 Flash devuelve llamadas a herramientas estructuradas y JSON estrictamente válido para pipelines de agentes y extracción confiables.

Endpoint compatible con OpenAI

La API de Gemini 3.5 Flash habla el formato de chat-completions de OpenAI. Apunta cualquier SDK de OpenAI a RouterBase: sin SDK de Google ni credenciales separadas.

Una clave para más de 200 modelos

La misma clave de RouterBase que llama a la API de Gemini 3.5 Flash también enruta a GPT-5, Claude Opus 4.8, GPT-4o mini y más de 200 modelos adicionales, sin gestionar credenciales por proveedor.

RouterBase dashboard preview
Inicio rápido

Comienza con la API de Gemini 3.5 Flash en 3 pasos

Desde el registro hasta tu primera respuesta en menos de 5 minutos.

  1. Crea una clave de API de RouterBase

    Regístrate y genera una clave de API: una sola clave alcanza la API de Gemini 3.5 Flash y todos los demás modelos del catálogo.

  2. Envía tu primer mensaje

    Apunta cualquier SDK compatible con OpenAI a routerbase.com/v1 y define el modelo como gemini-3-5-flash. La respuesta sigue el esquema estándar de chat-completions, con soporte para streaming y entrada multimodal.

  3. Inspecciona el uso

    Cada respuesta incluye un desglose detallado de tokens (entrada, salida y lecturas de caché), de modo que el costo y la tasa de aciertos de caché son visibles en cada llamada.

Precios

Paga sólo por lo que usas

RouterBase repercute precios de nivel partner. Comparado con la tarifa pública oficial del modelo.

Historias de clientes

Lo que los equipos construyen con la API de Gemini 3.5 Flash

Cargas reales de producción ejecutándose sobre la API de Gemini 3.5 Flash y el catálogo de modelos de RouterBase.

Marcus Reyes
Marcus ReyesCTO, Paradigm AI

Enrutamos chat de alto volumen a través de la API de Gemini 3.5 Flash: respuestas multimodales rápidas a escala, y el 5% de descuento de RouterBase es margen puro.

Priya Lakshmi
Priya LakshmiFounder, Quillo

La visión nativa en la API de Gemini 3.5 Flash reemplazó un pipeline de OCR: una sola llamada rápida describe y extrae, texto e imagen juntos.

Thomas Beck
Thomas BeckStaff Engineer, Northbeam

Las salidas JSON estructuradas de la API de Gemini 3.5 Flash acabaron con nuestro análisis inestable: JSON estrictamente válido siempre, incluso con entradas multimodales.

Aoi Tanaka
Aoi TanakaML Lead, Daybreak Robotics

La latencia de nivel Flash en la API de Gemini 3.5 Flash nos permitió pasar la clasificación a tiempo real. RouterBase la hace un 5% más barata todavía.

Jonas Keller
Jonas KellerIndie Developer

El contexto de 1M en la API de Gemini 3.5 Flash significa que puedo lanzarle documentos enteros y aun así obtener respuestas rápidas. Sin pegamento de fragmentación.

Ethan Nguyen
Ethan NguyenHead of Engineering, Compound Studio

RouterBase pone la API de Gemini 3.5 Flash y más de 200 modelos adicionales detrás de una sola clave. Nuestro equipo dejó de pedir cuentas de nuevos proveedores.

Sophia Martín
Sophia MartínCTO, Relay

Hacemos pruebas A/B de la API de Gemini 3.5 Flash contra Pro por solicitud: el mismo SDK, un solo campo de modelo. La mayoría del tráfico se queda en Flash y la latencia bajó.

Lucas Fernandes
Lucas FernandesEngineering Manager, Light

Migramos 42 servicios a la API de Gemini 3.5 Flash en un fin de semana. El único comentario en el PR fue: '¿espera, eso es todo?'.

David Okonkwo
David OkonkwoCo-founder, Figment

Las lecturas de caché a $0.105 / 1M en la API de Gemini 3.5 Flash hicieron asequibles nuestras funciones de contexto largo. El cálculo del ROI fue instantáneo.

Preguntas frecuentes

Preguntas comunes sobre la API de Gemini 3.5 Flash.

Es el acceso directo de RouterBase a Gemini 3.5 Flash de Google: un endpoint de chat multimodal rápido y eficiente con un contexto de 1M de tokens, entrada nativa de visión/audio/video, function calling y salidas estructuradas, servido mediante una interfaz REST compatible con OpenAI.