Nous acheminons le chat à fort volume via l'API Gemini 3.5 Flash — des réponses multimodales rapides à grande échelle, et la remise de 5 % de RouterBase est de la marge pure.
L'API Gemini 3.5 Flash est le modèle multimodal rapide et efficace de Google —— une fenêtre de contexte de 1M tokens, une entrée native texte/image/audio/vidéo/PDF, le function calling et des sorties JSON structurées, optimisée pour une faible latence et un débit élevé. L'API Gemini 3.5 Flash est compatible OpenAI : pointez n'importe quel SDK vers RouterBase et définissez le modèle sur gemini-3-5-flash. Entrée à $1.05 / 1M, sortie à $6.30 / 1M, lectures en cache à $0.105 / 1M —— 5% sous le tarif standard, le tout via un endpoint REST.
API Gemini 3.5 Flash : Chat
Utilisez l'API Gemini 3.5 Flash pour exécuter le modèle multimodal rapide et efficace de Google, doté d'une fenêtre de contexte de 1M tokens.
L'API Gemini 3.5 Flash est le modèle multimodal de Google optimisé pour la vitesse — une fenêtre de contexte de 1M tokens, une entrée native pour le texte, les images, l'audio, la vidéo et le PDF, le function calling ainsi que des sorties JSON structurées, le tout réglé pour une faible latence et un débit élevé. Acheminée via RouterBase, elle est entièrement compatible OpenAI : pointez n'importe quel SDK existant vers l'URL de base de RouterBase, définissez le modèle sur gemini-3-5-flash, et votre premier appel passe immédiatement.
La tarification est de $1.05 / 1M tokens d'entrée, $6.30 / 1M tokens de sortie et $0.105 / 1M lectures d'entrée en cache — 5 % en dessous du tarif standard. Une seule clé RouterBase — aucun identifiant Google requis.
Six raisons pour lesquelles les équipes déploient sur l'API Gemini 3.5 Flash
De l'inférence multimodale rapide à une tarification réduite de 5 % — ce qui distingue Gemini 3.5 Flash.
Contexte de 1M tokens
Accepte jusqu'à 1 million de tokens par requête — documents longs, code multi-fichiers ou transcriptions vidéo tiennent dans un seul appel à l'API Gemini 3.5 Flash.
Entrée multimodale native
L'API Gemini 3.5 Flash comprend le texte, les images, l'audio, la vidéo et les PDF. Transmettez des médias mixtes dans une seule requête pour analyser, transcrire ou raisonner à travers les modalités.
Rapide et à haut débit
Réglée pour une faible latence et un volume élevé : l'API Gemini 3.5 Flash offre une vitesse de niveau Flash pour le chat, la classification, l'extraction et le routage à grande échelle.
Function calling et JSON
Définissez des outils et demandez un schéma JSON ; l'API Gemini 3.5 Flash renvoie des appels d'outils structurés et un JSON strictement valide pour des pipelines d'agents et d'extraction fiables.
Point de terminaison compatible OpenAI
L'API Gemini 3.5 Flash parle le format de transmission chat-completions d'OpenAI. Pointez n'importe quel SDK OpenAI vers RouterBase — aucun SDK Google ni identifiants distincts nécessaires.
Une clé pour 200+ modèles
La même clé RouterBase qui appelle l'API Gemini 3.5 Flash achemine aussi vers GPT-5, Claude Opus 4.8, GPT-4o mini et 200+ autres modèles — aucune gestion d'identifiants par fournisseur.

Démarrez avec l'API Gemini 3.5 Flash en 3 étapes
De l'inscription à votre première réponse en moins de 5 minutes.
Créez une clé API RouterBase
Inscrivez-vous et générez une clé API — une seule clé atteint l'API Gemini 3.5 Flash et tous les autres modèles du catalogue.
Envoyez votre premier message
Pointez n'importe quel SDK compatible OpenAI vers routerbase.com/v1 et définissez le modèle sur gemini-3-5-flash. La réponse suit le schéma standard chat-completions — le streaming et l'entrée multimodale sont pris en charge.
Examinez l'utilisation
Chaque réponse inclut une ventilation détaillée des tokens — entrée, sortie et tokens lus en cache — de sorte que le coût et le taux de succès du cache sont visibles à chaque appel.
Ne payez que ce que vous utilisez
RouterBase répercute les prix partenaires. Comparé au tarif public officiel du modèle.
Ce que les équipes construisent avec l'API Gemini 3.5 Flash
De véritables charges de production tournant sur l'API Gemini 3.5 Flash et le catalogue de modèles RouterBase.
La vision native sur l'API Gemini 3.5 Flash a remplacé un pipeline OCR — un seul appel rapide légende et extrait, texte et image ensemble.
Les sorties JSON structurées de l'API Gemini 3.5 Flash ont éliminé notre analyse instable — un JSON strictement valide à chaque fois, même sur des entrées multimodales.
La latence de niveau Flash de l'API Gemini 3.5 Flash nous a permis de passer la classification en ligne. RouterBase la rend encore 5 % moins chère.
Le contexte de 1M de l'API Gemini 3.5 Flash signifie que je peux lui envoyer des documents entiers et obtenir quand même des réponses rapides. Aucune glu de découpage.
RouterBase place l'API Gemini 3.5 Flash et 200+ autres modèles derrière une seule clé. Notre équipe a cessé de soumettre des demandes pour de nouveaux comptes fournisseurs.
Nous testons l'API Gemini 3.5 Flash en A/B contre Pro par requête — le même SDK, un seul champ de modèle. La majeure partie du trafic reste sur Flash et la latence a chuté.
Nous avons migré 42 services vers l'API Gemini 3.5 Flash en un week-end. Le seul commentaire de PR était : « attends, c'est tout ? ».
Les lectures en cache à $0.105 / 1M sur l'API Gemini 3.5 Flash ont rendu nos fonctionnalités à long contexte abordables. Le calcul du ROI a été immédiat.
Questions fréquentes
Questions courantes sur l'API Gemini 3.5 Flash.
C'est l'accès direct de RouterBase à Gemini 3.5 Flash de Google — un point de terminaison de chat multimodal rapide et efficace avec un contexte de 1M tokens, une entrée native vision/audio/vidéo, le function calling et des sorties structurées, servi via une interface REST compatible OpenAI.