La Gemini 3 Flash Preview API est notre choix quotidien — qualité de dernière génération, rapide et assez bon marché pour éviter le modèle phare sur la plupart des appels. La réduction RouterBase de 5% est de la marge pure.
L'API Gemini 3 Flash (Preview) est le modèle multimodal rapide et économique de Google —— une fenêtre de contexte de 1M tokens, l'entrée native de texte, images, audio, vidéo et PDF, le raisonnement, le function calling et des sorties JSON structurées. L'API Gemini 3 Flash est compatible OpenAI : pointez n'importe quel SDK vers RouterBase et définissez le modèle sur gemini-3-flash-preview. Entrée à $0.475 / 1M, sortie à $2.85 / 1M, lectures en cache à $0.0475 / 1M —— le tout via un endpoint REST.
Gemini 3 Flash Preview API : Chat
Utilisez la Gemini 3 Flash Preview API pour exécuter le modèle multimodal Gemini 3 rapide et peu coûteux de Google — un contexte de 1M tokens, une entrée native vision/audio/vidéo et des sorties structurées.
La Gemini 3 Flash Preview API est le modèle multimodal Gemini 3 rapide et économique de Google — une fenêtre de contexte de 1M tokens, une entrée native pour le texte, les images, l'audio, la vidéo et le PDF, le function calling et des sorties JSON structurées, optimisé pour une faible latence et un débit élevé. Routée via RouterBase, la Gemini 3 Flash Preview API est entièrement compatible OpenAI : pointez n'importe quel SDK existant vers l'URL de base de RouterBase, définissez le modèle sur gemini-3-flash-preview, et votre premier appel à la Gemini 3 Flash Preview API passe immédiatement.
Les tarifs de la Gemini 3 Flash Preview API sont de $0.475 / 1M tokens en entrée, $2.85 / 1M tokens en sortie et $0.0475 / 1M lectures d'entrée mises en cache — 5% en dessous du tarif officiel publié. Une seule clé RouterBase — aucun identifiant Google requis.
Six raisons pour lesquelles les équipes déploient sur la Gemini 3 Flash Preview API
De la vitesse de dernière génération à une réduction de 5% — ce qui distingue la Gemini 3 Flash Preview API.
Gemini 3 rapide et équilibré
La Gemini 3 Flash Preview API est le cheval de bataille de dernière génération de Google — réglé pour le meilleur équilibre entre vitesse, qualité et coût dans la famille Gemini 3.
Contexte de 1M tokens
Accepte jusqu'à 1 million de tokens par requête — documents longs, code multi-fichiers ou transcriptions vidéo tiennent dans un seul appel à la Gemini 3 Flash Preview API sans découpage.
Entrée multimodale native
La Gemini 3 Flash Preview API comprend le texte, les images, l'audio, la vidéo et les PDF. Transmettez des médias mixtes dans une seule requête pour analyser, transcrire ou raisonner sur plusieurs modalités.
Function calling & JSON
Définissez des outils et demandez un schéma JSON ; la Gemini 3 Flash Preview API renvoie des appels d'outils structurés et un JSON strictement valide pour des pipelines d'agents et d'extraction fiables.
Endpoint compatible OpenAI
La Gemini 3 Flash Preview API parle le format de transmission chat-completions d'OpenAI. Pointez n'importe quel SDK OpenAI vers RouterBase — aucun SDK Google ni identifiants distincts nécessaires.
Une clé pour 200+ modèles
La même clé RouterBase qui appelle la Gemini 3 Flash Preview API route aussi vers GPT-5, Claude Opus 4.8, Gemini 3 Pro et 200+ autres modèles — aucune gestion d'identifiants par fournisseur.

Démarrez avec la Gemini 3 Flash Preview API en 3 étapes
De l'inscription à votre première réponse en moins de 5 minutes.
Créez une clé API RouterBase
Inscrivez-vous et générez une clé API — une seule clé atteint la Gemini 3 Flash Preview API et tous les autres modèles du catalogue.
Envoyez votre premier message
Pointez n'importe quel SDK compatible OpenAI vers routerbase.com/v1 et définissez le modèle sur gemini-3-flash-preview. La réponse de la Gemini 3 Flash Preview API suit le schéma standard chat-completions — streaming et entrée multimodale pris en charge.
Inspectez l'utilisation
Chaque réponse de la Gemini 3 Flash Preview API inclut une ventilation détaillée des tokens — entrée, sortie et tokens de lecture du cache — afin que le coût et le taux de succès du cache soient visibles à chaque appel.
Ne payez que ce que vous utilisez
RouterBase répercute les prix partenaires. Comparé au tarif public officiel du modèle.
Ce que les équipes construisent avec la Gemini 3 Flash Preview API
De vraies charges de production tournant sur la Gemini 3 Flash Preview API et le catalogue de modèles RouterBase.
Le multimodal natif de la Gemini 3 Flash Preview API lit directement la vidéo et l'audio — un seul appel rapide transcrit et raisonne sur le contenu en même temps.
Les sorties JSON structurées de la Gemini 3 Flash Preview API ont éliminé notre analyse regex peu fiable. Un JSON strictement valide à chaque fois, zéro relance.
Nous avons déplacé la classification et le routage vers la Gemini 3 Flash Preview API et la latence a baissé tandis que la qualité montait. RouterBase la rend 5% moins chère et contourne automatiquement les pannes.
1M tokens de contexte aux prix de Flash signifie que je peux lui balancer des documents entiers à moindre coût. La Gemini 3 Flash Preview API les traite tout simplement rapidement.
RouterBase place la Gemini 3 Flash Preview API et 200+ autres modèles derrière une seule clé. Notre équipe a cessé de déposer des demandes pour de nouveaux comptes fournisseurs.
Nous testons en A/B la Gemini 3 Flash Preview API contre 3 Pro par requête — même SDK, un seul champ de modèle. La majeure partie du trafic reste sur Flash et la facture a fortement chuté.
Nous avons routé nos endpoints à gros volume vers la Gemini 3 Flash Preview API en un week-end. Le seul commentaire de PR était 'attends, c'est tout ?'.
À $0.475 / 1M en entrée moins 5%, la Gemini 3 Flash Preview API nous a donné une inférence multimodale de dernière génération à un prix qui passe à l'échelle. Le calcul du ROI était immédiat.
Questions fréquentes
Questions courantes sur la Gemini 3 Flash Preview API.
C'est le pass-through de RouterBase vers Gemini 3 Flash (Preview) de Google — le modèle Gemini 3 rapide et économique de Google, avec un contexte de 1M tokens, une entrée native vision/audio/vidéo, le function calling et des sorties structurées, servi via une interface REST compatible OpenAI.