chat.gemini_3_5_flash
google/gemini-3-5-flash

L'API Gemini 3.5 Flash est le modèle multimodal rapide et efficace de Google —— une fenêtre de contexte de 1M tokens, une entrée native texte/image/audio/vidéo/PDF, le function calling et des sorties JSON structurées, optimisée pour une faible latence et un débit élevé. L'API Gemini 3.5 Flash est compatible OpenAI : pointez n'importe quel SDK vers RouterBase et définissez le modèle sur gemini-3-5-flash. Entrée à $1.05 / 1M, sortie à $6.30 / 1M, lectures en cache à $0.105 / 1M —— 5% sous le tarif standard, le tout via un endpoint REST.

Input
Gemini 3.5 Flash
max_tokens4096
temperature1
top_p1
presence_penalty0
frequency_penalty0
Gemini 3.5 Flash Online
Hi! I'm a helpful AI assistant. What can I do for you?

API Gemini 3.5 Flash : Chat

Utilisez l'API Gemini 3.5 Flash pour exécuter le modèle multimodal rapide et efficace de Google, doté d'une fenêtre de contexte de 1M tokens.

L'API Gemini 3.5 Flash est le modèle multimodal de Google optimisé pour la vitesse — une fenêtre de contexte de 1M tokens, une entrée native pour le texte, les images, l'audio, la vidéo et le PDF, le function calling ainsi que des sorties JSON structurées, le tout réglé pour une faible latence et un débit élevé. Acheminée via RouterBase, elle est entièrement compatible OpenAI : pointez n'importe quel SDK existant vers l'URL de base de RouterBase, définissez le modèle sur gemini-3-5-flash, et votre premier appel passe immédiatement.

La tarification est de $1.05 / 1M tokens d'entrée, $6.30 / 1M tokens de sortie et $0.105 / 1M lectures d'entrée en cache — 5 % en dessous du tarif standard. Une seule clé RouterBase — aucun identifiant Google requis.

Pourquoi ce modèle

Six raisons pour lesquelles les équipes déploient sur l'API Gemini 3.5 Flash

De l'inférence multimodale rapide à une tarification réduite de 5 % — ce qui distingue Gemini 3.5 Flash.

Contexte de 1M tokens

Accepte jusqu'à 1 million de tokens par requête — documents longs, code multi-fichiers ou transcriptions vidéo tiennent dans un seul appel à l'API Gemini 3.5 Flash.

Entrée multimodale native

L'API Gemini 3.5 Flash comprend le texte, les images, l'audio, la vidéo et les PDF. Transmettez des médias mixtes dans une seule requête pour analyser, transcrire ou raisonner à travers les modalités.

Rapide et à haut débit

Réglée pour une faible latence et un volume élevé : l'API Gemini 3.5 Flash offre une vitesse de niveau Flash pour le chat, la classification, l'extraction et le routage à grande échelle.

Function calling et JSON

Définissez des outils et demandez un schéma JSON ; l'API Gemini 3.5 Flash renvoie des appels d'outils structurés et un JSON strictement valide pour des pipelines d'agents et d'extraction fiables.

Point de terminaison compatible OpenAI

L'API Gemini 3.5 Flash parle le format de transmission chat-completions d'OpenAI. Pointez n'importe quel SDK OpenAI vers RouterBase — aucun SDK Google ni identifiants distincts nécessaires.

Une clé pour 200+ modèles

La même clé RouterBase qui appelle l'API Gemini 3.5 Flash achemine aussi vers GPT-5, Claude Opus 4.8, GPT-4o mini et 200+ autres modèles — aucune gestion d'identifiants par fournisseur.

RouterBase dashboard preview
Démarrage rapide

Démarrez avec l'API Gemini 3.5 Flash en 3 étapes

De l'inscription à votre première réponse en moins de 5 minutes.

  1. Créez une clé API RouterBase

    Inscrivez-vous et générez une clé API — une seule clé atteint l'API Gemini 3.5 Flash et tous les autres modèles du catalogue.

  2. Envoyez votre premier message

    Pointez n'importe quel SDK compatible OpenAI vers routerbase.com/v1 et définissez le modèle sur gemini-3-5-flash. La réponse suit le schéma standard chat-completions — le streaming et l'entrée multimodale sont pris en charge.

  3. Examinez l'utilisation

    Chaque réponse inclut une ventilation détaillée des tokens — entrée, sortie et tokens lus en cache — de sorte que le coût et le taux de succès du cache sont visibles à chaque appel.

Tarifs

Ne payez que ce que vous utilisez

RouterBase répercute les prix partenaires. Comparé au tarif public officiel du modèle.

Témoignages clients

Ce que les équipes construisent avec l'API Gemini 3.5 Flash

De véritables charges de production tournant sur l'API Gemini 3.5 Flash et le catalogue de modèles RouterBase.

Marcus Reyes
Marcus ReyesCTO, Paradigm AI

Nous acheminons le chat à fort volume via l'API Gemini 3.5 Flash — des réponses multimodales rapides à grande échelle, et la remise de 5 % de RouterBase est de la marge pure.

Priya Lakshmi
Priya LakshmiFounder, Quillo

La vision native sur l'API Gemini 3.5 Flash a remplacé un pipeline OCR — un seul appel rapide légende et extrait, texte et image ensemble.

Thomas Beck
Thomas BeckStaff Engineer, Northbeam

Les sorties JSON structurées de l'API Gemini 3.5 Flash ont éliminé notre analyse instable — un JSON strictement valide à chaque fois, même sur des entrées multimodales.

Aoi Tanaka
Aoi TanakaML Lead, Daybreak Robotics

La latence de niveau Flash de l'API Gemini 3.5 Flash nous a permis de passer la classification en ligne. RouterBase la rend encore 5 % moins chère.

Jonas Keller
Jonas KellerIndie Developer

Le contexte de 1M de l'API Gemini 3.5 Flash signifie que je peux lui envoyer des documents entiers et obtenir quand même des réponses rapides. Aucune glu de découpage.

Ethan Nguyen
Ethan NguyenHead of Engineering, Compound Studio

RouterBase place l'API Gemini 3.5 Flash et 200+ autres modèles derrière une seule clé. Notre équipe a cessé de soumettre des demandes pour de nouveaux comptes fournisseurs.

Sophia Martín
Sophia MartínCTO, Relay

Nous testons l'API Gemini 3.5 Flash en A/B contre Pro par requête — le même SDK, un seul champ de modèle. La majeure partie du trafic reste sur Flash et la latence a chuté.

Lucas Fernandes
Lucas FernandesEngineering Manager, Light

Nous avons migré 42 services vers l'API Gemini 3.5 Flash en un week-end. Le seul commentaire de PR était : « attends, c'est tout ? ».

David Okonkwo
David OkonkwoCo-founder, Figment

Les lectures en cache à $0.105 / 1M sur l'API Gemini 3.5 Flash ont rendu nos fonctionnalités à long contexte abordables. Le calcul du ROI a été immédiat.

Questions fréquentes

Questions courantes sur l'API Gemini 3.5 Flash.

C'est l'accès direct de RouterBase à Gemini 3.5 Flash de Google — un point de terminaison de chat multimodal rapide et efficace avec un contexte de 1M tokens, une entrée native vision/audio/vidéo, le function calling et des sorties structurées, servi via une interface REST compatible OpenAI.