La Gemini 3.1 Pro API traite nos jeux de documents de 800K tokens en un seul appel — sans chunking, sans glu de retrieval. Le contexte de 1M a changé notre façon de construire.
L'API Gemini 3.1 Pro est le modèle multimodal de raisonnement phare de Google —— une fenêtre de contexte de 1M tokens, une entrée native texte/image/audio/vidéo/PDF, un raisonnement avancé, le function calling et des sorties JSON structurées. L'API Gemini 3.1 Pro est compatible OpenAI : pointez n'importe quel SDK vers RouterBase et définissez le modèle sur gemini-3-1-pro-preview. Entrée à $1.40 / 1M, sortie à $8.40 / 1M, lectures en cache à $0.14 / 1M —— 5% sous le tarif standard (tarif de base pour les prompts jusqu'à 200K tokens), le tout via un endpoint REST.
Gemini 3.1 Pro API : Chat
Utilisez la Gemini 3.1 Pro API pour exécuter le modèle de raisonnement multimodal phare de Google, doté d'une fenêtre de contexte de 1M tokens.
La Gemini 3.1 Pro API est le modèle Gemini Pro phare de Google — une fenêtre de contexte de 1M tokens, une entrée multimodale native (texte, images, audio, vidéo, PDF), un raisonnement avancé, le function calling et des sorties JSON structurées. Routée via RouterBase, elle est entièrement compatible OpenAI : pointez n'importe quel SDK existant vers l'URL de base de RouterBase, définissez le modèle sur gemini-3-1-pro-preview, et votre premier appel passe immédiatement.
La tarification est de $1.40 / 1M tokens en entrée, $8.40 / 1M tokens en sortie et $0.14 / 1M lectures d'entrée mises en cache — 5 % en dessous du tarif standard. Le tarif de base s'applique aux prompts allant jusqu'à 200K tokens. Une seule clé RouterBase — aucun identifiant Google requis.
Six raisons pour lesquelles les équipes déploient sur la Gemini 3.1 Pro API
Du contexte multimodal de 1M tokens à la tarification à -5 % — ce qui distingue Gemini 3.1 Pro.
Contexte de 1M tokens
Accepte jusqu'à 1 million de tokens par requête (tarif de base pour les prompts jusqu'à 200K) — des bases de code entières, de longs documents ou des transcriptions vidéo tiennent dans un seul appel à la Gemini 3.1 Pro API.
Entrée multimodale native
La Gemini 3.1 Pro API comprend le texte, les images, l'audio, la vidéo et les PDF. Transmettez des médias mixtes dans une seule requête pour analyser, transcrire ou raisonner à travers les modalités.
Raisonnement avancé
Gemini 3.1 Pro réfléchit avant de répondre, en allouant davantage de calcul aux problèmes difficiles — performant en mathématiques multi-étapes, en codage et en analyse complexe.
Function calling & JSON
Définissez des outils et demandez un schéma JSON ; la Gemini 3.1 Pro API renvoie des appels d'outils structurés et un JSON strictement valide pour des pipelines d'agents et d'extraction fiables.
Endpoint compatible OpenAI
La Gemini 3.1 Pro API parle le format wire chat-completions d'OpenAI. Pointez n'importe quel SDK OpenAI vers RouterBase — aucun SDK Google ni identifiant distinct nécessaire.
Une clé pour 200+ modèles
La même clé RouterBase qui appelle la Gemini 3.1 Pro API route aussi vers GPT-5, Claude Opus 4.8, GPT-4o mini et 200+ autres modèles — sans gestion d'identifiants par fournisseur.

Démarrer avec la Gemini 3.1 Pro API en 3 étapes
De l'inscription à votre première réponse en moins de 5 minutes.
Créer une clé d'API RouterBase
Inscrivez-vous et générez une clé d'API — une seule clé atteint la Gemini 3.1 Pro API et tous les autres modèles du catalogue.
Envoyer votre premier message
Pointez n'importe quel SDK compatible OpenAI vers routerbase.com/v1 et définissez le modèle sur gemini-3-1-pro-preview. La réponse suit le schéma chat-completions standard — le streaming et l'entrée multimodale sont pris en charge.
Inspecter l'utilisation
Chaque réponse inclut une ventilation détaillée des tokens — entrée, sortie et tokens de lecture en cache — de sorte que le coût et le taux de succès du cache sont visibles à chaque appel.
Ne payez que ce que vous utilisez
RouterBase répercute les prix partenaires. Comparé au tarif public officiel du modèle.
Ce que les équipes construisent avec la Gemini 3.1 Pro API
De véritables charges de production tournant sur la Gemini 3.1 Pro API et le catalogue de modèles RouterBase.
Nous alimentons la Gemini 3.1 Pro API directement avec de la vidéo et des PDF — un seul appel multimodal a remplacé trois pipelines distincts.
Passer à la Gemini 3.1 Pro API a représenté une modification de deux lignes via RouterBase. La qualité du raisonnement a bondi et la remise de 5 % est de la marge pure.
Le raisonnement de Gemini 3.1 Pro a résolu des tâches de planification que notre modèle précédent ne pouvait pas aborder. La précision a progressé de 31 % sur notre benchmark interne.
Un million de tokens de contexte signifie que je peux envoyer un dépôt entier plus la documentation à la Gemini 3.1 Pro API. Fini la glu de chunking.
RouterBase place la Gemini 3.1 Pro API et 200+ autres modèles derrière une seule clé. Notre équipe a cessé de déposer des demandes pour de nouveaux comptes de fournisseurs.
Les sorties JSON structurées de la Gemini 3.1 Pro API ont éliminé notre parsing instable — un JSON strictement valide à chaque fois, même sur des entrées multimodales.
Nous avons migré 42 services vers la Gemini 3.1 Pro API en un week-end. Le seul commentaire de PR était : attends, c'est tout ?
Les lectures en cache à $0.14 / 1M sur la Gemini 3.1 Pro API ont rendu nos fonctionnalités à long contexte abordables. Le calcul du ROI a été immédiat.
Foire aux questions
Questions fréquentes sur la Gemini 3.1 Pro API.
C'est le pass-through de RouterBase vers le Gemini 3.1 Pro de Google — un endpoint de chat multimodal phare doté d'un contexte de 1M tokens, d'un raisonnement avancé, d'une entrée vision/audio/vidéo native, du function calling et de sorties structurées, servi via une interface REST compatible OpenAI.