Nous acheminons 90% de notre trafic via la GPT-5 nano API — classification et extraction de niveau raisonnement à une fraction du coût. La remise de 5% de RouterBase est de la marge pure.
L'API GPT-5 nano est le modèle GPT-5 le plus rapide et le moins cher d'OpenAI —— une fenêtre de contexte de 400K tokens, un raisonnement ajustable, la vision (texte + image), le function calling et des sorties JSON structurées, optimisée pour une faible latence et un débit élevé. L'API GPT-5 nano est compatible OpenAI : pointez n'importe quel SDK vers RouterBase et définissez le modèle sur gpt-5-nano. Entrée à $0.03 / 1M, sortie à $0.24 / 1M, lectures en cache à $0.003 / 1M —— 5% sous le tarif standard, le tout via un endpoint REST.
GPT-5 nano API : Chat
Utilisez la GPT-5 nano API pour exécuter le modèle GPT-5 le plus rapide et le moins cher d'OpenAI — raisonnement, fenêtre de contexte de 400K tokens et vision.
La GPT-5 nano API est le modèle GPT-5 le plus petit et le plus économique d'OpenAI — une fenêtre de contexte de 400K tokens, la vision (entrée texte et image), un effort de raisonnement ajustable, le function calling et des sorties JSON structurées, optimisé pour une faible latence et un débit élevé. Acheminé via RouterBase, il est entièrement compatible OpenAI : pointez n'importe quel SDK existant vers l'URL de base de RouterBase, définissez le modèle sur gpt-5-nano, et votre premier appel passe immédiatement.
La tarification est de $0.03 / 1M tokens d'entrée, $0.24 / 1M tokens de sortie et $0.003 / 1M lectures d'entrée mises en cache — 5% en dessous du tarif standard. Une seule clé RouterBase — aucun identifiant OpenAI distinct requis.
Six raisons pour lesquelles les équipes déploient sur la GPT-5 nano API
D'une fenêtre de contexte de 400K tokens à une tarification réduite de 5% — ce qui distingue GPT-5 nano.
Fenêtre de contexte de 400K tokens
Accepte jusqu'à 400 000 tokens par requête — longs documents, code réparti sur plusieurs fichiers ou historique de chat étendu tiennent dans un seul appel de la GPT-5 nano API.
Le raisonnement au prix nano
La GPT-5 nano API expose un effort de raisonnement ajustable — augmentez-le pour les problèmes plus difficiles ou réduisez-le pour la vitesse, le tout au tarif le moins cher de la famille GPT-5.
Le palier GPT-5 le plus rapide et le moins cher
Conçue pour les charges de travail à fort volume : la GPT-5 nano API est le modèle GPT-5 le moins cher à $0.03 / 1M tokens d'entrée — idéale pour la classification, l'autocomplétion, l'extraction et le routage à grande échelle.
Vision et function calling
La GPT-5 nano API accepte des images aux côtés du texte et renvoie des appels d'outils structurés — transmettez une URL d'image ou du base64, définissez des outils et demandez un JSON strictement valide.
Point de terminaison compatible OpenAI
La GPT-5 nano API utilise le format réseau chat-completions d'OpenAI. Tout SDK Python, Node, Go ou Rust qui fonctionne avec OpenAI fonctionne ici — il suffit de mettre à jour l'URL de base.
Une clé pour 200+ modèles
La même clé RouterBase qui appelle la GPT-5 nano API achemine aussi vers GPT-5, Claude Opus 4.8, Gemini 3.5 Flash et 200+ autres modèles — sans gestion d'identifiants par fournisseur.

Lancez-vous avec la GPT-5 nano API en 3 étapes
De l'inscription à votre première réponse en moins de 5 minutes.
Créez une clé d'API RouterBase
Inscrivez-vous et générez une clé d'API — une seule clé donne accès à la GPT-5 nano API et à tous les autres modèles du catalogue.
Envoyez votre premier message
Pointez n'importe quel SDK compatible OpenAI vers routerbase.com/v1 et définissez le modèle sur gpt-5-nano. La réponse suit le schéma standard chat-completions — streaming, raisonnement et vision pris en charge.
Inspectez l'utilisation
Chaque réponse inclut une ventilation détaillée des tokens — entrée, sortie, raisonnement et tokens lus en cache — pour que le coût et le taux de succès du cache soient visibles à chaque appel.
Ne payez que ce que vous utilisez
RouterBase répercute les prix partenaires. Comparé au tarif public officiel du modèle.
Ce que les équipes construisent avec la GPT-5 nano API
De véritables charges de production tournant sur la GPT-5 nano API et le catalogue de modèles RouterBase.
La vision sur la GPT-5 nano API a remplacé un pipeline d'OCR — un appel rapide et économique légende et extrait, texte et image ensemble.
Les sorties JSON structurées de la GPT-5 nano API ont mis fin à notre parsing regex instable. Un JSON strictement valide à chaque fois, zéro relance.
À notre volume, GPT-5 nano est le seul modèle de classe GPT-5 qui soit rentable. RouterBase le rend encore 5% moins cher.
Le raisonnement ajustable de la GPT-5 nano API me permet d'arbitrer le coût face à la qualité par requête. Assez bon marché pour que j'aie cessé de compter les tokens.
RouterBase place la GPT-5 nano API et 200+ autres modèles derrière une seule clé. Notre équipe a cessé de soumettre des demandes de nouveaux comptes fournisseurs.
Nous testons en A/B la GPT-5 nano API contre GPT-5 par requête — même SDK, un seul champ modèle. La majeure partie du trafic reste sur nano et la facture a chuté de 70%.
Nous avons migré 42 services vers la GPT-5 nano API en un week-end. Le seul commentaire de PR a été : 'attends, c'est tout ?'.
À $0.03 / 1M d'entrée moins 5%, la GPT-5 nano API a rendu nos fonctionnalités à fort volume réellement rentables. Le calcul du ROI a été immédiat.
Foire aux questions
Questions courantes sur la GPT-5 nano API.
C'est le relais de RouterBase vers le GPT-5 nano d'OpenAI — le point de terminaison de chat le plus rapide et le moins cher de la famille GPT-5, avec une fenêtre de contexte de 400K tokens, un raisonnement ajustable, l'entrée image, le function calling et des sorties structurées, servi via une interface REST compatible OpenAI.