Nous acheminons 90 % de notre trafic via la GPT-4.1 nano API – classification et extraction à une fraction du coût. La remise RouterBase de 5 % est de la marge pure.
L'API GPT-4.1 nano est le modèle 4.1 le plus rapide et le moins cher d'OpenAI —— une fenêtre de contexte de 1M tokens, la vision (texte + image), le function calling et des sorties JSON structurées, optimisée pour une faible latence et un débit élevé. L'API GPT-4.1 nano est compatible OpenAI : pointez n'importe quel SDK vers RouterBase et définissez le modèle sur gpt-4-1-nano. Entrée à $0.06 / 1M, sortie à $0.24 / 1M, lectures en cache à $0.015 / 1M —— 5% sous le tarif standard, le tout via un endpoint REST.
GPT-4.1 nano API : Chat
Utilisez la GPT-4.1 nano API pour exécuter le modèle 4.1 le plus rapide et le moins cher d'OpenAI, avec une fenêtre de contexte de 1M tokens et la vision.
La GPT-4.1 nano API est le modèle 4.1 le plus petit et le plus économique d'OpenAI – une fenêtre de contexte de 1M tokens, la vision (entrée texte et image), le function calling et des sorties JSON structurées, optimisée pour une faible latence et un débit élevé. Acheminée via RouterBase, elle est entièrement compatible OpenAI : pointez n'importe quel SDK existant vers l'URL de base de RouterBase, définissez le modèle sur gpt-4-1-nano, et votre premier appel passe immédiatement.
La tarification est de $0.06 / 1M tokens en entrée, $0.24 / 1M tokens en sortie et $0.015 / 1M lectures d'entrée mises en cache – soit 5 % en dessous du tarif standard. Une seule clé RouterBase – aucun identifiant OpenAI distinct requis.
Six raisons pour lesquelles les équipes livrent avec la GPT-4.1 nano API
Du contexte de 1M tokens à la remise de 5 % – ce qui distingue GPT-4.1 nano.
Contexte de 1M tokens
Accepte jusqu'à 1 million de tokens par requête – documents longs, code multi-fichiers ou historique de chat étendu tiennent dans un seul appel à la GPT-4.1 nano API.
Entrée vision
La GPT-4.1 nano API accepte des images aux côtés du texte. Transmettez une URL d'image ou du base64 dans la même requête pour légender, extraire ou raisonner sur du contenu visuel.
Niveau 4.1 le plus rapide et le moins cher
Conçue pour les charges à fort volume : la GPT-4.1 nano API est le modèle le moins coûteux de la famille 4.1 à $0.06 / 1M tokens en entrée – idéale pour la classification, l'autocomplétion, l'extraction et le routage à grande échelle.
Function calling et JSON
Définissez des outils et demandez un schéma JSON ; la GPT-4.1 nano API renvoie des appels d'outils structurés et un JSON strictement valide pour des pipelines d'agents et d'extraction fiables.
Point de terminaison compatible OpenAI
La GPT-4.1 nano API parle le format réseau chat-completions d'OpenAI. Tout SDK Python, Node, Go ou Rust qui fonctionne avec OpenAI fonctionne ici – il suffit de mettre à jour l'URL de base.
Une clé pour 200+ modèles
La même clé RouterBase qui appelle la GPT-4.1 nano API achemine aussi vers GPT-5, Claude Opus 4.8, Gemini 3.5 Flash et 200+ autres modèles – sans gestion d'identifiants par fournisseur.

Démarrez avec la GPT-4.1 nano API en 3 étapes
De l'inscription à votre première réponse en moins de 5 minutes.
Créez une clé API RouterBase
Inscrivez-vous et générez une clé API – une seule clé atteint la GPT-4.1 nano API et tous les autres modèles du catalogue.
Envoyez votre premier message
Pointez n'importe quel SDK compatible OpenAI vers routerbase.com/v1 et définissez le modèle sur gpt-4-1-nano. La réponse suit le schéma standard chat-completions – streaming et vision pris en charge.
Inspectez l'utilisation
Chaque réponse inclut une ventilation détaillée des tokens – entrée, sortie et lecture de cache – afin que le coût et le taux de succès du cache soient visibles à chaque appel.
Ne payez que ce que vous utilisez
RouterBase répercute les prix partenaires. Comparé au tarif public officiel du modèle.
Ce que les équipes construisent avec la GPT-4.1 nano API
De vraies charges de production tournant sur la GPT-4.1 nano API et le catalogue de modèles RouterBase.
La vision sur la GPT-4.1 nano API a remplacé un pipeline OCR – un appel rapide et bon marché légende et extrait, texte et image ensemble.
Les sorties JSON structurées de la GPT-4.1 nano API ont éliminé notre parsing regex instable. Un JSON strictement valide à chaque fois, zéro nouvelle tentative.
À notre volume, GPT-4.1 nano est le seul modèle de classe 4.1 qui soit rentable. RouterBase le rend encore 5 % moins cher.
Le function calling sur la GPT-4.1 nano API se branche directement dans ma boucle d'agent. Assez bon marché pour que j'aie cessé de compter les tokens.
RouterBase place la GPT-4.1 nano API et 200+ autres modèles derrière une seule clé. Notre équipe a cessé de déposer des demandes pour de nouveaux comptes fournisseurs.
Nous testons la GPT-4.1 nano API en A/B contre GPT-4.1 par requête – même SDK, un seul champ modèle. L'essentiel du trafic reste sur nano et la facture a chuté de 70 %.
Nous avons migré 42 services vers la GPT-4.1 nano API en un week-end. Le seul commentaire de PR était 'attends, c'est tout ?'.
À $0.06 / 1M en entrée moins 5 %, la GPT-4.1 nano API a rendu nos fonctionnalités à fort volume réellement rentables. Le calcul du ROI était instantané.
Questions fréquentes
Questions courantes sur la GPT-4.1 nano API.
C'est la passerelle de RouterBase vers GPT-4.1 nano d'OpenAI – le point de terminaison de chat le plus rapide et le moins cher de la famille 4.1, avec un contexte de 1M tokens, l'entrée vision, le function calling et des sorties structurées, servi via une interface REST compatible OpenAI.