Nous routons 90 % de notre trafic via la GPT-4o mini API — classification et extraction à une fraction du coût. La réduction de 5 % de RouterBase, c'est de la marge pure.
L'API GPT-4o mini est le modèle multimodal rapide et économique d'OpenAI — contexte de 128K tokens, vision native (texte + image), function calling et sorties JSON structurées. L'API GPT-4o mini est compatible OpenAI : pointez n'importe quel SDK vers RouterBase et conservez le modèle gpt-4o-mini. Entrée à $0.09 / 1M, sortie à $0.36 / 1M, lectures en cache à $0.045 / 1M — 5% sous le tarif standard, le tout via un endpoint REST.
GPT-4o mini API : Chat
Utilisez la GPT-4o mini API pour exécuter le modèle multimodal rapide et économique d'OpenAI — texte et vision dans un seul point de terminaison.
La GPT-4o mini API est le petit modèle le plus rentable d'OpenAI — une fenêtre de contexte de 128K tokens, une vision native (entrée texte + image), le function calling et des sorties JSON structurées. Routée via RouterBase, elle est entièrement compatible OpenAI : pointez n'importe quel SDK existant vers l'URL de base de RouterBase, conservez le nom de modèle gpt-4o-mini, et votre premier appel passe immédiatement.
La tarification est de $0.09 / 1M de tokens d'entrée, $0.36 / 1M de tokens de sortie et $0.045 / 1M pour les lectures d'entrée mises en cache — 5 % en dessous du tarif standard. Une seule clé RouterBase — aucun identifiant OpenAI distinct requis.
Six raisons pour lesquelles les équipes déploient sur la GPT-4o mini API
De la vision native à 5 % de réduction sur le prix — ce qui distingue GPT-4o mini.
Contexte de 128K tokens
Accepte jusqu'à 128 000 tokens par requête — longs documents, code multi-fichiers ou historique de chat étendu tiennent dans un seul appel à la GPT-4o mini API.
Vision native
La GPT-4o mini API accepte des images aux côtés du texte. Transmettez une URL d'image ou du base64 dans la même requête pour légender, extraire ou raisonner sur du contenu visuel.
Function calling et outils
Définissez des outils et la GPT-4o mini API renvoie des appels d'outils structurés — intégrez-la dans des agents, du retrieval ou des actions d'application avec le schéma standard de function calling d'OpenAI.
Sorties JSON structurées
Demandez un schéma JSON et la GPT-4o mini API renvoie à chaque fois du JSON strictement valide — pas de parsing fragile, idéal pour l'extraction et la classification.
Rapide et économique
Conçue pour les charges de travail à fort volume : la GPT-4o mini API est le modèle de classe GPT-4 le moins cher d'OpenAI à $0.09 / 1M de tokens d'entrée — 5 % en dessous du tarif standard via RouterBase.
Une clé pour 200+ modèles
La même clé RouterBase qui appelle la GPT-4o mini API route aussi vers GPT-5, Claude Opus 4.8, Gemini 3.5 Flash et 200+ autres modèles — aucune gestion d'identifiants par fournisseur.

Démarrez avec la GPT-4o mini API en 3 étapes
De l'inscription à votre première réponse en moins de 5 minutes.
Créer une clé API RouterBase
Inscrivez-vous et générez une clé API — une seule clé atteint la GPT-4o mini API et tous les autres modèles du catalogue.
Envoyer votre premier message
Pointez n'importe quel SDK compatible OpenAI vers routerbase.com/v1 et définissez le modèle sur gpt-4o-mini. La réponse suit le schéma standard de chat-completions — streaming et vision pris en charge.
Inspecter l'utilisation
Chaque réponse inclut une ventilation détaillée des tokens — entrée, sortie et lecture de cache — afin que le coût et le taux de succès du cache soient visibles à chaque appel.
Ne payez que ce que vous utilisez
RouterBase répercute les prix partenaires. Comparé au tarif public officiel du modèle.
Ce que les équipes construisent avec la GPT-4o mini API
De véritables charges de production tournant sur la GPT-4o mini API et le catalogue de modèles RouterBase.
La vision native sur la GPT-4o mini API a remplacé tout un pipeline OCR. Un seul appel légende et extrait — texte et image dans la même requête.
Les sorties JSON structurées de la GPT-4o mini API ont éliminé notre parsing regex peu fiable. Du JSON strictement valide à chaque fois, zéro relance.
À notre volume, GPT-4o mini est le seul modèle de classe GPT-4 qui soit rentable. RouterBase le rend 5 % moins cher encore.
Le function calling sur la GPT-4o mini API s'intègre directement dans ma boucle d'agent. Assez bon marché pour que j'aie cessé de compter les tokens.
RouterBase place la GPT-4o mini API et 200+ autres modèles derrière une seule clé. Notre équipe a cessé de déposer des demandes pour de nouveaux comptes fournisseurs.
Nous testons en A/B la GPT-4o mini API contre GPT-4o par requête — même SDK, un seul champ de modèle. La majeure partie du trafic reste sur mini et la facture a chuté de 70 %.
Nous avons migré 42 services vers la GPT-4o mini API en un week-end. Le seul commentaire de PR a été : 'attends, c'est tout ?'.
À $0.09 / 1M d'entrée moins 5 %, la GPT-4o mini API a rendu nos fonctionnalités à fort volume réellement profitables. Le calcul du ROI a été immédiat.
Questions fréquentes
Questions courantes sur la GPT-4o mini API.
C'est le pass-through de RouterBase vers GPT-4o mini d'OpenAI — un point de terminaison de chat multimodal rapide et économique avec un contexte de 128K tokens, une vision native, le function calling et des sorties structurées, servi via une interface REST compatible OpenAI.