Nous routons nos charges de mathématiques et de code via l'o4-mini API — du raisonnement o-series à une fraction du coût du modèle phare. La remise RouterBase de 5% est une marge pure.
L'API o4-mini est le modèle de raisonnement de la série o d'OpenAI, économique —— une fenêtre de contexte de 200K tokens, un effort de raisonnement ajustable, la vision (texte + image), le function calling et des sorties JSON structurées, optimisée pour de solides performances en mathématiques, codage et STEM. L'API OpenAI o4-mini est compatible OpenAI : pointez n'importe quel SDK vers RouterBase et définissez le modèle sur o4-mini. Entrée à $0.66 / 1M, sortie à $2.64 / 1M, lectures en cache à $0.165 / 1M —— 5% sous le tarif standard, le tout via un endpoint REST.
OpenAI o4-mini API: Chat
Utilisez l'o4-mini API pour exécuter le modèle de raisonnement o-series économique d'OpenAI — solide en mathématiques, en code et en raisonnement visuel, avec un contexte de 200K tokens.
L'o4-mini API est le modèle de raisonnement o-series compact d'OpenAI — une fenêtre de contexte de 200K tokens, un effort de raisonnement ajustable, la vision (entrée texte + image), le function calling et des sorties JSON structurées, optimisé pour de solides performances en mathématiques, en code et en STEM à une fraction du coût du modèle phare. Routée via RouterBase, l'OpenAI o4-mini API est entièrement compatible OpenAI : pointez n'importe quel SDK existant vers l'URL de base de RouterBase, réglez le modèle sur o4-mini, et votre premier appel passe immédiatement.
La tarification est de $0.66 / 1M tokens d'entrée, $2.64 / 1M tokens de sortie et $0.165 / 1M lectures d'entrée en cache — 5% en dessous du tarif standard. Une seule clé RouterBase — aucun identifiant OpenAI distinct requis.
Six raisons pour lesquelles les équipes déploient sur l'o4-mini API
Du raisonnement o-series à une tarification réduite de 5% — ce qui distingue l'OpenAI o4-mini API.
Raisonnement économique
L'o4-mini API offre un raisonnement o-series par chaîne de pensée à une fraction du prix du modèle phare — un rapport prix/performance de premier ordre pour les mathématiques, le code et la logique.
Effort de raisonnement ajustable
Réglez l'effort de raisonnement sur faible, moyen ou élevé sur l'o4-mini API — augmentez-le pour les problèmes difficiles en plusieurs étapes ou réduisez-le pour des réponses rapides et économiques.
Contexte de 200K tokens
Accepte jusqu'à 200 000 tokens par requête — de longs documents, du code multi-fichiers ou un historique de conversation étendu tiennent dans un seul appel à l'o4-mini API.
Vision & function calling
L'o4-mini API accepte des images en plus du texte et renvoie des appels d'outils structurés — transmettez une URL d'image ou du base64, définissez des outils et demandez un JSON strictement valide.
Endpoint compatible OpenAI
L'OpenAI o4-mini API parle le format wire chat-completions d'OpenAI. Tout SDK Python, Node, Go ou Rust qui fonctionne avec OpenAI fonctionne ici — il suffit de mettre à jour l'URL de base.
Une clé pour 200+ modèles
La même clé RouterBase qui appelle l'o4-mini API route aussi vers GPT-5, Claude Opus 4.8, Gemini 3.5 Flash et 200+ autres modèles — aucune gestion d'identifiants par fournisseur.

Démarrez avec l'o4-mini API en 3 étapes
De l'inscription à votre première réponse en moins de 5 minutes.
Créer une clé API RouterBase
Inscrivez-vous et générez une clé API — une seule clé atteint l'o4-mini API et tous les autres modèles du catalogue.
Envoyer votre premier message
Pointez n'importe quel SDK compatible OpenAI vers routerbase.com/v1 et réglez le modèle sur o4-mini. La réponse suit le schéma standard chat-completions — streaming, raisonnement et vision pris en charge.
Inspecter l'utilisation
Chaque réponse inclut une ventilation détaillée des tokens — entrée, sortie, raisonnement et lectures de cache — de sorte que le coût et le taux de succès du cache sont visibles à chaque appel.
Ne payez que ce que vous utilisez
RouterBase répercute les prix partenaires. Comparé au tarif public officiel du modèle.
Ce que les équipes construisent avec l'o4-mini API
De vraies charges de production tournant sur l'o4-mini API et le catalogue de modèles RouterBase.
Le raisonnement visuel sur l'o4-mini API lit directement nos graphiques et nos captures d'écran — un seul appel analyse l'image et renvoie des résultats structurés.
Les sorties JSON structurées de l'o4-mini API ont éliminé notre analyse regex peu fiable. Un JSON strictement valide à chaque fois, zéro relance.
L'effort de raisonnement ajustable nous permet d'affiner l'o4-mini API par tâche. RouterBase la rend 5% moins chère et contourne automatiquement les pannes.
L'o4-mini API résout les étapes de raisonnement difficiles dans ma boucle d'agent sans la facture du modèle phare. Un simple échange d'URL de base et j'étais en ligne.
RouterBase place l'o4-mini API et 200+ autres modèles derrière une seule clé. Notre équipe a cessé de déposer des demandes pour de nouveaux comptes fournisseurs.
Nous testons l'o4-mini API en A/B contre o3 par requête — le même SDK, un seul champ de modèle. L'essentiel du trafic reste sur o4-mini et la facture a fortement baissé.
Nous avons migré 42 services vers l'o4-mini API en un week-end. Le seul commentaire de PR a été : 'attends, c'est tout ?'.
À $0.66 / 1M en entrée moins 5%, l'o4-mini API nous a offert une qualité de niveau raisonnement sans la facture du modèle phare. Le calcul du ROI a été instantané.
Questions fréquentes
Questions courantes sur l'o4-mini API.
C'est le pass-through de RouterBase vers l'o4-mini d'OpenAI — l'endpoint de raisonnement o-series économique avec un contexte de 200K tokens, un effort de raisonnement ajustable, l'entrée d'images, le function calling et des sorties structurées, servi via une interface REST compatible OpenAI.