La Claude Haiku 4.5 API gère notre trafic le plus volumineux — rapide, économique et assez bonne pour que la plupart des appels n'aient jamais besoin d'un modèle plus grand. La remise de 5% de RouterBase est de la marge pure.
La Claude Haiku 4.5 API est le modèle le plus rapide et le plus économique d'Anthropic —— une intelligence quasi de pointe à la vitesse et au prix d'un petit modèle, avec une fenêtre de contexte de 200K tokens, le raisonnement étendu, la vision, l'utilisation d'outils et le cache de prompts. La Claude Haiku 4.5 API est compatible OpenAI : pointez n'importe quel SDK vers RouterBase et remplacez le nom du modèle par claude-haiku-4-5. Entrée à $0.95 / 1M, sortie à $4.75 / 1M, lectures en cache à $0.095 / 1M —— 5% sous le tarif standard, le tout via un endpoint REST.
Claude Haiku 4.5 API : Chat
Utilisez la Claude Haiku 4.5 API pour exécuter le modèle le plus rapide et le plus économique d'Anthropic — un contexte de 200K tokens, l'extended thinking et le prompt caching.
La Claude Haiku 4.5 API est le modèle le plus rapide et le plus économique d'Anthropic — une intelligence proche du Frontier à la vitesse et au prix d'un petit modèle, avec une fenêtre de contexte de 200K tokens, l'extended thinking, la vision, le tool use et le prompt caching. Routée via RouterBase, la Claude Haiku 4.5 API est entièrement compatible OpenAI : pointez n'importe quel SDK existant vers l'URL de base de RouterBase, remplacez le nom du modèle par claude-haiku-4-5, et votre premier appel passe immédiatement.
La tarification est de $0.95 / 1M tokens en entrée, $4.75 / 1M tokens en sortie et $0.095 / 1M lectures d'entrée mises en cache — 5% sous le tarif standard. Une seule clé RouterBase — aucun compte Anthropic requis.
Six raisons pour lesquelles les équipes déploient sur la Claude Haiku 4.5 API
D'une vitesse proche du Frontier à une tarification réduite de 5% — ce qui distingue la Claude Haiku 4.5 API.
Le Claude le plus rapide et le moins cher
La Claude Haiku 4.5 API offre une qualité proche du Frontier au prix Claude le plus bas et à la vitesse la plus élevée — idéale pour les charges de travail à fort volume et sensibles à la latence.
Extended thinking
Activez l'extended thinking pour laisser la Claude Haiku 4.5 API raisonner étape par étape quand une tâche l'exige, ou laissez-le désactivé pour les réponses les plus rapides et les moins chères — vous contrôlez la profondeur par requête.
Contexte de 200K tokens
Accepte jusqu'à 200 000 tokens par requête — longs documents, bases de code multi-fichiers ou historique de conversation complet tiennent dans un seul appel à la Claude Haiku 4.5 API sans découpage.
Vision et tool use
La Claude Haiku 4.5 API accepte les images et renvoie des tool calls structurés dans le schéma OpenAI standard — parfaitement adaptée à l'extraction, la classification et les étapes d'agent rapides.
Prompt caching
Mettez en cache les longs prompts système et le contexte partagé ; la Claude Haiku 4.5 API facture les lectures en cache à $0.095 / 1M, réduisant le coût jusqu'à 90% sur les préfixes répétés.
Endpoint compatible OpenAI
La Claude Haiku 4.5 API parle le format wire des chat completions d'OpenAI. Pointez n'importe quel SDK OpenAI vers RouterBase — aucun SDK Anthropic ni identifiants distincts nécessaires.

Démarrez avec la Claude Haiku 4.5 API en 3 étapes
De l'inscription à votre première réponse en moins de 5 minutes.
Créer une clé API RouterBase
Inscrivez-vous et générez une clé API — une seule clé atteint la Claude Haiku 4.5 API et tous les autres modèles du catalogue.
Envoyer votre premier message
Pointez n'importe quel SDK compatible OpenAI vers routerbase.com/v1 et définissez le modèle sur claude-haiku-4-5. La réponse suit le schéma standard des chat completions — le streaming et le tool use sont pris en charge.
Inspecter la consommation
Chaque réponse inclut une ventilation détaillée des tokens — entrée, sortie et lectures en cache — afin que le coût et le taux de succès du cache soient visibles à chaque appel.
Ne payez que ce que vous utilisez
RouterBase répercute les prix partenaires. Comparé au tarif public officiel du modèle.
Ce que les équipes construisent avec la Claude Haiku 4.5 API
De vraies charges de production tournant sur la Claude Haiku 4.5 API et le catalogue de modèles RouterBase.
Nous avons déplacé la classification et le routage vers la Claude Haiku 4.5 API, et la latence a chuté tandis que la qualité s'est maintenue. Elle gère des millions d'appels par jour sans broncher.
Le prompt caching sur la Claude Haiku 4.5 API a réduit notre facture d'extraction de plus de moitié — le long prompt système est désormais quasiment gratuit.
L'extended thinking sur la Claude Haiku 4.5 API nous permet d'activer le raisonnement uniquement quand une tâche l'exige. RouterBase le rend 5% moins cher et contourne automatiquement les pannes.
200K de contexte aux prix Haiku signifie que je peux y caser des documents entiers à moindre coût. La Claude Haiku 4.5 API répond vite et fait à peine bouger la facture.
RouterBase place la Claude Haiku 4.5 API et plus de 200+ autres modèles derrière une seule clé. Notre équipe a cessé de déposer des demandes de nouveaux comptes fournisseurs.
Nous testons la Claude Haiku 4.5 API en A/B contre Sonnet par requête — même SDK, un seul champ de modèle. La majeure partie du trafic reste sur Haiku et la facture a fortement chuté.
Nous avons redirigé nos endpoints à fort volume vers la Claude Haiku 4.5 API en un week-end. Le seul commentaire de PR était 'attends, c'est tout ?'.
À $0.95 / 1M en entrée moins 5%, la Claude Haiku 4.5 API nous a donné une qualité proche du Frontier à un prix qui passe à l'échelle. Le calcul du ROI a été immédiat.
Questions fréquentes
Questions courantes sur la Claude Haiku 4.5 API.
C'est le pass-through de RouterBase vers Claude Haiku 4.5 d'Anthropic — le modèle le plus rapide et le plus économique d'Anthropic, avec un contexte de 200K tokens, l'extended thinking, la vision, le tool use et le prompt caching, servi via une interface REST compatible OpenAI.