Die Claude Haiku 4.5 API verarbeitet unseren Traffic mit dem höchsten Volumen — schnell, günstig und gut genug, dass die meisten Aufrufe nie ein größeres Modell brauchen. Der 5%-Rabatt von RouterBase ist reine Marge.
Die Claude Haiku 4.5 API ist Anthropics schnellstes, kosteneffizientestes Modell —— nahezu Frontier-Intelligenz zur Geschwindigkeit und zum Preis eines kleinen Modells, mit einem 200K-Token-Kontextfenster, erweitertem Denken, Vision, Tool-Nutzung und Prompt-Caching. Die Claude Haiku 4.5 API ist OpenAI-kompatibel: Richten Sie ein bestehendes SDK auf RouterBase und ändern Sie den Modellnamen auf claude-haiku-4-5. Eingabe $0.95 / 1M, Ausgabe $4.75 / 1M, Cache-Lesezugriffe $0.095 / 1M —— 5% unter dem Standardtarif, alles über einen REST-Endpunkt.
Claude Haiku 4.5 API: Chat
Nutzen Sie die Claude Haiku 4.5 API, um das schnellste und kosteneffizienteste Modell von Anthropic einzusetzen — mit 200K-Token-Kontext, Extended Thinking und prompt caching.
Die Claude Haiku 4.5 API ist das schnellste und kosteneffizienteste Modell von Anthropic — Intelligenz nahe am Frontier-Niveau bei der Geschwindigkeit und dem Preis eines kleinen Modells, mit einem 200K-Token-Kontextfenster, Extended Thinking, Vision, tool use und prompt caching. Über RouterBase geroutet ist die Claude Haiku 4.5 API vollständig OpenAI-kompatibel: Richten Sie ein beliebiges vorhandenes SDK auf die Basis-URL von RouterBase, tauschen Sie den Modellnamen gegen claude-haiku-4-5, und Ihr erster Aufruf läuft sofort durch.
Der Preis beträgt $0.95 / 1M Input-Tokens, $4.75 / 1M Output-Tokens und $0.095 / 1M Cached-Input-Reads — 5% unter dem Standardtarif. Ein RouterBase-Schlüssel — kein Anthropic-Konto erforderlich.
Sechs Gründe, warum Teams mit der Claude Haiku 4.5 API live gehen
Von Geschwindigkeit nahe am Frontier-Niveau bis zu 5% Rabatt — was die Claude Haiku 4.5 API auszeichnet.
Schnellstes, günstigstes Claude
Die Claude Haiku 4.5 API liefert Qualität nahe am Frontier-Niveau zum niedrigsten Claude-Preis und mit der höchsten Geschwindigkeit — ideal für umfangreiche, latenzkritische Workloads.
Extended Thinking
Aktivieren Sie Extended Thinking, damit die Claude Haiku 4.5 API bei Bedarf Schritt für Schritt schlussfolgert, oder lassen Sie es aus für die schnellsten, günstigsten Antworten — Sie steuern die Tiefe pro Anfrage.
200K-Token-Kontext
Akzeptiert bis zu 200.000 Tokens pro Anfrage — lange Dokumente, Codebasen aus mehreren Dateien oder der vollständige Gesprächsverlauf passen in einen einzigen Claude Haiku 4.5 API-Aufruf ohne Chunking.
Vision & tool use
Die Claude Haiku 4.5 API akzeptiert Bilder und gibt strukturierte tool calls im standardmäßigen OpenAI-Schema zurück — bestens geeignet für Extraktion, Klassifizierung und schnelle Agentenschritte.
Prompt caching
Cachen Sie lange System-Prompts und gemeinsam genutzten Kontext; die Claude Haiku 4.5 API berechnet Cached Reads mit $0.095 / 1M und senkt die Kosten bei wiederholten Präfixen um bis zu 90%.
OpenAI-kompatibler Endpunkt
Die Claude Haiku 4.5 API spricht das Wire-Format der OpenAI Chat Completions. Richten Sie ein beliebiges OpenAI-SDK auf RouterBase — kein Anthropic-SDK und keine separaten Zugangsdaten nötig.

In 3 Schritten mit der Claude Haiku 4.5 API loslegen
Von der Anmeldung bis zur ersten Antwort in unter 5 Minuten.
Einen RouterBase-API-Schlüssel erstellen
Melden Sie sich an und generieren Sie einen API-Schlüssel — ein Schlüssel erreicht die Claude Haiku 4.5 API und jedes andere Modell im Katalog.
Ihre erste Nachricht senden
Richten Sie ein beliebiges OpenAI-kompatibles SDK auf routerbase.com/v1 und setzen Sie das Modell auf claude-haiku-4-5. Die Antwort folgt dem standardmäßigen Chat-Completions-Schema — Streaming und tool use werden unterstützt.
Verbrauch prüfen
Jede Antwort enthält eine detaillierte Token-Aufschlüsselung — Input-, Output- und Cache-Read-Tokens — sodass Kosten und Cache-Trefferquote bei jedem Aufruf sichtbar sind.
Nur für die Nutzung zahlen
RouterBase reicht Partner-Tier-Preise durch. Verglichen mit dem offiziellen API-Tarif des Modells.
Was Teams mit der Claude Haiku 4.5 API bauen
Echte Produktionslasten, die auf der Claude Haiku 4.5 API und dem RouterBase-Modellkatalog laufen.
Wir haben Klassifizierung und Routing auf die Claude Haiku 4.5 API umgestellt, und die Latenz sank, während die Qualität gehalten wurde. Sie bewältigt Millionen Aufrufe pro Tag, ohne mit der Wimper zu zucken.
Prompt caching auf der Claude Haiku 4.5 API hat unsere Extraktionsrechnung um mehr als die Hälfte gesenkt — der lange System-Prompt ist jetzt praktisch kostenlos.
Extended Thinking auf der Claude Haiku 4.5 API lässt uns das Schlussfolgern nur dann einschalten, wenn eine Aufgabe es braucht. RouterBase macht es 5% günstiger und routet automatisch um Ausfälle herum.
200K Kontext zu Haiku-Preisen bedeutet, dass ich ganze Dokumente günstig hineinpacken kann. Die Claude Haiku 4.5 API antwortet schnell und bewegt die Rechnung kaum.
RouterBase stellt die Claude Haiku 4.5 API und über 200+ weitere Modelle hinter einen Schlüssel. Unser Team hat aufgehört, Anträge für neue Anbieterkonten einzureichen.
Wir testen die Claude Haiku 4.5 API im A/B-Verfahren gegen Sonnet pro Anfrage — dasselbe SDK, ein Modellfeld. Der meiste Traffic bleibt auf Haiku, und die Rechnung sank deutlich.
Wir haben unsere Endpunkte mit hohem Volumen an einem Wochenende auf die Claude Haiku 4.5 API umgeleitet. Der einzige PR-Kommentar war 'Moment, das war alles?'.
Bei $0.95 / 1M Input minus 5% lieferte uns die Claude Haiku 4.5 API Qualität nahe am Frontier-Niveau zu einem Preis, der skaliert. Die ROI-Rechnung ging sofort auf.
Häufig gestellte Fragen
Häufige Fragen zur Claude Haiku 4.5 API.
Es ist der Pass-through von RouterBase zu Anthropics Claude Haiku 4.5 — das schnellste und kosteneffizienteste Modell von Anthropic, mit 200K-Token-Kontext, Extended Thinking, Vision, tool use und prompt caching, bereitgestellt über eine OpenAI-kompatible REST-Schnittstelle.