A Claude Haiku 4.5 API roda nosso tráfego de maior volume: rápida, barata e boa o suficiente para que a maioria das chamadas nunca precise de um modelo maior. Os 5% de desconto da RouterBase são margem pura.
A Claude Haiku 4.5 API é o modelo mais rápido e econômico da Anthropic —— inteligência quase de fronteira na velocidade e no preço de um modelo pequeno, com janela de contexto de 200K tokens, raciocínio estendido, visão, uso de ferramentas e cache de prompts. A Claude Haiku 4.5 API é compatível com OpenAI: aponte qualquer SDK para a RouterBase e troque o nome do modelo para claude-haiku-4-5. Entrada a $0.95 / 1M, saída a $4.75 / 1M, leituras em cache a $0.095 / 1M —— 5% abaixo da taxa padrão, tudo por um endpoint REST.
Claude Haiku 4.5 API: Chat
Use a Claude Haiku 4.5 API para rodar o modelo mais rápido e econômico da Anthropic: um contexto de 200K tokens, raciocínio estendido e prompt caching.
A Claude Haiku 4.5 API é o modelo mais rápido e econômico da Anthropic: inteligência quase de fronteira na velocidade e no preço de um modelo pequeno, com uma janela de contexto de 200K tokens, raciocínio estendido, visão, tool use e prompt caching. Roteada pela RouterBase, a Claude Haiku 4.5 API é totalmente compatível com OpenAI: aponte qualquer SDK existente para a URL base da RouterBase, troque o nome do modelo para claude-haiku-4-5 e sua primeira chamada funciona na hora.
Os preços são de $0.95 / 1M tokens de entrada, $4.75 / 1M tokens de saída e $0.095 / 1M leituras de entrada em cache: 5% abaixo da tarifa padrão. Uma única chave da RouterBase, sem necessidade de conta na Anthropic.
Seis motivos pelos quais as equipes lançam na Claude Haiku 4.5 API
Da velocidade quase de fronteira ao preço com 5% de desconto: o que faz a Claude Haiku 4.5 API se destacar.
O Claude mais rápido e barato
A Claude Haiku 4.5 API entrega qualidade quase de fronteira ao menor preço do Claude e na maior velocidade, ideal para cargas de trabalho de alto volume e sensíveis à latência.
Raciocínio estendido
Ative o raciocínio estendido para que a Claude Haiku 4.5 API raciocine passo a passo quando uma tarefa exigir, ou deixe-o desligado para as respostas mais rápidas e baratas: você controla a profundidade em cada requisição.
Contexto de 200K tokens
Aceita até 200,000 tokens por requisição: documentos longos, bases de código com múltiplos arquivos ou o histórico completo da conversa cabem em uma única chamada à Claude Haiku 4.5 API sem fragmentação.
Visão e tool use
A Claude Haiku 4.5 API aceita imagens e retorna chamadas de ferramentas estruturadas no esquema padrão da OpenAI: muito adequada para extração, classificação e etapas rápidas de agentes.
Prompt caching
Armazene em cache prompts de sistema longos e contexto compartilhado; a Claude Haiku 4.5 API cobra as leituras em cache a $0.095 / 1M, reduzindo o custo em até 90% em prefixos repetidos.
Endpoint compatível com OpenAI
A Claude Haiku 4.5 API fala o formato de chat-completions da OpenAI. Aponte qualquer SDK da OpenAI para a RouterBase: sem necessidade do SDK da Anthropic nem de credenciais separadas.

Comece com a Claude Haiku 4.5 API em 3 passos
Do cadastro à sua primeira resposta em menos de 5 minutos.
Crie uma chave de API da RouterBase
Cadastre-se e gere uma chave de API: uma única chave alcança a Claude Haiku 4.5 API e todos os outros modelos do catálogo.
Envie sua primeira mensagem
Aponte qualquer SDK compatível com OpenAI para routerbase.com/v1 e defina o modelo como claude-haiku-4-5. A resposta segue o esquema padrão de chat-completions: com suporte a streaming e tool use.
Inspecione o uso
Cada resposta inclui um detalhamento minucioso de tokens (entrada, saída e leituras em cache), de modo que o custo e a taxa de acertos em cache ficam visíveis em cada chamada.
Paga apenas pelo que usas
A RouterBase repassa preços de nível partner. Comparado com o preço público oficial do modelo.
O que as equipes constroem com a Claude Haiku 4.5 API
Cargas de produção reais rodando na Claude Haiku 4.5 API e no catálogo de modelos da RouterBase.
Movemos a classificação e o roteamento para a Claude Haiku 4.5 API e a latência caiu enquanto a qualidade se manteve. Ela lida com milhões de chamadas por dia sem pestanejar.
O prompt caching na Claude Haiku 4.5 API reduziu nossa conta de extração em mais da metade: o prompt de sistema longo agora é praticamente de graça.
O raciocínio estendido na Claude Haiku 4.5 API nos permite ligar o raciocínio apenas quando uma tarefa precisa. A RouterBase deixa tudo 5% mais barato e roteia automaticamente em torno de quedas.
200K de contexto a preços do Haiku significa que posso enfiar documentos inteiros de forma barata. A Claude Haiku 4.5 API responde rápido e mal mexe na conta.
A RouterBase coloca a Claude Haiku 4.5 API e mais de 200+ modelos atrás de uma única chave. Nossa equipe parou de abrir solicitações de contas de novos provedores.
Fazemos A/B da Claude Haiku 4.5 API contra o Sonnet por requisição: o mesmo SDK, um único campo de modelo. A maior parte do tráfego fica no Haiku e a conta caiu bastante.
Roteamos nossos endpoints de alto volume para a Claude Haiku 4.5 API em um fim de semana. O único comentário no PR foi: 'espera, é só isso?'.
A $0.95 / 1M de entrada menos 5%, a Claude Haiku 4.5 API nos deu qualidade quase de fronteira a um preço que escala. A conta do ROI foi instantânea.
Perguntas frequentes
Perguntas comuns sobre a Claude Haiku 4.5 API.
É o acesso direto da RouterBase ao Claude Haiku 4.5 da Anthropic: o modelo mais rápido e econômico da Anthropic, com um contexto de 200K tokens, raciocínio estendido, visão, tool use e prompt caching, servido por uma interface REST compatível com OpenAI.