La Claude Haiku 4.5 API maneja nuestro tráfico de mayor volumen: rápida, económica y lo suficientemente buena como para que la mayoría de las llamadas nunca necesiten un modelo más grande. El 5% de descuento de RouterBase es margen puro.
La Claude Haiku 4.5 API es el modelo más rápido y rentable de Anthropic —— inteligencia casi de frontera a la velocidad y el precio de un modelo pequeño, con ventana de contexto de 200K tokens, pensamiento extendido, visión, uso de herramientas y caché de prompts. La Claude Haiku 4.5 API es compatible con OpenAI: apunta cualquier SDK a RouterBase y cambia el nombre del modelo a claude-haiku-4-5. Entrada a $0.95 / 1M, salida a $4.75 / 1M, lecturas en caché a $0.095 / 1M —— 5% por debajo de la tarifa estándar, todo por un endpoint REST.
Claude Haiku 4.5 API: Chat
Usa la Claude Haiku 4.5 API para ejecutar el modelo más rápido y rentable de Anthropic: un contexto de 200K tokens, razonamiento extendido y prompt caching.
La Claude Haiku 4.5 API es el modelo más rápido y rentable de Anthropic: inteligencia casi de frontera a la velocidad y el precio de un modelo pequeño, con una ventana de contexto de 200K tokens, razonamiento extendido, visión, tool use y prompt caching. Enrutada a través de RouterBase, la Claude Haiku 4.5 API es totalmente compatible con OpenAI: apunta cualquier SDK existente a la URL base de RouterBase, cambia el nombre del modelo a claude-haiku-4-5 y tu primera llamada funciona de inmediato.
Los precios son de $0.95 / 1M tokens de entrada, $4.75 / 1M tokens de salida y $0.095 / 1M lecturas de entrada en caché: un 5% por debajo de la tarifa estándar. Una sola clave de RouterBase, sin necesidad de una cuenta de Anthropic.
Seis razones por las que los equipos lanzan con la Claude Haiku 4.5 API
Desde una velocidad casi de frontera hasta un precio con 5% de descuento: lo que hace destacar a la Claude Haiku 4.5 API.
El Claude más rápido y económico
La Claude Haiku 4.5 API ofrece calidad casi de frontera al precio más bajo de Claude y la mayor velocidad, ideal para cargas de trabajo de alto volumen y sensibles a la latencia.
Razonamiento extendido
Activa el razonamiento extendido para que la Claude Haiku 4.5 API razone paso a paso cuando una tarea lo requiera, o desactívalo para obtener las respuestas más rápidas y económicas: tú controlas la profundidad en cada petición.
Contexto de 200K tokens
Acepta hasta 200,000 tokens por petición: documentos largos, bases de código con múltiples archivos o el historial completo de la conversación caben en una sola llamada a la Claude Haiku 4.5 API sin fragmentación.
Visión y tool use
La Claude Haiku 4.5 API acepta imágenes y devuelve llamadas a herramientas estructuradas en el esquema estándar de OpenAI: muy adecuada para extracción, clasificación y pasos rápidos de agentes.
Prompt caching
Almacena en caché prompts de sistema largos y contexto compartido; la Claude Haiku 4.5 API factura las lecturas en caché a $0.095 / 1M, reduciendo el costo hasta un 90% en prefijos repetidos.
Endpoint compatible con OpenAI
La Claude Haiku 4.5 API habla el formato de chat-completions de OpenAI. Apunta cualquier SDK de OpenAI a RouterBase: sin necesidad del SDK de Anthropic ni de credenciales aparte.

Empieza con la Claude Haiku 4.5 API en 3 pasos
Del registro a tu primera respuesta en menos de 5 minutos.
Crea una clave de API de RouterBase
Regístrate y genera una clave de API: una sola clave llega a la Claude Haiku 4.5 API y a todos los demás modelos del catálogo.
Envía tu primer mensaje
Apunta cualquier SDK compatible con OpenAI a routerbase.com/v1 y establece el modelo en claude-haiku-4-5. La respuesta sigue el esquema estándar de chat-completions: con soporte para streaming y tool use.
Inspecciona el uso
Cada respuesta incluye un desglose detallado de tokens (entrada, salida y lecturas en caché), de modo que el costo y la tasa de aciertos en caché son visibles en cada llamada.
Paga sólo por lo que usas
RouterBase repercute precios de nivel partner. Comparado con la tarifa pública oficial del modelo.
Qué construyen los equipos con la Claude Haiku 4.5 API
Cargas de producción reales que se ejecutan sobre la Claude Haiku 4.5 API y el catálogo de modelos de RouterBase.
Movimos la clasificación y el enrutamiento a la Claude Haiku 4.5 API y la latencia bajó mientras la calidad se mantuvo. Maneja millones de llamadas al día sin inmutarse.
El prompt caching en la Claude Haiku 4.5 API redujo nuestra factura de extracción a más de la mitad: el prompt de sistema largo ahora es prácticamente gratis.
El razonamiento extendido en la Claude Haiku 4.5 API nos permite activar el razonamiento solo cuando una tarea lo necesita. RouterBase lo hace un 5% más barato y enruta automáticamente alrededor de las caídas.
200K de contexto a precios de Haiku significa que puedo meter documentos enteros de forma económica. La Claude Haiku 4.5 API responde rápido y apenas mueve la factura.
RouterBase pone la Claude Haiku 4.5 API y más de 200+ modelos detrás de una sola clave. Nuestro equipo dejó de presentar solicitudes para cuentas de nuevos proveedores.
Hacemos A/B de la Claude Haiku 4.5 API contra Sonnet por petición: el mismo SDK, un solo campo de modelo. La mayoría del tráfico se queda en Haiku y la factura bajó drásticamente.
Enrutamos nuestros endpoints de alto volumen a la Claude Haiku 4.5 API en un fin de semana. El único comentario del PR fue: '¿espera, eso es todo?'.
A $0.95 / 1M de entrada menos 5%, la Claude Haiku 4.5 API nos dio calidad casi de frontera a un precio que escala. El cálculo del ROI fue instantáneo.
Preguntas frecuentes
Preguntas comunes sobre la Claude Haiku 4.5 API.
Es el acceso directo de RouterBase a Claude Haiku 4.5 de Anthropic: el modelo más rápido y rentable de Anthropic, con un contexto de 200K tokens, razonamiento extendido, visión, tool use y prompt caching, servido mediante una interfaz REST compatible con OpenAI.