C
openai/o3

La o3 API es el modelo de razonamiento de la serie o más capaz de OpenAI —— ventana de contexto de 200K tokens, alto esfuerzo de razonamiento, visión (entrada de texto + imagen), function calling y salidas JSON estructuradas, creado para los problemas más difíciles de matemáticas, programación y ciencia. La OpenAI o3 API es compatible con OpenAI: apunta cualquier SDK a RouterBase y configura el modelo como o3. Entrada a $1.20 / 1M, salida a $4.80 / 1M, lecturas en caché a $0.30 / 1M —— 5% por debajo de la tarifa estándar, todo por un endpoint REST.

Input
OpenAI o3
max_tokens4096
presence_penalty0
frequency_penalty0
OpenAI o3 Online
Hi! I'm a helpful AI assistant. What can I do for you?

OpenAI o3 API: Chat

Usa la o3 API para ejecutar el modelo de razonamiento insignia de la serie o de OpenAI: matemáticas profundas, programación, ciencia y razonamiento visual con un contexto de 200K tokens.

La o3 API es el modelo de razonamiento de la serie o más capaz de OpenAI: una ventana de contexto de 200K tokens, esfuerzo de razonamiento de alta profundidad, visión (entrada de texto + imagen), function calling y salidas JSON estructuradas, diseñado para los problemas más difíciles de matemáticas, programación, ciencia y de múltiples pasos. Enrutada a través de RouterBase, la OpenAI o3 API es totalmente compatible con OpenAI: apunta cualquier SDK existente a la URL base de RouterBase, configura el modelo en o3 y tu primera llamada se ejecuta de inmediato.

El precio es de $1.20 / 1M tokens de entrada, $4.80 / 1M tokens de salida y $0.30 / 1M lecturas de entrada en caché, un 5% por debajo de la tarifa estándar. Una sola clave de RouterBase, sin necesidad de credenciales de OpenAI por separado.

Por qué este modelo

Seis razones por las que los equipos lanzan con la o3 API

Desde el razonamiento insignia de la serie o hasta un precio con 5% de descuento: lo que hace destacar a la OpenAI o3 API.

Profundidad de razonamiento insignia

La o3 API ejecuta el razonamiento de cadena de pensamiento más profundo de la serie o de OpenAI: el modelo al que recurres para los problemas más difíciles de matemáticas, programación y ciencia.

Esfuerzo de razonamiento ajustable

Define el esfuerzo de razonamiento en la o3 API: súbelo para máximo rigor en problemas de múltiples pasos o bájalo para equilibrar latencia y costo.

Contexto de 200K tokens

Acepta hasta 200,000 tokens por solicitud: documentos largos, código de múltiples archivos o un historial de chat extenso caben en una sola llamada a la o3 API.

Visión y function calling

La o3 API acepta imágenes junto con texto y devuelve llamadas a herramientas estructuradas: razona sobre diagramas y capturas de pantalla, define herramientas y solicita JSON estrictamente válido.

Endpoint compatible con OpenAI

La OpenAI o3 API habla el formato de chat-completions de OpenAI. Cualquier SDK de Python, Node, Go o Rust que funcione con OpenAI funciona aquí: solo actualiza la URL base.

Una clave para 200+ modelos

La misma clave de RouterBase que llama a la o3 API también enruta a GPT-5, Claude Opus 4.8, Gemini 3.5 Flash y 200+ modelos más, sin gestión de credenciales por proveedor.

RouterBase dashboard preview
Inicio rápido

Comienza con la o3 API en 3 pasos

Desde el registro hasta tu primera respuesta en menos de 5 minutos.

  1. Crea una clave de API de RouterBase

    Regístrate y genera una clave de API: una sola clave alcanza la o3 API y todos los demás modelos del catálogo.

  2. Envía tu primer mensaje

    Apunta cualquier SDK compatible con OpenAI a routerbase.com/v1 y configura el modelo en o3. La respuesta sigue el esquema estándar de chat-completions: streaming, razonamiento y visión compatibles.

  3. Inspecciona el uso

    Cada respuesta incluye un desglose detallado de tokens (entrada, salida, razonamiento y tokens de lectura en caché) para que el costo y la tasa de aciertos de caché sean visibles en cada llamada.

Precios

Paga sólo por lo que usas

RouterBase repercute precios de nivel partner. Comparado con la tarifa pública oficial del modelo.

Historias de clientes

Lo que los equipos construyen con la o3 API

Cargas de producción reales ejecutándose en la o3 API y el catálogo de modelos de RouterBase.

Marcus Reyes
Marcus ReyesCTO, Paradigm AI

Reservamos la o3 API para nuestros pasos de razonamiento más difíciles: nada más iguala esa profundidad. El descuento del 5% de RouterBase es margen puro.

Priya Lakshmi
Priya LakshmiFounder, Quillo

El razonamiento visual en la o3 API resuelve nuestros diagramas y capturas de pantalla más complicados: una sola llamada analiza la imagen y devuelve resultados estructurados.

Thomas Beck
Thomas BeckStaff Engineer, Northbeam

Las salidas JSON estructuradas de la o3 API acabaron con nuestro frágil análisis con regex. JSON estrictamente válido siempre, cero reintentos.

Aoi Tanaka
Aoi TanakaML Lead, Daybreak Robotics

Cuando un problema necesita razonamiento real de múltiples pasos, la o3 API lo resuelve. RouterBase lo hace un 5% más barato y enruta automáticamente esquivando las caídas.

Jonas Keller
Jonas KellerIndie Developer

La o3 API maneja los pasos de razonamiento en los que mi bucle de agente solía fallar. Un solo cambio de URL base y estaba en producción.

Ethan Nguyen
Ethan NguyenHead of Engineering, Compound Studio

RouterBase pone la o3 API y 200+ modelos más detrás de una sola clave. Nuestro equipo dejó de solicitar cuentas de nuevos proveedores.

Sophia Martín
Sophia MartínCTO, Relay

Hacemos A/B entre la o3 API y o4-mini por solicitud: el mismo SDK, un solo campo de modelo. Los casos difíciles se quedan en o3 y todo lo demás sale más barato.

Lucas Fernandes
Lucas FernandesEngineering Manager, Light

Migramos 42 servicios a la o3 API en un fin de semana. El único comentario en el PR fue '¿espera, eso es todo?'.

David Okonkwo
David OkonkwoCo-founder, Figment

A $1.20 / 1M de entrada menos 5%, la o3 API nos dio razonamiento insignia sin la factura insignia. El cálculo del ROI fue instantáneo.

Preguntas frecuentes

Preguntas comunes sobre la o3 API.

Es el paso directo de RouterBase a la o3 de OpenAI: el endpoint de razonamiento insignia de la serie o con un contexto de 200K tokens, esfuerzo de razonamiento de alta profundidad, entrada de visión, function calling y salidas estructuradas, servido a través de una interfaz REST compatible con OpenAI.