C
openai/o4-mini

A o4-mini API é o modelo de raciocínio da série o da OpenAI, eficiente em custos —— janela de contexto de 200K tokens, esforço de raciocínio ajustável, visão (entrada de texto + imagem), function calling e saídas JSON estruturadas, otimizado para forte desempenho em matemática, programação e STEM. A OpenAI o4-mini API é compatível com OpenAI: aponte qualquer SDK para a RouterBase e defina o modelo como o4-mini. Entrada a $0.66 / 1M, saída a $2.64 / 1M, leituras em cache a $0.165 / 1M —— 5% abaixo da taxa padrão, tudo por um endpoint REST.

Input
OpenAI o4-mini
max_tokens4096
presence_penalty0
frequency_penalty0
OpenAI o4-mini Online
Hi! I'm a helpful AI assistant. What can I do for you?

API o4-mini da OpenAI: Chat

Use a o4-mini API para rodar o modelo de raciocínio da série o da OpenAI, eficiente em custo: forte em matemática, programação e raciocínio visual com um contexto de 200K tokens.

A o4-mini API é o modelo compacto de raciocínio da série o da OpenAI: uma janela de contexto de 200K tokens, esforço de raciocínio ajustável, visão (entrada de texto + imagem), function calling e saídas estruturadas em JSON, ajustado para um forte desempenho em matemática, programação e STEM por uma fração do custo do modelo principal. Roteada pela RouterBase, a OpenAI o4-mini API é totalmente compatível com a OpenAI: aponte qualquer SDK existente para a URL base da RouterBase, defina o modelo como o4-mini e sua primeira chamada já é processada na hora.

O preço é de $0.66 / 1M tokens de entrada, $2.64 / 1M tokens de saída e $0.165 / 1M leituras de entrada em cache, 5% abaixo da tarifa padrão. Uma única chave da RouterBase, sem precisar de credenciais separadas da OpenAI.

Por que este modelo

Seis motivos pelos quais as equipes lançam com a o4-mini API

Do raciocínio da série o ao preço com 5% de desconto: o que faz a OpenAI o4-mini API se destacar.

Raciocínio eficiente em custo

A o4-mini API entrega raciocínio em cadeia de pensamento da série o por uma fração do preço do modelo principal: a melhor relação preço/desempenho da categoria para matemática, programação e lógica.

Esforço de raciocínio ajustável

Defina o esforço de raciocínio como baixo, médio ou alto na o4-mini API: aumente-o para problemas difíceis de várias etapas ou reduza-o para respostas rápidas e baratas.

Contexto de 200K tokens

Aceita até 200,000 tokens por requisição: documentos longos, código de vários arquivos ou um histórico de chat extenso cabem em uma única chamada à o4-mini API.

Visão e function calling

A o4-mini API aceita imagens junto com texto e retorna chamadas de ferramentas estruturadas: passe uma URL de imagem ou base64, defina ferramentas e solicite JSON estritamente válido.

Endpoint compatível com OpenAI

A OpenAI o4-mini API fala o formato de chat-completions da OpenAI. Qualquer SDK de Python, Node, Go ou Rust que funcione com a OpenAI funciona aqui: basta atualizar a URL base.

Uma chave para mais de 200 modelos

A mesma chave da RouterBase que chama a o4-mini API também roteia para GPT-5, Claude Opus 4.8, Gemini 3.5 Flash e mais de 200 outros modelos: sem gestão de credenciais por provedor.

RouterBase dashboard preview
Início rápido

Comece com a o4-mini API em 3 passos

Do cadastro à sua primeira resposta em menos de 5 minutos.

  1. Crie uma chave de API da RouterBase

    Cadastre-se e gere uma chave de API: uma única chave alcança a o4-mini API e todos os outros modelos do catálogo.

  2. Envie sua primeira mensagem

    Aponte qualquer SDK compatível com OpenAI para routerbase.com/v1 e defina o modelo como o4-mini. A resposta segue o esquema padrão de chat-completions: com suporte a streaming, raciocínio e visão.

  3. Inspecione o uso

    Cada resposta inclui um detalhamento minucioso de tokens (entrada, saída, raciocínio e leituras de cache), de modo que o custo e a taxa de acertos de cache ficam visíveis em cada chamada.

Preços

Paga apenas pelo que usas

A RouterBase repassa preços de nível partner. Comparado com o preço público oficial do modelo.

Histórias de clientes

O que as equipes constroem com a o4-mini API

Cargas de produção reais rodando sobre a o4-mini API e o catálogo de modelos da RouterBase.

Marcus Reyes
Marcus ReyesCTO, Paradigm AI

Roteamos nossas cargas de trabalho de matemática e programação pela o4-mini API: raciocínio da série o por uma fração do custo do modelo principal. Os 5% de desconto da RouterBase são margem pura.

Priya Lakshmi
Priya LakshmiFounder, Quillo

O raciocínio visual na o4-mini API lê nossos gráficos e capturas de tela diretamente: uma única chamada analisa a imagem e retorna resultados estruturados.

Thomas Beck
Thomas BeckStaff Engineer, Northbeam

As saídas estruturadas em JSON da o4-mini API acabaram com nosso instável parsing por regex. JSON estritamente válido sempre, zero novas tentativas.

Aoi Tanaka
Aoi TanakaML Lead, Daybreak Robotics

O esforço de raciocínio ajustável nos permite calibrar a o4-mini API por tarefa. A RouterBase a torna 5% mais barata e roteia em torno de quedas automaticamente.

Jonas Keller
Jonas KellerIndie Developer

A o4-mini API resolve as etapas difíceis de raciocínio no loop do meu agente sem a fatura do modelo principal. Uma única troca de URL base e eu já estava no ar.

Ethan Nguyen
Ethan NguyenHead of Engineering, Compound Studio

A RouterBase coloca a o4-mini API e mais de 200 outros modelos atrás de uma única chave. Nossa equipe parou de abrir solicitações para novas contas de provedores.

Sophia Martín
Sophia MartínCTO, Relay

Fazemos teste A/B da o4-mini API contra o o3 por requisição: o mesmo SDK, um único campo de modelo. A maior parte do tráfego fica no o4-mini e a fatura caiu drasticamente.

Lucas Fernandes
Lucas FernandesEngineering Manager, Light

Migramos 42 serviços para a o4-mini API em um fim de semana. O único comentário no PR foi 'espera, é só isso?'.

David Okonkwo
David OkonkwoCo-founder, Figment

A $0.66 / 1M de entrada menos 5%, a o4-mini API nos deu qualidade de nível de raciocínio sem a fatura do modelo principal. O cálculo do ROI foi instantâneo.

Perguntas frequentes

Perguntas comuns sobre a o4-mini API.

É o acesso direto da RouterBase ao o4-mini da OpenAI: o endpoint de raciocínio da série o eficiente em custo, com um contexto de 200K tokens, esforço de raciocínio ajustável, entrada de visão, function calling e saídas estruturadas, servido por uma interface REST compatível com OpenAI.