A GPT-5.4 mini API é o nosso padrão do dia a dia — raciocínio de classe GPT-5.4, barato o bastante para rodar na maior parte do tráfego. O desconto de 5% da RouterBase é margem pura.
A GPT-5.4 mini API é o nível econômico da série GPT-5.4 da OpenAI —— uma janela de contexto de 400K tokens, esforço de raciocínio ajustável, visão (entrada de texto + imagem), function calling e saídas JSON estruturadas, para tarefas de raciocínio, código e agentes de alto volume por uma fração do custo. A GPT-5.4 mini API é compatível com OpenAI: aponte qualquer SDK para a RouterBase e defina o modelo como gpt-5-4-mini. Entrada a $0.7125 / 1M, saída a $4.275 / 1M, leituras em cache a $0.07125 / 1M —— tudo por um endpoint REST.
GPT-5.4 mini API: Chat
Use a GPT-5.4 mini API para executar o nível GPT-5.4 econômico da OpenAI — contexto de 400K tokens, raciocínio ajustável, visão e function calling.
A GPT-5.4 mini API é o nível GPT-5.4 econômico da OpenAI — uma janela de contexto de 400K tokens, esforço de raciocínio ajustável, visão (entrada de texto + imagem), function calling e saídas JSON estruturadas, construída para raciocínio, programação e tarefas de agentes de alto volume a uma fração do custo da carro-chefe. Roteada pela RouterBase, a GPT-5.4 mini API é totalmente compatível com OpenAI: aponte qualquer SDK existente para a base URL da RouterBase, defina o modelo como gpt-5-4-mini e a sua primeira chamada à GPT-5.4 mini API passa imediatamente.
O preço da GPT-5.4 mini API é $0.7125 / 1M tokens de entrada, $4.275 / 1M tokens de saída e $0.07125 / 1M leituras de entrada em cache — 5% abaixo da tarifa padrão. Uma chave RouterBase — sem conta da OpenAI.
Seis razões pelas quais as equipes lançam na GPT-5.4 mini API
Do raciocínio econômico ao preço com 5% de desconto — o que destaca a GPT-5.4 mini API.
GPT-5.4 econômico
A GPT-5.4 mini API entrega raciocínio passo a passo de classe GPT-5.4 a uma fração do preço da carro-chefe — ajuste o esforço de raciocínio por requisição para equilibrar profundidade, velocidade e custo.
Feito para código e agentes
A GPT-5.4 mini API lida com refatorações multiarquivo, longas cadeias de uso de ferramentas e fluxos de agentes — uma base confiável e de baixo custo para agentes de programação em produção.
Contexto de 400K tokens
Aceita até 400.000 tokens por requisição — documentos longos, bases de código multiarquivo ou o histórico completo da conversa cabem em uma única chamada à GPT-5.4 mini API sem fragmentação.
Visão e function calling
A GPT-5.4 mini API aceita entrada de texto e imagem e retorna chamadas de ferramentas estruturadas e JSON estritamente válido — ideal para extração, análise e pipelines de agentes.
Endpoint compatível com OpenAI
A GPT-5.4 mini API fala o formato chat-completions da OpenAI. Aponte qualquer SDK da OpenAI para a RouterBase — sem credenciais separadas nem mudanças no código.
Uma chave para 200+ modelos
A mesma chave RouterBase que chama a GPT-5.4 mini API também roteia para GPT-5.4, Claude Opus 4.8, Gemini 3 Pro e mais de 200 modelos — sem gestão de credenciais por provedor.

Comece com a GPT-5.4 mini API em 3 passos
Do cadastro à sua primeira resposta em menos de 5 minutos.
Crie uma chave de API RouterBase
Cadastre-se e gere uma chave de API — uma chave alcança a GPT-5.4 mini API e todos os outros modelos do catálogo.
Envie sua primeira mensagem
Aponte qualquer SDK compatível com OpenAI para routerbase.com/v1 e defina o modelo como gpt-5-4-mini. A resposta da GPT-5.4 mini API segue o esquema padrão chat-completions — com streaming e uso de ferramentas.
Inspecione o uso
Cada resposta da GPT-5.4 mini API inclui um detalhamento de tokens — entrada, saída e leitura de cache — para que custo e taxa de acerto de cache fiquem visíveis em cada chamada.
Paga apenas pelo que usas
A RouterBase repassa preços de nível partner. Comparado com o preço público oficial do modelo.
O que as equipes constroem com a GPT-5.4 mini API
Cargas de produção reais rodando na GPT-5.4 mini API e no catálogo de modelos da RouterBase.
Rodamos a base do nosso agente na GPT-5.4 mini API e ela sustenta longas cadeias de uso de ferramentas sem desviar — a uma fração do custo da carro-chefe.
As saídas JSON estruturadas da GPT-5.4 mini API acabaram com o nosso parsing por regex frágil. JSON estritamente válido sempre, zero retentativas.
O raciocínio ajustável da GPT-5.4 mini API nos deixa regular profundidade e custo por tarefa. A RouterBase a torna 5% mais barata e contorna quedas automaticamente.
400K de contexto a preços de mini significa que posso colocar um repositório inteiro. A GPT-5.4 mini API raciocina entre arquivos sem perder o fio.
A RouterBase coloca a GPT-5.4 mini API e mais de 200 modelos atrás de uma única chave. A nossa equipe parou de abrir solicitações de novas contas de provedores.
Fazemos teste A/B da GPT-5.4 mini API contra a GPT-5.4 completa por requisição — o mesmo SDK, um campo de modelo. A maior parte do tráfego fica no mini e a conta caiu bruscamente.
Roteamos os nossos endpoints de alto volume para a GPT-5.4 mini API em um fim de semana. O único comentário no PR foi: 'espera, é só isso?'.
A $0.7125 / 1M de entrada menos 5%, a GPT-5.4 mini API nos deu raciocínio de classe GPT-5.4 a um preço que escala. A conta do ROI foi instantânea.
Perguntas frequentes
Perguntas comuns sobre a GPT-5.4 mini API.
É o pass-through da RouterBase para a GPT-5.4 mini da OpenAI — o nível GPT-5.4 econômico com contexto de 400K tokens, esforço de raciocínio ajustável, visão, function calling e saídas estruturadas, servido por uma interface REST compatível com OpenAI.