Roteamos 90% do nosso tráfego pela GPT-4o mini API: classificação e extração por uma fração do custo. O desconto de 5% da RouterBase é margem pura.
A GPT-4o mini API é o modelo multimodal rápido e de baixo custo da OpenAI — contexto de 128K tokens, visão nativa (texto + imagem), function calling e saídas JSON estruturadas. A GPT-4o mini API é compatível com OpenAI: aponte qualquer SDK para a RouterBase e mantenha o modelo gpt-4o-mini. Entrada a $0.09 / 1M, saída a $0.36 / 1M, leituras em cache a $0.045 / 1M — 5% abaixo da tarifa padrão, tudo por um endpoint REST.
GPT-4o mini API: Chat
Use a GPT-4o mini API para rodar o modelo multimodal rápido e de baixo custo da OpenAI: texto e visão em um único endpoint.
A GPT-4o mini API é o modelo pequeno mais econômico da OpenAI: uma janela de contexto de 128K tokens, visão nativa (entrada de texto + imagem), function calling e saídas estruturadas em JSON. Roteada pela RouterBase, é totalmente compatível com a OpenAI: aponte qualquer SDK existente para a URL base da RouterBase, mantenha o nome do modelo gpt-4o-mini e sua primeira chamada já funciona na hora.
O preço é de $0.09 / 1M tokens de entrada, $0.36 / 1M tokens de saída e $0.045 / 1M leituras de entrada em cache: 5% abaixo da taxa padrão. Uma única chave RouterBase, sem precisar de credenciais separadas da OpenAI.
Seis motivos pelos quais os times lançam na GPT-4o mini API
Da visão nativa ao preço com 5% de desconto: o que faz a GPT-4o mini se destacar.
Contexto de 128K tokens
Aceita até 128.000 tokens por requisição: documentos longos, código de múltiplos arquivos ou históricos de chat extensos cabem em uma única chamada à GPT-4o mini API.
Visão nativa
A GPT-4o mini API aceita imagens junto com texto. Passe uma URL de imagem ou base64 na mesma requisição para legendar, extrair ou raciocinar sobre conteúdo visual.
Function calling e ferramentas
Defina ferramentas e a GPT-4o mini API retorna chamadas de ferramentas estruturadas: conecte-a a agentes, recuperação ou ações do seu app com o esquema padrão de function calling da OpenAI.
Saídas estruturadas em JSON
Solicite um esquema JSON e a GPT-4o mini API retorna JSON estritamente válido sempre: sem parsing frágil, ideal para extração e classificação.
Rápido e de baixo custo
Feito para cargas de alto volume: a GPT-4o mini API é o modelo classe GPT-4 mais barato da OpenAI a $0.09 / 1M tokens de entrada, 5% abaixo da taxa padrão pela RouterBase.
Uma chave para 200+ modelos
A mesma chave RouterBase que chama a GPT-4o mini API também roteia para GPT-5, Claude Opus 4.8, Gemini 3.5 Flash e outros 200+ modelos: sem gerenciar credenciais por provedor.

Comece com a GPT-4o mini API em 3 passos
Do cadastro à sua primeira resposta em menos de 5 minutos.
Crie uma chave de API da RouterBase
Cadastre-se e gere uma chave de API: uma única chave alcança a GPT-4o mini API e todos os outros modelos do catálogo.
Envie sua primeira mensagem
Aponte qualquer SDK compatível com a OpenAI para routerbase.com/v1 e defina o modelo como gpt-4o-mini. A resposta segue o esquema padrão de chat-completions, com suporte a streaming e visão.
Inspecione o uso
Cada resposta inclui um detalhamento de tokens (entrada, saída e tokens de leitura de cache) para que o custo e a taxa de acerto de cache fiquem visíveis em cada chamada.
Paga apenas pelo que usas
A RouterBase repassa preços de nível partner. Comparado com o preço público oficial do modelo.
O que os times constroem com a GPT-4o mini API
Cargas reais de produção rodando na GPT-4o mini API e no catálogo de modelos da RouterBase.
A visão nativa da GPT-4o mini API substituiu todo um pipeline de OCR. Uma chamada legenda e extrai: texto e imagem na mesma requisição.
As saídas estruturadas em JSON da GPT-4o mini API acabaram com nosso parsing instável de regex. JSON estritamente válido sempre, zero novas tentativas.
No nosso volume, a GPT-4o mini é o único modelo classe GPT-4 que fecha a conta. A RouterBase a deixa 5% mais barata ainda.
O function calling da GPT-4o mini API conecta direto no meu loop de agente. Barato o bastante para eu parar de contar tokens.
A RouterBase coloca a GPT-4o mini API e outros 200+ modelos atrás de uma única chave. Nosso time parou de abrir chamados para novas contas de provedor.
Fazemos A/B da GPT-4o mini API contra a GPT-4o por requisição: o mesmo SDK, um único campo de modelo. A maior parte do tráfego fica na mini e a conta caiu 70%.
Migramos 42 serviços para a GPT-4o mini API em um fim de semana. O único comentário no PR foi 'peraí, é só isso?'.
A $0.09 / 1M de entrada menos 5%, a GPT-4o mini API tornou nossos recursos de alto volume realmente lucrativos. A conta de ROI foi instantânea.
Perguntas frequentes
Perguntas comuns sobre a GPT-4o mini API.
É o acesso direto da RouterBase à GPT-4o mini da OpenAI: um endpoint de chat multimodal rápido e de baixo custo com contexto de 128K tokens, visão nativa, function calling e saídas estruturadas, servido por uma interface REST compatível com a OpenAI.