Roteamos 90% do nosso tráfego pela GPT-4.1 nano API: classificação e extração por uma fração do custo. Os 5% de desconto da RouterBase são margem pura.
A GPT-4.1 nano API é o modelo 4.1 mais rápido e econômico da OpenAI —— janela de contexto de 1M tokens, visão (entrada de texto + imagem), function calling e saídas JSON estruturadas, otimizada para baixa latência e alto throughput. A GPT-4.1 nano API é compatível com OpenAI: aponte qualquer SDK para a RouterBase e defina o modelo como gpt-4-1-nano. Entrada a $0.06 / 1M, saída a $0.24 / 1M, leituras em cache a $0.015 / 1M —— 5% abaixo da taxa padrão, tudo por um endpoint REST.
GPT-4.1 nano API: Chat
Use a GPT-4.1 nano API para rodar o modelo 4.1 mais rápido e barato da OpenAI, com uma janela de contexto de 1M de tokens e visão.
A GPT-4.1 nano API é o menor e mais econômico modelo 4.1 da OpenAI: uma janela de contexto de 1M de tokens, visão (entrada de texto + imagem), function calling e saídas JSON estruturadas, ajustado para baixa latência e alta vazão. Roteado pela RouterBase, é totalmente compatível com a OpenAI: aponte qualquer SDK existente para a URL base da RouterBase, defina o modelo como gpt-4-1-nano e sua primeira chamada já funciona de imediato.
O preço é de $0.06 / 1M tokens de entrada, $0.24 / 1M tokens de saída e $0.015 / 1M de leituras de entrada em cache, 5% abaixo da tarifa padrão. Uma única chave RouterBase, sem necessidade de credenciais separadas da OpenAI.
Seis motivos pelos quais os times entregam com a GPT-4.1 nano API
Do contexto de 1M de tokens ao preço com 5% de desconto: o que faz a GPT-4.1 nano se destacar.
Contexto de 1M de tokens
Aceita até 1 milhão de tokens por requisição: documentos longos, código de múltiplos arquivos ou histórico de chat extenso cabem em uma única chamada à GPT-4.1 nano API.
Entrada de visão
A GPT-4.1 nano API aceita imagens junto com texto. Passe uma URL de imagem ou base64 na mesma requisição para legendar, extrair ou raciocinar sobre conteúdo visual.
O nível 4.1 mais rápido e barato
Feito para cargas de alto volume: a GPT-4.1 nano API é o modelo de menor custo da família 4.1, a $0.06 / 1M tokens de entrada, ideal para classificação, autocompletar, extração e roteamento em escala.
Function calling e JSON
Defina ferramentas e solicite um schema JSON; a GPT-4.1 nano API retorna chamadas de ferramenta estruturadas e JSON estritamente válido para pipelines confiáveis de agentes e extração.
Endpoint compatível com OpenAI
A GPT-4.1 nano API fala o formato de transmissão chat-completions da OpenAI. Qualquer SDK em Python, Node, Go ou Rust que funcione com a OpenAI funciona aqui: basta atualizar a URL base.
Uma chave para 200+ modelos
A mesma chave RouterBase que chama a GPT-4.1 nano API também roteia para GPT-5, Claude Opus 4.8, Gemini 3.5 Flash e 200+ outros modelos, sem gestão de credenciais por provedor.

Comece com a GPT-4.1 nano API em 3 passos
Do cadastro à sua primeira resposta em menos de 5 minutos.
Crie uma chave de API da RouterBase
Cadastre-se e gere uma chave de API: uma única chave alcança a GPT-4.1 nano API e todos os outros modelos do catálogo.
Envie sua primeira mensagem
Aponte qualquer SDK compatível com OpenAI para routerbase.com/v1 e defina o modelo como gpt-4-1-nano. A resposta segue o schema padrão de chat-completions, com suporte a streaming e visão.
Inspecione o uso
Cada resposta inclui um detalhamento completo de tokens (entrada, saída e tokens de leitura de cache), de forma que o custo e a taxa de acerto de cache fiquem visíveis em cada chamada.
Paga apenas pelo que usas
A RouterBase repassa preços de nível partner. Comparado com o preço público oficial do modelo.
O que os times constroem com a GPT-4.1 nano API
Cargas de produção reais rodando sobre a GPT-4.1 nano API e o catálogo de modelos da RouterBase.
A visão na GPT-4.1 nano API substituiu um pipeline de OCR: uma chamada rápida e barata legenda e extrai, texto e imagem juntos.
As saídas JSON estruturadas da GPT-4.1 nano API acabaram com nossa instável análise por regex. JSON estritamente válido sempre, zero retentativas.
No nosso volume, a GPT-4.1 nano é o único modelo de classe 4.1 que se paga. A RouterBase a torna 5% mais barata ainda.
O function calling na GPT-4.1 nano API se conecta direto ao meu loop de agente. Barato a ponto de eu parar de contar tokens.
A RouterBase coloca a GPT-4.1 nano API e 200+ outros modelos atrás de uma única chave. Nosso time parou de abrir solicitações de novas contas de provedores.
Fazemos A/B da GPT-4.1 nano API contra a GPT-4.1 por requisição: o mesmo SDK, um único campo de modelo. A maior parte do tráfego fica na nano e a conta caiu 70%.
Migramos 42 serviços para a GPT-4.1 nano API em um fim de semana. O único comentário no PR foi: "peraí, é só isso?".
A $0.06 / 1M de entrada menos 5%, a GPT-4.1 nano API tornou nossos recursos de alto volume realmente lucrativos. A conta de ROI foi instantânea.
Perguntas frequentes
Perguntas comuns sobre a GPT-4.1 nano API.
É o acesso direto da RouterBase à GPT-4.1 nano da OpenAI: o endpoint de chat mais rápido e barato da família 4.1, com contexto de 1M de tokens, entrada de visão, function calling e saídas estruturadas, servido por uma interface REST compatível com OpenAI.