chat.gpt_5_nano
openai/gpt-5-nano

A GPT-5 nano API é o modelo GPT-5 mais rápido e econômico da OpenAI —— janela de contexto de 400K tokens, raciocínio ajustável, visão (entrada de texto + imagem), function calling e saídas JSON estruturadas, otimizada para baixa latência e alto throughput. A GPT-5 nano API é compatível com OpenAI: aponte qualquer SDK para a RouterBase e defina o modelo como gpt-5-nano. Entrada a $0.03 / 1M, saída a $0.24 / 1M, leituras em cache a $0.003 / 1M —— 5% abaixo da taxa padrão, tudo por um endpoint REST.

Input
GPT-5 nano
max_tokens4096
presence_penalty0
frequency_penalty0
GPT-5 nano Online
Hi! I'm a helpful AI assistant. What can I do for you?

GPT-5 nano API: Chat

Use a GPT-5 nano API para rodar o modelo GPT-5 mais rápido e barato da OpenAI: raciocínio, uma janela de contexto de 400K tokens e visão.

A GPT-5 nano API é o modelo GPT-5 menor e mais econômico da OpenAI: uma janela de contexto de 400K tokens, visão (entrada de texto + imagem), esforço de raciocínio ajustável, function calling e saídas JSON estruturadas, ajustado para baixa latência e alta vazão. Roteado pela RouterBase, é totalmente compatível com OpenAI: aponte qualquer SDK existente para a URL base da RouterBase, defina o modelo como gpt-5-nano e sua primeira chamada já é processada na hora.

O preço é de $0.03 / 1M tokens de entrada, $0.24 / 1M tokens de saída e $0.003 / 1M leituras de entrada em cache: 5% abaixo da tarifa padrão. Uma única chave da RouterBase, sem necessidade de credenciais separadas da OpenAI.

Por que este modelo

Seis motivos pelos quais as equipes lançam com a GPT-5 nano API

De um contexto de 400K tokens a um preço com 5% de desconto: o que faz a GPT-5 nano se destacar.

Contexto de 400K tokens

Aceita até 400.000 tokens por requisição: documentos longos, código de vários arquivos ou um histórico de chat extenso cabem em uma única chamada à GPT-5 nano API.

Raciocínio a custo nano

A GPT-5 nano API expõe um esforço de raciocínio ajustável: aumente-o para problemas mais difíceis ou diminua-o por velocidade, tudo no nível mais barato da família GPT-5.

O nível GPT-5 mais rápido e barato

Feito para cargas de alto volume: a GPT-5 nano API é o modelo GPT-5 de menor custo a $0.03 / 1M tokens de entrada, ideal para classificação, autocompletar, extração e roteamento em escala.

Visão e function calling

A GPT-5 nano API aceita imagens junto com texto e retorna chamadas de ferramentas estruturadas: passe uma URL de imagem ou base64, defina ferramentas e solicite JSON estritamente válido.

Endpoint compatível com OpenAI

A GPT-5 nano API fala o formato de transmissão de chat-completions da OpenAI. Qualquer SDK de Python, Node, Go ou Rust que funcione com OpenAI funciona aqui: basta atualizar a URL base.

Uma chave para mais de 200 modelos

A mesma chave da RouterBase que chama a GPT-5 nano API também roteia para GPT-5, Claude Opus 4.8, Gemini 3.5 Flash e 200+ outros modelos, sem gerenciar credenciais por provedor.

RouterBase dashboard preview
Início rápido

Comece com a GPT-5 nano API em 3 passos

Do cadastro à sua primeira resposta em menos de 5 minutos.

  1. Crie uma chave de API da RouterBase

    Cadastre-se e gere uma chave de API: uma única chave alcança a GPT-5 nano API e todos os outros modelos do catálogo.

  2. Envie sua primeira mensagem

    Aponte qualquer SDK compatível com OpenAI para routerbase.com/v1 e defina o modelo como gpt-5-nano. A resposta segue o esquema padrão de chat-completions, com suporte a streaming, raciocínio e visão.

  3. Inspecione o uso

    Cada resposta inclui um detalhamento completo de tokens (entrada, saída, raciocínio e leitura de cache), de modo que o custo e a taxa de acertos de cache ficam visíveis em cada chamada.

Preços

Paga apenas pelo que usas

A RouterBase repassa preços de nível partner. Comparado com o preço público oficial do modelo.

Histórias de clientes

O que as equipes constroem com a GPT-5 nano API

Cargas de produção reais rodando na GPT-5 nano API e no catálogo de modelos da RouterBase.

Marcus Reyes
Marcus ReyesCTO, Paradigm AI

Roteamos 90% do nosso tráfego pela GPT-5 nano API: classificação e extração com nível de raciocínio a uma fração do custo. Os 5% de desconto da RouterBase são margem pura.

Priya Lakshmi
Priya LakshmiFounder, Quillo

A visão na GPT-5 nano API substituiu um pipeline de OCR: uma única chamada rápida e barata descreve e extrai, texto e imagem juntos.

Thomas Beck
Thomas BeckStaff Engineer, Northbeam

As saídas JSON estruturadas da GPT-5 nano API acabaram com nosso parsing instável por regex. JSON estritamente válido toda vez, zero novas tentativas.

Aoi Tanaka
Aoi TanakaML Lead, Daybreak Robotics

No nosso volume, a GPT-5 nano é o único modelo de classe GPT-5 que fecha a conta. A RouterBase a torna 5% mais barata ainda.

Jonas Keller
Jonas KellerIndie Developer

O raciocínio ajustável da GPT-5 nano API me deixa regular o custo frente à qualidade em cada requisição. Barato o suficiente para eu parar de contar tokens.

Ethan Nguyen
Ethan NguyenHead of Engineering, Compound Studio

A RouterBase coloca a GPT-5 nano API e mais de 200 outros modelos atrás de uma única chave. Nossa equipe parou de abrir solicitações para novas contas de provedores.

Sophia Martín
Sophia MartínCTO, Relay

Fazemos testes A/B da GPT-5 nano API contra a GPT-5 em cada requisição: o mesmo SDK, um único campo de modelo. A maior parte do tráfego fica na nano e a fatura caiu 70%.

Lucas Fernandes
Lucas FernandesEngineering Manager, Light

Migramos 42 serviços para a GPT-5 nano API em um fim de semana. O único comentário no PR foi: 'espera, é só isso?'.

David Okonkwo
David OkonkwoCo-founder, Figment

A $0.03 / 1M de entrada menos 5%, a GPT-5 nano API tornou nossos recursos de alto volume realmente lucrativos. A conta do ROI foi instantânea.

Perguntas frequentes

Perguntas comuns sobre a GPT-5 nano API.

É o acesso direto da RouterBase à GPT-5 nano da OpenAI: o endpoint de chat mais rápido e barato da família GPT-5, com contexto de 400K tokens, raciocínio ajustável, entrada de visão, function calling e saídas estruturadas, servido por uma interface REST compatível com OpenAI.