Encaminhamos só as nossas tarefas de raciocínio mais difíceis para a GLM 5 API e modelos mais baratos para o resto —— resolve problemas que os outros continuavam a errar.
A GLM 5 API é o modelo GLM topo de gama de nova geração da Z.ai —— o mais capaz da família, um salto geracional sobre a linha 4.x em raciocínio difícil, programação complexa e trabalho agêntico exigente, com uma janela de contexto de 200K tokens, tool calling nativo e saídas estruturadas. A GLM 5 API é compatível com OpenAI: aponte qualquer SDK para a RouterBase e defina o modelo como glm-5. Entrada a $0.90 / 1M tokens, saída a $2.88 / 1M, entrada em cache a $0.18 / 1M —— 10% abaixo do oficial, tudo por um endpoint REST.
GLM 5 API: Chat
Use a GLM 5 API para chegar ao topo de gama de nova geração da Z.ai —— a GLM-5 é o modelo mais capaz da família, um salto claro sobre a linha 4.x em raciocínio difícil, programação complexa e trabalho agêntico exigente.
A GLM 5 API é o modelo topo de gama de nova geração da Z.ai —— o modelo mais capaz da família GLM, um salto geracional em relação à linha 4.x em raciocínio difícil, programação complexa e trabalho de agentes exigente, com tool calling nativo, saídas estruturadas e uma janela de contexto de 200K tokens. Através da RouterBase, a GLM 5 API é totalmente compatível com OpenAI: aponte qualquer SDK existente para a base URL da RouterBase, defina o modelo como glm-5 e a sua primeira chamada à GLM 5 API passa de imediato.
O preço da GLM 5 API é $0.90 / 1M tokens de entrada, $2.88 / 1M tokens de saída e $0.18 / 1M de leituras de entrada em cache —— 10% abaixo da tarifa oficial publicada. Uma chave RouterBase chega à GLM 5 API e a mais de 200 modelos —— sem conta Z.ai.
Seis razões para usar a GLM 5 API
Do raciocínio de fronteira a um preço com 10% de desconto —— seis razões pelas quais as equipas recorrem à GLM-5 nos problemas difíceis.
A GLM mais capaz até hoje
A GLM-5 é um passo geracional sobre a linha 4.x —— raciocínio mais profundo, resolução de problemas multietapa mais forte e melhor juízo em tarefas ambíguas e abertas.
Raciocínio de fronteira
Dê à GLM 5 API um problema difícil de matemática, análise ou planeamento e ela resolve-o com método, passo a passo —— a profundidade que só um modelo de topo oferece.
Tool calling nativo
A GLM-5 planeia e chama ferramentas no formato OpenAI com bom critério sobre quando agir —— ideal para agentes autónomos que enfrentam objetivos complexos e de várias etapas.
Janela de contexto longa
A GLM 5 API aceita até 200K tokens de contexto —— bases de código inteiras, dossiês de investigação ou longos históricos de casos ficam à vista num único passo de raciocínio.
Compatível com OpenAI, uma chave
A GLM 5 API usa o formato chat-completions da OpenAI, por isso uma chave RouterBase coloca a GLM-5 ao lado de GPT-5.5, Claude, Gemini e mais de 200 modelos.
10% abaixo do preço de tabela
A GLM-5 custa 10% menos que a tarifa publicada da Z.ai —— $0.90 / 1M entrada, $2.88 / 1M saída, $0.18 / 1M em cache. Capacidade de fronteira a um preço encaminhado, faturado por token.

Comece a usar a GLM 5 API em 3 passos
Do registo à primeira resposta em menos de 5 minutos.
Crie uma chave RouterBase
Crie uma conta e gere uma chave de API —— a partir de um só lugar ela chega à GLM-5 e a todos os outros modelos do catálogo da RouterBase.
Envie a primeira mensagem
Aponte qualquer SDK compatível com OpenAI para routerbase.com/v1 e defina o modelo como glm-5. O streaming, as tool calls e as saídas estruturadas seguem todos o esquema padrão chat-completions.
Inspecione o uso
Cada resposta da GLM 5 API devolve um detalhe completo de tokens —— entrada, saída e entrada em cache —— para que o custo e os acertos de cache fiquem visíveis em cada chamada.
Paga apenas pelo que usas
A RouterBase repassa preços de nível partner. Comparado com o preço público oficial do modelo.
O que as equipas constroem com a GLM 5 API
Cargas de produção reais sobre o catálogo de mais de 200 modelos da RouterBase.
A GLM-5 tornou-se o nosso modelo por omissão para análise complexa via RouterBase —— uma linha de configuração, e o salto de qualidade em perguntas abertas foi evidente.
Para o planeamento de várias etapas os nossos agentes apoiam-se na GLM 5 API —— raciocina sobre o objetivo inteiro em vez de só o próximo passo.
Fazemos A/B da GLM 5 API contra modelos de fronteira atrás de uma única chave RouterBase —— aguenta nas nossas avaliações mais duras a um custo bastante mais baixo.
A GLM 5 API trata dos casos limite complicados que o nosso pipeline costumava escalar para um humano —— menos fallbacks e saídas mais limpas.
Passar os nossos prompts mais difíceis para a GLM 5 API foi uma só alteração de base URL, e as respostas voltaram mais afiadas e mais bem estruturadas.
Perguntas frequentes
Perguntas comuns sobre a GLM 5 API.
A GLM 5 API é a ligação direta da RouterBase à GLM-5 da Z.ai —— o modelo mais recente e mais capaz da família GLM, um passo geracional sobre a linha 4.x para raciocínio difícil, programação complexa e agentes exigentes, servido por uma interface REST compatível com OpenAI com tool calling nativo e saídas estruturadas.