O nosso agente de planeamento executa fluxos de 40 passos na GLM 4.7 API sem perder o fio —— essa fiabilidade de longo curso é o que antes não conseguíamos.
A GLM 4.7 API é o mais recente modelo GLM topo de gama da Z.ai —— afinado para agentes de longo curso, seguimento estrito de instruções e raciocínio profundo, com uma janela de contexto de 200K tokens, tool calling nativo e saídas estruturadas. A GLM 4.7 API é compatível com OpenAI: aponte qualquer SDK para a RouterBase e defina o modelo como glm-4-7. Entrada a $0.51 / 1M tokens, saída a $1.87 / 1M, entrada em cache a $0.0935 / 1M —— 15% abaixo do oficial, tudo por um endpoint REST.
GLM 4.7 API: Chat
Use a GLM 4.7 API para executar o mais recente topo de gama da Z.ai —— o GLM mais fiável até hoje para execuções de agentes longas e de vários passos, seguimento estrito de instruções e raciocínio profundo, tudo compatível com OpenAI.
A GLM 4.7 API é o modelo topo de gama mais recente da Z.ai —— concebida para execuções de agentes longas e de múltiplos passos, cumprimento rigoroso de instruções e raciocínio profundo, com tool calling nativo, saídas estruturadas e uma janela de contexto de 200K tokens. Através da RouterBase, a GLM 4.7 API é totalmente compatível com OpenAI: aponte qualquer SDK existente para a base URL da RouterBase, defina o modelo como glm-4-7 e a sua primeira chamada à GLM 4.7 API passa de imediato.
O preço da GLM 4.7 API é $0.51 / 1M tokens de entrada, $1.87 / 1M tokens de saída e $0.0935 / 1M de leituras de entrada em cache —— 15% abaixo da tarifa oficial publicada. Uma chave RouterBase chega à GLM 4.7 API e a mais de 200 modelos —— sem conta Z.ai.
Seis razões para usar a GLM 4.7 API
De execuções de agentes sólidas como rocha a um preço com 15% de desconto —— seis razões pelas quais as equipas padronizam na GLM-4.7.
Feita para execuções de agentes longas
A GLM 4.7 API mantém um plano ao longo de dezenas de chamadas a ferramentas sem se desviar —— a fiabilidade de longo curso que torna os agentes autónomos realmente lançáveis.
Segue as instruções à risca
Dê à GLM 4.7 API um formato, um esquema ou um guia de estilo estrito e ela cumpre-o —— menos repetições de pedido, saídas estruturadas mais limpas e menos pós-processamento do seu lado.
Tool calling nativo
A GLM 4.7 API chama funções no formato OpenAI e raramente deforma uma chamada, mesmo no fundo de uma cadeia —— por isso os agentes multiferramenta não saem dos carris.
Janela de contexto longa
A GLM 4.7 API aceita até 200K tokens de contexto —— bases de código inteiras, processos ou toda uma sessão de histórico de um agente cabem num único pedido.
Compatível com OpenAI, uma chave
A GLM 4.7 API fala o formato chat-completions da OpenAI; a mesma chave RouterBase também encaminha para GPT-5.5, Claude, Gemini e mais de 200 modelos.
15% abaixo do preço de tabela
A GLM-4.7 custa 15% menos que a tarifa publicada da Z.ai —— $0.51 / 1M entrada, $1.87 / 1M saída, $0.0935 / 1M em cache. Raciocínio de topo de gama sem preço de topo de gama.

Comece a usar a GLM 4.7 API em 3 passos
Do registo à primeira resposta em menos de 5 minutos.
Crie uma chave RouterBase
Crie uma conta e gere uma chave de API —— a partir de um só lugar ela chega à GLM-4.7 e a todos os outros modelos do catálogo da RouterBase.
Envie a primeira mensagem
Aponte qualquer SDK compatível com OpenAI para routerbase.com/v1 e defina o modelo como glm-4-7. O streaming, as tool calls e as saídas estruturadas seguem todos o esquema padrão chat-completions.
Inspecione o uso
Cada resposta da GLM 4.7 API devolve um detalhe completo de tokens —— entrada, saída e entrada em cache —— para que o custo e os acertos de cache fiquem visíveis em cada chamada.
Paga apenas pelo que usas
A RouterBase repassa preços de nível partner. Comparado com o preço público oficial do modelo.
O que as equipas constroem com a GLM 4.7 API
Cargas de produção reais sobre o catálogo de mais de 200 modelos da RouterBase.
Padronizámos na GLM 4.7 API através da RouterBase numa linha —— o JSON estrito em todas as respostas deixou-nos apagar uma camada inteira de validação de saída.
Ao longo de cadeias de ferramentas longas a GLM 4.7 API mal deforma uma chamada —— os nossos agentes agora terminam tarefas de vários passos que antes paravam a meio.
Fazemos A/B da GLM 4.7 API contra GPT e Claude atrás de uma única chave RouterBase —— iguala ambos nas nossas avaliações de raciocínio por uma fração do custo.
O andaime longo de agentes mais o preço de entrada em cache mantém a nossa fatura estável —— a GLM 4.7 API relê o mesmo contexto barato a cada turno.
Apontar o nosso SDK da OpenAI para a GLM 4.7 API foi uma só alteração de base URL, e as saídas estruturadas chegaram exatamente na forma que pedimos.
Perguntas frequentes
Perguntas comuns sobre a GLM 4.7 API.
A GLM 4.7 API é a ligação direta da RouterBase à GLM-4.7 da Z.ai —— o mais recente topo de gama GLM, afinado para agentes de longo curso, seguimento estrito de instruções e raciocínio profundo, servido por uma interface REST compatível com OpenAI com tool calling nativo e saídas estruturadas.