Passámos os nossos agentes de código do GLM-4.5 para a GLM 4.6 API —— diffs multiarquivo mais limpos, e o menor uso de tokens aparece logo na fatura.
A GLM 4.6 API é o novo modelo GLM topo de gama da Z.ai —— um avanço em relação ao GLM-4.5, com uma janela de contexto de 200K tokens, código mais forte em cenários reais e fluxos de agentes mais eficientes em tokens, além de tool calling nativo e saídas estruturadas. A GLM 4.6 API é compatível com OpenAI: aponte qualquer SDK para a RouterBase e defina o modelo como glm-4-6. Entrada a $0.51 / 1M tokens, saída a $1.87 / 1M, entrada em cache a $0.0935 / 1M —— 15% abaixo do oficial, tudo por um endpoint REST.
GLM 4.6 API: Chat
Use a GLM 4.6 API para executar o novo topo de gama da Z.ai —— um grande salto em relação ao GLM-4.5, com uma janela de contexto de 200K tokens, código mais forte em cenários reais e execuções de agentes mais enxutas e eficientes em tokens.
A GLM 4.6 API é o modelo topo de gama mais recente da Z.ai —— um avanço em relação ao GLM-4.5, com uma janela de contexto de 200K tokens, programação mais forte em cenários reais e execuções de agentes mais enxutas e eficientes em tokens, além de tool calling nativo e saídas estruturadas. Através da RouterBase, a GLM 4.6 API é totalmente compatível com OpenAI: aponte qualquer SDK existente para a base URL da RouterBase, defina o modelo como glm-4-6 e a sua primeira chamada à GLM 4.6 API passa de imediato.
O preço da GLM 4.6 API é $0.51 / 1M tokens de entrada, $1.87 / 1M tokens de saída e $0.0935 / 1M de leituras de entrada em cache —— 15% abaixo da tarifa oficial publicada. Uma chave RouterBase chega à GLM 4.6 API e a mais de 200 modelos —— sem conta Z.ai.
Seis razões para usar a GLM 4.6 API
De uma janela de contexto de 200K a um preço de lançamento com 15% de desconto —— o que torna a GLM-4.6 digna de ir para produção.
Um salto real em relação ao GLM-4.5
A GLM 4.6 API é o novo topo de gama da Z.ai —— mensuravelmente melhor em código, raciocínio e tool calling de agentes do que o GLM-4.5, e conclui as tarefas com cerca de 15% menos tokens.
Feita para código
A GLM 4.6 API é um modelo de código de primeira linha —— geração multiarquivo, refatoração, depuração e um trabalho de front-end mais afiado, com resultados líderes em benchmarks de código reais.
Tool calling nativo
A GLM-4.6 foi afinada para agentes —— o function / tool calling funciona de origem no formato OpenAI, com menos chamadas malformadas do que o GLM-4.5 ao encadear passos.
Janela de contexto longa
A GLM 4.6 API aceita até 200K tokens de contexto —— repositórios inteiros, documentos longos ou todo o histórico de um agente numa única chamada.
Compatível com OpenAI, uma chave
A GLM 4.6 API fala o formato chat-completions da OpenAI; a mesma chave RouterBase também encaminha para GPT-5.5, Claude, Gemini e mais de 200 modelos.
15% abaixo do preço de tabela
A GLM-4.6 custa 15% menos que a tarifa publicada da Z.ai —— $0.51 / 1M entrada, $1.87 / 1M saída, $0.0935 / 1M em cache. Paga pelos tokens que usa, nada por pedido.

Comece a usar a GLM 4.6 API em 3 passos
Do registo à primeira resposta em menos de 5 minutos.
Crie uma chave RouterBase
Crie uma conta e gere uma chave —— ela desbloqueia a GLM-4.6 e todos os outros modelos do catálogo da RouterBase.
Envie a primeira mensagem
Aponte qualquer SDK compatível com OpenAI para routerbase.com/v1 e defina o modelo como glm-4-6. As respostas seguem o esquema padrão chat-completions, com streaming e tool calls disponíveis de origem.
Inspecione o uso
Cada resposta traz um detalhe completo de tokens —— entrada, saída e entrada em cache —— para acompanhar o custo e a taxa de acerto de cache da GLM 4.6 API chamada a chamada.
Paga apenas pelo que usas
A RouterBase repassa preços de nível partner. Comparado com o preço público oficial do modelo.
O que as equipas constroem com a GLM 4.6 API
Cargas de produção reais sobre o catálogo de mais de 200 modelos da RouterBase.
Mudámos para a GLM 4.6 API pela RouterBase numa linha —— sem alterações de SDK, e o maior contexto de 200K do 4.6 deixou-nos largar os antigos remendos de fragmentação.
O tool calling da GLM 4.6 API é mais fiável do que o GLM-4.5 para os nossos agentes —— menos chamadas malformadas, e o mesmo formato OpenAI.
A RouterBase deixa-nos fazer A/B da GLM 4.6 API contra GPT e Claude atrás de uma chave —— o 4.6 vence as nossas avaliações de código por uma fração do custo.
O preço de entrada em cache mais o maior contexto do 4.6 voltaram a cortar a nossa fatura de RAG —— os prompts de sistema longos na GLM 4.6 API já quase nem se notam.
Apontámos o nosso SDK da OpenAI para a RouterBase e a GLM 4.6 API simplesmente funcionou —— passar do GLM-4.5 foi mudar uma linha de modelo.
Perguntas frequentes
Perguntas comuns sobre a GLM 4.6 API.
A GLM 4.6 API é a ligação direta da RouterBase à GLM-4.6 da Z.ai —— o novo topo de gama da Z.ai e uma clara evolução face ao GLM-4.5, com uma janela de contexto de 200K, código e tool calling de agentes mais fortes e melhor eficiência de tokens, servido por uma interface REST compatível com OpenAI com tool calling nativo e saídas estruturadas.