chat.glm_4_6
zai/glm-4-6

A GLM 4.6 API é o novo modelo GLM topo de gama da Z.ai —— um avanço em relação ao GLM-4.5, com uma janela de contexto de 200K tokens, código mais forte em cenários reais e fluxos de agentes mais eficientes em tokens, além de tool calling nativo e saídas estruturadas. A GLM 4.6 API é compatível com OpenAI: aponte qualquer SDK para a RouterBase e defina o modelo como glm-4-6. Entrada a $0.51 / 1M tokens, saída a $1.87 / 1M, entrada em cache a $0.0935 / 1M —— 15% abaixo do oficial, tudo por um endpoint REST.

Input
GLM-4.6
max_tokens4096
temperature1
top_p1
presence_penalty0
frequency_penalty0
GLM-4.6 Online
Hi! I'm a helpful AI assistant. What can I do for you?

GLM 4.6 API: Chat

Use a GLM 4.6 API para executar o novo topo de gama da Z.ai —— um grande salto em relação ao GLM-4.5, com uma janela de contexto de 200K tokens, código mais forte em cenários reais e execuções de agentes mais enxutas e eficientes em tokens.

A GLM 4.6 API é o modelo topo de gama mais recente da Z.ai —— um avanço em relação ao GLM-4.5, com uma janela de contexto de 200K tokens, programação mais forte em cenários reais e execuções de agentes mais enxutas e eficientes em tokens, além de tool calling nativo e saídas estruturadas. Através da RouterBase, a GLM 4.6 API é totalmente compatível com OpenAI: aponte qualquer SDK existente para a base URL da RouterBase, defina o modelo como glm-4-6 e a sua primeira chamada à GLM 4.6 API passa de imediato.

O preço da GLM 4.6 API é $0.51 / 1M tokens de entrada, $1.87 / 1M tokens de saída e $0.0935 / 1M de leituras de entrada em cache —— 15% abaixo da tarifa oficial publicada. Uma chave RouterBase chega à GLM 4.6 API e a mais de 200 modelos —— sem conta Z.ai.

Porquê este modelo

Seis razões para usar a GLM 4.6 API

De uma janela de contexto de 200K a um preço de lançamento com 15% de desconto —— o que torna a GLM-4.6 digna de ir para produção.

Um salto real em relação ao GLM-4.5

A GLM 4.6 API é o novo topo de gama da Z.ai —— mensuravelmente melhor em código, raciocínio e tool calling de agentes do que o GLM-4.5, e conclui as tarefas com cerca de 15% menos tokens.

Feita para código

A GLM 4.6 API é um modelo de código de primeira linha —— geração multiarquivo, refatoração, depuração e um trabalho de front-end mais afiado, com resultados líderes em benchmarks de código reais.

Tool calling nativo

A GLM-4.6 foi afinada para agentes —— o function / tool calling funciona de origem no formato OpenAI, com menos chamadas malformadas do que o GLM-4.5 ao encadear passos.

Janela de contexto longa

A GLM 4.6 API aceita até 200K tokens de contexto —— repositórios inteiros, documentos longos ou todo o histórico de um agente numa única chamada.

Compatível com OpenAI, uma chave

A GLM 4.6 API fala o formato chat-completions da OpenAI; a mesma chave RouterBase também encaminha para GPT-5.5, Claude, Gemini e mais de 200 modelos.

15% abaixo do preço de tabela

A GLM-4.6 custa 15% menos que a tarifa publicada da Z.ai —— $0.51 / 1M entrada, $1.87 / 1M saída, $0.0935 / 1M em cache. Paga pelos tokens que usa, nada por pedido.

RouterBase dashboard preview
Início rápido

Comece a usar a GLM 4.6 API em 3 passos

Do registo à primeira resposta em menos de 5 minutos.

  1. Crie uma chave RouterBase

    Crie uma conta e gere uma chave —— ela desbloqueia a GLM-4.6 e todos os outros modelos do catálogo da RouterBase.

  2. Envie a primeira mensagem

    Aponte qualquer SDK compatível com OpenAI para routerbase.com/v1 e defina o modelo como glm-4-6. As respostas seguem o esquema padrão chat-completions, com streaming e tool calls disponíveis de origem.

  3. Inspecione o uso

    Cada resposta traz um detalhe completo de tokens —— entrada, saída e entrada em cache —— para acompanhar o custo e a taxa de acerto de cache da GLM 4.6 API chamada a chamada.

Preços

Paga apenas pelo que usas

A RouterBase repassa preços de nível partner. Comparado com o preço público oficial do modelo.

Histórias de clientes

O que as equipas constroem com a GLM 4.6 API

Cargas de produção reais sobre o catálogo de mais de 200 modelos da RouterBase.

Marcus Reyes
Marcus ReyesCTO, Paradigm AI

Passámos os nossos agentes de código do GLM-4.5 para a GLM 4.6 API —— diffs multiarquivo mais limpos, e o menor uso de tokens aparece logo na fatura.

Priya Lakshmi
Priya LakshmiFounder, Quillo

Mudámos para a GLM 4.6 API pela RouterBase numa linha —— sem alterações de SDK, e o maior contexto de 200K do 4.6 deixou-nos largar os antigos remendos de fragmentação.

Aoi Tanaka
Aoi TanakaML Lead, Daybreak Robotics

O tool calling da GLM 4.6 API é mais fiável do que o GLM-4.5 para os nossos agentes —— menos chamadas malformadas, e o mesmo formato OpenAI.

Ethan Nguyen
Ethan NguyenHead of Engineering, Compound Studio

A RouterBase deixa-nos fazer A/B da GLM 4.6 API contra GPT e Claude atrás de uma chave —— o 4.6 vence as nossas avaliações de código por uma fração do custo.

Sophia Martín
Sophia MartínCTO, Relay

O preço de entrada em cache mais o maior contexto do 4.6 voltaram a cortar a nossa fatura de RAG —— os prompts de sistema longos na GLM 4.6 API já quase nem se notam.

Lucas Fernandes
Lucas FernandesEngineering Manager, Light

Apontámos o nosso SDK da OpenAI para a RouterBase e a GLM 4.6 API simplesmente funcionou —— passar do GLM-4.5 foi mudar uma linha de modelo.

Perguntas frequentes

Perguntas comuns sobre a GLM 4.6 API.

A GLM 4.6 API é a ligação direta da RouterBase à GLM-4.6 da Z.ai —— o novo topo de gama da Z.ai e uma clara evolução face ao GLM-4.5, com uma janela de contexto de 200K, código e tool calling de agentes mais fortes e melhor eficiência de tokens, servido por uma interface REST compatível com OpenAI com tool calling nativo e saídas estruturadas.