chat.glm_4_7
zai/glm-4-7

A GLM 4.7 API é o mais recente modelo GLM topo de gama da Z.ai —— afinado para agentes de longo curso, seguimento estrito de instruções e raciocínio profundo, com uma janela de contexto de 200K tokens, tool calling nativo e saídas estruturadas. A GLM 4.7 API é compatível com OpenAI: aponte qualquer SDK para a RouterBase e defina o modelo como glm-4-7. Entrada a $0.51 / 1M tokens, saída a $1.87 / 1M, entrada em cache a $0.0935 / 1M —— 15% abaixo do oficial, tudo por um endpoint REST.

Input
GLM-4.7
max_tokens4096
temperature1
top_p1
presence_penalty0
frequency_penalty0
GLM-4.7 Online
Hi! I'm a helpful AI assistant. What can I do for you?

GLM 4.7 API: Chat

Use a GLM 4.7 API para executar o mais recente topo de gama da Z.ai —— o GLM mais fiável até hoje para execuções de agentes longas e de vários passos, seguimento estrito de instruções e raciocínio profundo, tudo compatível com OpenAI.

A GLM 4.7 API é o modelo topo de gama mais recente da Z.ai —— concebida para execuções de agentes longas e de múltiplos passos, cumprimento rigoroso de instruções e raciocínio profundo, com tool calling nativo, saídas estruturadas e uma janela de contexto de 200K tokens. Através da RouterBase, a GLM 4.7 API é totalmente compatível com OpenAI: aponte qualquer SDK existente para a base URL da RouterBase, defina o modelo como glm-4-7 e a sua primeira chamada à GLM 4.7 API passa de imediato.

O preço da GLM 4.7 API é $0.51 / 1M tokens de entrada, $1.87 / 1M tokens de saída e $0.0935 / 1M de leituras de entrada em cache —— 15% abaixo da tarifa oficial publicada. Uma chave RouterBase chega à GLM 4.7 API e a mais de 200 modelos —— sem conta Z.ai.

Porquê este modelo

Seis razões para usar a GLM 4.7 API

De execuções de agentes sólidas como rocha a um preço com 15% de desconto —— seis razões pelas quais as equipas padronizam na GLM-4.7.

Feita para execuções de agentes longas

A GLM 4.7 API mantém um plano ao longo de dezenas de chamadas a ferramentas sem se desviar —— a fiabilidade de longo curso que torna os agentes autónomos realmente lançáveis.

Segue as instruções à risca

Dê à GLM 4.7 API um formato, um esquema ou um guia de estilo estrito e ela cumpre-o —— menos repetições de pedido, saídas estruturadas mais limpas e menos pós-processamento do seu lado.

Tool calling nativo

A GLM 4.7 API chama funções no formato OpenAI e raramente deforma uma chamada, mesmo no fundo de uma cadeia —— por isso os agentes multiferramenta não saem dos carris.

Janela de contexto longa

A GLM 4.7 API aceita até 200K tokens de contexto —— bases de código inteiras, processos ou toda uma sessão de histórico de um agente cabem num único pedido.

Compatível com OpenAI, uma chave

A GLM 4.7 API fala o formato chat-completions da OpenAI; a mesma chave RouterBase também encaminha para GPT-5.5, Claude, Gemini e mais de 200 modelos.

15% abaixo do preço de tabela

A GLM-4.7 custa 15% menos que a tarifa publicada da Z.ai —— $0.51 / 1M entrada, $1.87 / 1M saída, $0.0935 / 1M em cache. Raciocínio de topo de gama sem preço de topo de gama.

RouterBase dashboard preview
Início rápido

Comece a usar a GLM 4.7 API em 3 passos

Do registo à primeira resposta em menos de 5 minutos.

  1. Crie uma chave RouterBase

    Crie uma conta e gere uma chave de API —— a partir de um só lugar ela chega à GLM-4.7 e a todos os outros modelos do catálogo da RouterBase.

  2. Envie a primeira mensagem

    Aponte qualquer SDK compatível com OpenAI para routerbase.com/v1 e defina o modelo como glm-4-7. O streaming, as tool calls e as saídas estruturadas seguem todos o esquema padrão chat-completions.

  3. Inspecione o uso

    Cada resposta da GLM 4.7 API devolve um detalhe completo de tokens —— entrada, saída e entrada em cache —— para que o custo e os acertos de cache fiquem visíveis em cada chamada.

Preços

Paga apenas pelo que usas

A RouterBase repassa preços de nível partner. Comparado com o preço público oficial do modelo.

Histórias de clientes

O que as equipas constroem com a GLM 4.7 API

Cargas de produção reais sobre o catálogo de mais de 200 modelos da RouterBase.

Marcus Reyes
Marcus ReyesCTO, Paradigm AI

O nosso agente de planeamento executa fluxos de 40 passos na GLM 4.7 API sem perder o fio —— essa fiabilidade de longo curso é o que antes não conseguíamos.

Priya Lakshmi
Priya LakshmiFounder, Quillo

Padronizámos na GLM 4.7 API através da RouterBase numa linha —— o JSON estrito em todas as respostas deixou-nos apagar uma camada inteira de validação de saída.

Aoi Tanaka
Aoi TanakaML Lead, Daybreak Robotics

Ao longo de cadeias de ferramentas longas a GLM 4.7 API mal deforma uma chamada —— os nossos agentes agora terminam tarefas de vários passos que antes paravam a meio.

Ethan Nguyen
Ethan NguyenHead of Engineering, Compound Studio

Fazemos A/B da GLM 4.7 API contra GPT e Claude atrás de uma única chave RouterBase —— iguala ambos nas nossas avaliações de raciocínio por uma fração do custo.

Sophia Martín
Sophia MartínCTO, Relay

O andaime longo de agentes mais o preço de entrada em cache mantém a nossa fatura estável —— a GLM 4.7 API relê o mesmo contexto barato a cada turno.

Lucas Fernandes
Lucas FernandesEngineering Manager, Light

Apontar o nosso SDK da OpenAI para a GLM 4.7 API foi uma só alteração de base URL, e as saídas estruturadas chegaram exatamente na forma que pedimos.

Perguntas frequentes

Perguntas comuns sobre a GLM 4.7 API.

A GLM 4.7 API é a ligação direta da RouterBase à GLM-4.7 da Z.ai —— o mais recente topo de gama GLM, afinado para agentes de longo curso, seguimento estrito de instruções e raciocínio profundo, servido por uma interface REST compatível com OpenAI com tool calling nativo e saídas estruturadas.