chat.glm_4_6
zai/glm-4-6

La GLM 4.6 API es el nuevo modelo GLM insignia de Z.ai —— un paso adelante respecto a GLM-4.5, con una ventana de contexto de 200K tokens, código más sólido en escenarios reales y flujos de agentes más eficientes en tokens, además de tool calling nativo y salidas estructuradas. La GLM 4.6 API es compatible con OpenAI: apunta cualquier SDK a RouterBase y pon el modelo en glm-4-6. Entrada a $0.51 / 1M tokens, salida a $1.87 / 1M, entrada en caché a $0.0935 / 1M —— un 15% por debajo del oficial, todo por un endpoint REST.

Input
GLM-4.6
max_tokens4096
temperature1
top_p1
presence_penalty0
frequency_penalty0
GLM-4.6 Online
Hi! I'm a helpful AI assistant. What can I do for you?

GLM 4.6 API: Chat

Usa la GLM 4.6 API para ejecutar el nuevo buque insignia de Z.ai —— un gran salto respecto a GLM-4.5, con una ventana de contexto de 200K tokens, código más sólido en escenarios reales y ejecuciones de agentes más ágiles y eficientes en tokens.

La GLM 4.6 API es el modelo insignia más nuevo de Z.ai —— un paso adelante respecto a GLM-4.5, con una ventana de contexto de 200K tokens, una codificación más sólida en escenarios reales y ejecuciones de agentes más ágiles y eficientes en tokens, además de tool calling nativo y salidas estructuradas. A través de RouterBase, la GLM 4.6 API es totalmente compatible con OpenAI: apunta cualquier SDK existente a la base URL de RouterBase, pon el modelo en glm-4-6 y tu primera llamada a la GLM 4.6 API pasa de inmediato.

El precio de la GLM 4.6 API es $0.51 / 1M tokens de entrada, $1.87 / 1M tokens de salida y $0.0935 / 1M de lecturas de entrada en caché —— un 15% por debajo de la tarifa oficial publicada. Una clave de RouterBase llega a la GLM 4.6 API y más de 200 modelos —— sin cuenta de Z.ai.

Por qué este modelo

Seis razones para usar la GLM 4.6 API

De una ventana de contexto de 200K a un precio de lanzamiento con 15% de descuento —— lo que hace que valga la pena llevar GLM-4.6 a producción.

Un salto real respecto a GLM-4.5

La GLM 4.6 API es el nuevo buque insignia de Z.ai —— mejor de forma medible en código, razonamiento y tool calling de agentes que GLM-4.5, y completa las tareas con cerca de un 15% menos de tokens.

Hecha para código

La GLM 4.6 API es un modelo de código de primer nivel —— generación multiarchivo, refactorización, depuración y un trabajo de front-end más afinado, con resultados líderes en benchmarks de código reales.

Tool calling nativo

GLM-4.6 se afinó para agentes —— el function / tool calling funciona de fábrica en formato OpenAI, con menos llamadas mal formadas que GLM-4.5 al encadenar pasos.

Ventana de contexto larga

La GLM 4.6 API admite hasta 200K tokens de contexto —— repositorios completos, documentos largos o todo el historial de un agente en una sola llamada.

Compatible con OpenAI, una clave

La GLM 4.6 API habla el formato chat-completions de OpenAI; la misma clave de RouterBase también enruta a GPT-5.5, Claude, Gemini y más de 200 modelos.

15% bajo el precio de lista

GLM-4.6 cuesta un 15% menos que la tarifa publicada de Z.ai —— $0.51 / 1M entrada, $1.87 / 1M salida, $0.0935 / 1M en caché. Pagas por los tokens que usas, nada por solicitud.

RouterBase dashboard preview
Inicio rápido

Empieza con la GLM 4.6 API en 3 pasos

Del registro a tu primera respuesta en menos de 5 minutos.

  1. Crea una clave de RouterBase

    Crea una cuenta y genera una clave —— desbloquea GLM-4.6 y todos los demás modelos del catálogo de RouterBase.

  2. Envía tu primer mensaje

    Apunta cualquier SDK compatible con OpenAI a routerbase.com/v1 y pon el modelo en glm-4-6. Las respuestas siguen el esquema estándar de chat-completions, con streaming y tool calls disponibles de fábrica.

  3. Revisa el uso

    Cada respuesta trae un desglose completo de tokens —— entrada, salida y entrada en caché —— para que sigas el coste y la tasa de aciertos de caché de la GLM 4.6 API llamada a llamada.

Precios

Paga sólo por lo que usas

RouterBase repercute precios de nivel partner. Comparado con la tarifa pública oficial del modelo.

Historias de clientes

Lo que los equipos construyen con la GLM 4.6 API

Cargas de producción reales sobre el catálogo de más de 200 modelos de RouterBase.

Marcus Reyes
Marcus ReyesCTO, Paradigm AI

Pasamos nuestros agentes de código de GLM-4.5 a la GLM 4.6 API —— diffs multiarchivo más limpios, y el menor uso de tokens se nota directo en la factura.

Priya Lakshmi
Priya LakshmiFounder, Quillo

Cambiamos a la GLM 4.6 API por RouterBase en una línea —— sin cambios de SDK, y el mayor contexto de 200K de 4.6 nos dejó eliminar nuestros viejos parches de troceado.

Aoi Tanaka
Aoi TanakaML Lead, Daybreak Robotics

El tool calling de la GLM 4.6 API es más fiable que GLM-4.5 para nuestros agentes —— menos llamadas mal formadas, y el mismo formato OpenAI.

Ethan Nguyen
Ethan NguyenHead of Engineering, Compound Studio

RouterBase nos deja hacer A/B de la GLM 4.6 API contra GPT y Claude tras una clave —— 4.6 gana nuestras evaluaciones de código por una fracción del coste.

Sophia Martín
Sophia MartínCTO, Relay

El precio de entrada en caché más el mayor contexto de 4.6 volvió a recortar nuestra factura de RAG —— los prompts de sistema largos en la GLM 4.6 API ya casi ni se notan.

Lucas Fernandes
Lucas FernandesEngineering Manager, Light

Apuntamos nuestro SDK de OpenAI a RouterBase y la GLM 4.6 API funcionó sin más —— pasar de GLM-4.5 fue cambiar una línea de modelo.

Preguntas frecuentes

Preguntas comunes sobre la GLM 4.6 API.

La GLM 4.6 API es el paso directo de RouterBase a la GLM-4.6 de Z.ai —— el nuevo buque insignia de Z.ai y una clara mejora sobre GLM-4.5, con una ventana de contexto de 200K, código y tool calling de agentes más fuertes y mejor eficiencia de tokens, servido por una interfaz REST compatible con OpenAI con tool calling nativo y salidas estructuradas.