Pasamos nuestros agentes de código de GLM-4.5 a la GLM 4.6 API —— diffs multiarchivo más limpios, y el menor uso de tokens se nota directo en la factura.
La GLM 4.6 API es el nuevo modelo GLM insignia de Z.ai —— un paso adelante respecto a GLM-4.5, con una ventana de contexto de 200K tokens, código más sólido en escenarios reales y flujos de agentes más eficientes en tokens, además de tool calling nativo y salidas estructuradas. La GLM 4.6 API es compatible con OpenAI: apunta cualquier SDK a RouterBase y pon el modelo en glm-4-6. Entrada a $0.51 / 1M tokens, salida a $1.87 / 1M, entrada en caché a $0.0935 / 1M —— un 15% por debajo del oficial, todo por un endpoint REST.
GLM 4.6 API: Chat
Usa la GLM 4.6 API para ejecutar el nuevo buque insignia de Z.ai —— un gran salto respecto a GLM-4.5, con una ventana de contexto de 200K tokens, código más sólido en escenarios reales y ejecuciones de agentes más ágiles y eficientes en tokens.
La GLM 4.6 API es el modelo insignia más nuevo de Z.ai —— un paso adelante respecto a GLM-4.5, con una ventana de contexto de 200K tokens, una codificación más sólida en escenarios reales y ejecuciones de agentes más ágiles y eficientes en tokens, además de tool calling nativo y salidas estructuradas. A través de RouterBase, la GLM 4.6 API es totalmente compatible con OpenAI: apunta cualquier SDK existente a la base URL de RouterBase, pon el modelo en glm-4-6 y tu primera llamada a la GLM 4.6 API pasa de inmediato.
El precio de la GLM 4.6 API es $0.51 / 1M tokens de entrada, $1.87 / 1M tokens de salida y $0.0935 / 1M de lecturas de entrada en caché —— un 15% por debajo de la tarifa oficial publicada. Una clave de RouterBase llega a la GLM 4.6 API y más de 200 modelos —— sin cuenta de Z.ai.
Seis razones para usar la GLM 4.6 API
De una ventana de contexto de 200K a un precio de lanzamiento con 15% de descuento —— lo que hace que valga la pena llevar GLM-4.6 a producción.
Un salto real respecto a GLM-4.5
La GLM 4.6 API es el nuevo buque insignia de Z.ai —— mejor de forma medible en código, razonamiento y tool calling de agentes que GLM-4.5, y completa las tareas con cerca de un 15% menos de tokens.
Hecha para código
La GLM 4.6 API es un modelo de código de primer nivel —— generación multiarchivo, refactorización, depuración y un trabajo de front-end más afinado, con resultados líderes en benchmarks de código reales.
Tool calling nativo
GLM-4.6 se afinó para agentes —— el function / tool calling funciona de fábrica en formato OpenAI, con menos llamadas mal formadas que GLM-4.5 al encadenar pasos.
Ventana de contexto larga
La GLM 4.6 API admite hasta 200K tokens de contexto —— repositorios completos, documentos largos o todo el historial de un agente en una sola llamada.
Compatible con OpenAI, una clave
La GLM 4.6 API habla el formato chat-completions de OpenAI; la misma clave de RouterBase también enruta a GPT-5.5, Claude, Gemini y más de 200 modelos.
15% bajo el precio de lista
GLM-4.6 cuesta un 15% menos que la tarifa publicada de Z.ai —— $0.51 / 1M entrada, $1.87 / 1M salida, $0.0935 / 1M en caché. Pagas por los tokens que usas, nada por solicitud.

Empieza con la GLM 4.6 API en 3 pasos
Del registro a tu primera respuesta en menos de 5 minutos.
Crea una clave de RouterBase
Crea una cuenta y genera una clave —— desbloquea GLM-4.6 y todos los demás modelos del catálogo de RouterBase.
Envía tu primer mensaje
Apunta cualquier SDK compatible con OpenAI a routerbase.com/v1 y pon el modelo en glm-4-6. Las respuestas siguen el esquema estándar de chat-completions, con streaming y tool calls disponibles de fábrica.
Revisa el uso
Cada respuesta trae un desglose completo de tokens —— entrada, salida y entrada en caché —— para que sigas el coste y la tasa de aciertos de caché de la GLM 4.6 API llamada a llamada.
Paga sólo por lo que usas
RouterBase repercute precios de nivel partner. Comparado con la tarifa pública oficial del modelo.
Lo que los equipos construyen con la GLM 4.6 API
Cargas de producción reales sobre el catálogo de más de 200 modelos de RouterBase.
Cambiamos a la GLM 4.6 API por RouterBase en una línea —— sin cambios de SDK, y el mayor contexto de 200K de 4.6 nos dejó eliminar nuestros viejos parches de troceado.
El tool calling de la GLM 4.6 API es más fiable que GLM-4.5 para nuestros agentes —— menos llamadas mal formadas, y el mismo formato OpenAI.
RouterBase nos deja hacer A/B de la GLM 4.6 API contra GPT y Claude tras una clave —— 4.6 gana nuestras evaluaciones de código por una fracción del coste.
El precio de entrada en caché más el mayor contexto de 4.6 volvió a recortar nuestra factura de RAG —— los prompts de sistema largos en la GLM 4.6 API ya casi ni se notan.
Apuntamos nuestro SDK de OpenAI a RouterBase y la GLM 4.6 API funcionó sin más —— pasar de GLM-4.5 fue cambiar una línea de modelo.
Preguntas frecuentes
Preguntas comunes sobre la GLM 4.6 API.
La GLM 4.6 API es el paso directo de RouterBase a la GLM-4.6 de Z.ai —— el nuevo buque insignia de Z.ai y una clara mejora sobre GLM-4.5, con una ventana de contexto de 200K, código y tool calling de agentes más fuertes y mejor eficiencia de tokens, servido por una interfaz REST compatible con OpenAI con tool calling nativo y salidas estructuradas.