chat.glm_4_7
zai/glm-4-7

La GLM 4.7 API es el último modelo GLM insignia de Z.ai —— ajustado para agentes de largo recorrido, seguimiento estricto de instrucciones y razonamiento profundo, con una ventana de contexto de 200K tokens, tool calling nativo y salidas estructuradas. La GLM 4.7 API es compatible con OpenAI: apunta cualquier SDK a RouterBase y pon el modelo en glm-4-7. Entrada a $0.51 / 1M tokens, salida a $1.87 / 1M, entrada en caché a $0.0935 / 1M —— un 15% por debajo del oficial, todo por un endpoint REST.

Input
GLM-4.7
max_tokens4096
temperature1
top_p1
presence_penalty0
frequency_penalty0
GLM-4.7 Online
Hi! I'm a helpful AI assistant. What can I do for you?

GLM 4.7 API: Chat

Usa la GLM 4.7 API para ejecutar el último buque insignia de Z.ai —— el GLM más fiable hasta la fecha para ejecuciones de agentes largas y de varios pasos, seguimiento estricto de instrucciones y razonamiento profundo, todo compatible con OpenAI.

La GLM 4.7 API es el modelo insignia más reciente de Z.ai —— creada para ejecuciones de agentes largas y de múltiples pasos, seguimiento estricto de instrucciones y razonamiento profundo, con tool calling nativo, salidas estructuradas y una ventana de contexto de 200K tokens. A través de RouterBase, la GLM 4.7 API es totalmente compatible con OpenAI: apunta cualquier SDK existente a la base URL de RouterBase, pon el modelo en glm-4-7 y tu primera llamada a la GLM 4.7 API pasa de inmediato.

El precio de la GLM 4.7 API es $0.51 / 1M tokens de entrada, $1.87 / 1M tokens de salida y $0.0935 / 1M de lecturas de entrada en caché —— un 15% por debajo de la tarifa oficial publicada. Una clave de RouterBase llega a la GLM 4.7 API y más de 200 modelos —— sin cuenta de Z.ai.

Por qué este modelo

Seis razones para usar la GLM 4.7 API

De ejecuciones de agentes sólidas como una roca a un precio con 15% de descuento —— seis razones por las que los equipos estandarizan en GLM-4.7.

Hecha para ejecuciones de agentes largas

La GLM 4.7 API mantiene un plan a lo largo de decenas de llamadas a herramientas sin desviarse —— la fiabilidad de largo recorrido que hace que los agentes autónomos sean de verdad desplegables.

Sigue las instrucciones al pie de la letra

Dale a la GLM 4.7 API un formato, un esquema o una guía de estilo estricta y se ciñe a ello —— menos repreguntas, salidas estructuradas más limpias y menos posprocesado de tu lado.

Tool calling nativo

La GLM 4.7 API llama a funciones en formato OpenAI y rara vez deforma una llamada, incluso en lo profundo de una cadena —— así los agentes multiherramienta no se descarrilan.

Ventana de contexto larga

La GLM 4.7 API admite hasta 200K tokens de contexto —— bases de código enteras, expedientes o toda una sesión de historial de un agente caben en una sola petición.

Compatible con OpenAI, una clave

La GLM 4.7 API habla el formato chat-completions de OpenAI; la misma clave de RouterBase también enruta a GPT-5.5, Claude, Gemini y más de 200 modelos.

15% bajo el precio de lista

GLM-4.7 cuesta un 15% menos que la tarifa publicada de Z.ai —— $0.51 / 1M entrada, $1.87 / 1M salida, $0.0935 / 1M en caché. Razonamiento de buque insignia sin precio de buque insignia.

RouterBase dashboard preview
Inicio rápido

Empieza con la GLM 4.7 API en 3 pasos

Del registro a tu primera respuesta en menos de 5 minutos.

  1. Crea una clave de RouterBase

    Crea una cuenta y genera una clave de API —— desde un solo lugar llega a GLM-4.7 y a todos los demás modelos del catálogo de RouterBase.

  2. Envía tu primer mensaje

    Apunta cualquier SDK compatible con OpenAI a routerbase.com/v1 y pon el modelo en glm-4-7. El streaming, las tool calls y las salidas estructuradas siguen todos el esquema estándar de chat-completions.

  3. Revisa el uso

    Cada respuesta de la GLM 4.7 API devuelve un desglose completo de tokens —— entrada, salida y entrada en caché —— para que el coste y los aciertos de caché queden visibles en cada llamada.

Precios

Paga sólo por lo que usas

RouterBase repercute precios de nivel partner. Comparado con la tarifa pública oficial del modelo.

Historias de clientes

Lo que los equipos construyen con la GLM 4.7 API

Cargas de producción reales sobre el catálogo de más de 200 modelos de RouterBase.

Marcus Reyes
Marcus ReyesCTO, Paradigm AI

Nuestro agente de planificación ejecuta flujos de 40 pasos en la GLM 4.7 API sin perder el hilo —— esa fiabilidad de largo recorrido es lo que antes no conseguíamos.

Priya Lakshmi
Priya LakshmiFounder, Quillo

Estandarizamos en la GLM 4.7 API a través de RouterBase en una línea —— el JSON estricto en cada respuesta nos dejó borrar toda una capa de validación de salida.

Aoi Tanaka
Aoi TanakaML Lead, Daybreak Robotics

A lo largo de cadenas de herramientas largas la GLM 4.7 API apenas deforma una llamada —— nuestros agentes ahora terminan tareas de varios pasos que antes se atascaban a mitad.

Ethan Nguyen
Ethan NguyenHead of Engineering, Compound Studio

Hacemos A/B de la GLM 4.7 API contra GPT y Claude tras una sola clave de RouterBase —— iguala a ambos en nuestras evaluaciones de razonamiento por una fracción del coste.

Sophia Martín
Sophia MartínCTO, Relay

El andamiaje largo de agentes más el precio de entrada en caché mantiene plana nuestra factura —— la GLM 4.7 API relee el mismo contexto barato en cada turno.

Lucas Fernandes
Lucas FernandesEngineering Manager, Light

Apuntar nuestro SDK de OpenAI a la GLM 4.7 API fue un solo cambio de base URL, y las salidas estructuradas llegaron con la forma exacta que pedimos.

Preguntas frecuentes

Preguntas comunes sobre la GLM 4.7 API.

La GLM 4.7 API es el paso directo de RouterBase a la GLM-4.7 de Z.ai —— el último buque insignia GLM, afinado para agentes de largo recorrido, seguimiento estricto de instrucciones y razonamiento profundo, servido por una interfaz REST compatible con OpenAI con tool calling nativo y salidas estructuradas.