Nous ne routons que nos tâches de raisonnement les plus difficiles vers la GLM 5 API et des modèles moins chers pour le reste —— elle résout des problèmes que les autres n'arrêtaient pas de rater.
La GLM 5 API est le modèle GLM phare de nouvelle génération de Z.ai —— le plus performant de la famille, un bond générationnel par rapport à la gamme 4.x sur le raisonnement difficile, le codage complexe et le travail agentique exigeant, avec une fenêtre de contexte de 200K tokens, le tool calling natif et les sorties structurées. La GLM 5 API est compatible OpenAI : pointez un SDK vers RouterBase et réglez le modèle sur glm-5. Entrée 0,90 $ / 1M tokens, sortie 2,88 $ / 1M, entrée en cache 0,18 $ / 1M —— 10% sous le tarif officiel, le tout par un endpoint REST.
GLM 5 API : Chat
Utilisez la GLM 5 API pour atteindre le modèle phare nouvelle génération de Z.ai —— GLM-5 est le modèle le plus performant de la famille, un bond net par rapport à la gamme 4.x sur le raisonnement difficile, le codage complexe et le travail agentique exigeant.
La GLM 5 API est le modèle phare de nouvelle génération de Z.ai —— le modèle le plus performant de la famille GLM, un bond générationnel par rapport à la gamme 4.x sur le raisonnement difficile, le code complexe et le travail d'agents exigeant, avec tool calling natif, sorties structurées et une fenêtre de contexte de 200K tokens. Via RouterBase, la GLM 5 API est entièrement compatible OpenAI : pointez n'importe quel SDK existant vers la base URL de RouterBase, réglez le modèle sur glm-5, et votre premier appel à la GLM 5 API passe immédiatement.
Le tarif de la GLM 5 API est de 0,90 $ / 1M tokens en entrée, 2,88 $ / 1M tokens en sortie et 0,18 $ / 1M de lectures d'entrée en cache —— 10% sous le tarif officiel publié. Une clé RouterBase atteint la GLM 5 API et plus de 200 modèles —— sans compte Z.ai.
Six raisons de choisir la GLM 5 API
Du raisonnement de pointe à un tarif à -10% —— six raisons pour lesquelles les équipes se tournent vers GLM-5 sur les problèmes difficiles.
Le GLM le plus performant à ce jour
GLM-5 est un pas générationnel par rapport à la gamme 4.x —— un raisonnement plus profond, une résolution de problèmes multi-étapes plus solide et un meilleur jugement sur les tâches ambiguës et ouvertes.
Raisonnement de pointe
Confiez à la GLM 5 API un problème difficile de maths, d'analyse ou de planification et elle le traite avec méthode, étape par étape —— la profondeur que seul un modèle de premier plan offre.
Tool calling natif
GLM-5 planifie et appelle les outils au format OpenAI avec un bon discernement sur le moment d'agir —— bien adaptée aux agents autonomes qui s'attaquent à des objectifs complexes et multi-étapes.
Longue fenêtre de contexte
La GLM 5 API accepte jusqu'à 200K tokens de contexte —— des bases de code entières, des dossiers de recherche ou de longs historiques de dossiers restent visibles en une seule passe de raisonnement.
Compatible OpenAI, une clé
La GLM 5 API utilise le format chat-completions d'OpenAI, si bien qu'une clé RouterBase place GLM-5 aux côtés de GPT-5.5, Claude, Gemini et plus de 200 modèles.
10% sous le prix catalogue
GLM-5 coûte 10% de moins que le tarif publié de Z.ai —— 0,90 $ / 1M entrée, 2,88 $ / 1M sortie, 0,18 $ / 1M en cache. Une capacité de pointe à un tarif routé, facturé au token.

Démarrez avec la GLM 5 API en 3 étapes
De l'inscription à votre première réponse en moins de 5 minutes.
Créez une clé RouterBase
Créez un compte et générez une clé d'API —— depuis un seul endroit, elle atteint GLM-5 et tous les autres modèles du catalogue RouterBase.
Envoyez votre premier message
Pointez n'importe quel SDK compatible OpenAI vers routerbase.com/v1 et réglez le modèle sur glm-5. Le streaming, les tool calls et les sorties structurées suivent tous le schéma standard chat-completions.
Inspectez l'usage
Chaque réponse de la GLM 5 API renvoie un détail complet des tokens —— entrée, sortie et entrée en cache —— pour que le coût et les hits de cache restent visibles à chaque appel.
Ne payez que ce que vous utilisez
RouterBase répercute les prix partenaires. Comparé au tarif public officiel du modèle.
Ce que les équipes construisent avec la GLM 5 API
Des charges de production réelles sur le catalogue de plus de 200 modèles de RouterBase.
GLM-5 est devenue notre choix par défaut pour l'analyse complexe via RouterBase —— une ligne de configuration, et le bond de qualité sur les questions ouvertes était évident.
Pour la planification multi-étapes, nos agents s'appuient sur la GLM 5 API —— elle raisonne sur l'objectif entier plutôt que sur la seule étape suivante.
Nous faisons de l'A/B entre la GLM 5 API et des modèles de pointe derrière une seule clé RouterBase —— elle tient sur nos évaluations les plus dures pour un coût nettement inférieur.
La GLM 5 API gère les cas limites épineux que notre pipeline escaladait autrefois vers un humain —— moins de fallbacks et des sorties plus propres.
Basculer nos prompts les plus difficiles vers la GLM 5 API n'a demandé qu'un seul changement de base URL, et les réponses sont revenues plus nettes et mieux structurées.
Questions fréquentes
Questions courantes sur la GLM 5 API.
La GLM 5 API est le passthrough de RouterBase vers la GLM-5 de Z.ai —— le modèle le plus récent et le plus performant de la famille GLM, un pas générationnel par rapport à la gamme 4.x pour le raisonnement difficile, le codage complexe et les agents exigeants, servi via une interface REST compatible OpenAI avec tool calling natif et sorties structurées.