chat.glm_4_6
zai/glm-4-6

La GLM 4.6 API est le nouveau modèle GLM phare de Z.ai —— une évolution par rapport à GLM-4.5, avec une fenêtre de contexte de 200K tokens, un code plus solide en conditions réelles et des workflows d'agents plus efficaces en tokens, plus le tool calling natif et les sorties structurées. La GLM 4.6 API est compatible OpenAI : pointez un SDK vers RouterBase et réglez le modèle sur glm-4-6. Entrée 0,51 $ / 1M tokens, sortie 1,87 $ / 1M, entrée en cache 0,0935 $ / 1M —— 15% sous le tarif officiel, le tout par un endpoint REST.

Input
GLM-4.6
max_tokens4096
temperature1
top_p1
presence_penalty0
frequency_penalty0
GLM-4.6 Online
Hi! I'm a helpful AI assistant. What can I do for you?

GLM 4.6 API : Chat

Utilisez la GLM 4.6 API pour exécuter le nouveau modèle phare de Z.ai —— une nette avancée par rapport à GLM-4.5, avec une fenêtre de contexte de 200K tokens, un code plus solide en conditions réelles et des exécutions d'agents plus légères et plus efficaces en tokens.

La GLM 4.6 API est le tout dernier modèle phare de Z.ai —— un cran au-dessus de GLM-4.5, avec une fenêtre de contexte de 200K tokens, un codage plus solide en conditions réelles et des exécutions d'agents plus légères et plus économes en tokens, en plus du tool calling natif et des sorties structurées. Via RouterBase, la GLM 4.6 API est entièrement compatible OpenAI : pointez n'importe quel SDK existant vers la base URL de RouterBase, réglez le modèle sur glm-4-6, et votre premier appel à la GLM 4.6 API passe immédiatement.

Le tarif de la GLM 4.6 API est de 0,51 $ / 1M tokens en entrée, 1,87 $ / 1M tokens en sortie et 0,0935 $ / 1M de lectures d'entrée en cache —— 15% sous le tarif officiel publié. Une clé RouterBase atteint la GLM 4.6 API et plus de 200 modèles —— sans compte Z.ai.

Pourquoi ce modèle

Six raisons de choisir la GLM 4.6 API

D'une fenêtre de contexte de 200K à un tarif de lancement à -15% —— ce qui rend GLM-4.6 digne d'être mis en production.

Une vraie avancée par rapport à GLM-4.5

La GLM 4.6 API est le nouveau modèle phare de Z.ai —— mesurablement meilleure que GLM-4.5 en code, en raisonnement et en tool calling d'agents, et elle termine les tâches avec environ 15% de tokens en moins.

Conçue pour le code

La GLM 4.6 API est un modèle de code de premier plan —— génération multi-fichiers, refactoring, débogage et un travail front-end plus précis, avec des résultats de pointe sur les benchmarks de code réels.

Tool calling natif

GLM-4.6 a été affinée pour les agents —— le function / tool calling fonctionne d'emblée au format OpenAI, avec moins d'appels malformés que GLM-4.5 lors de l'enchaînement d'étapes.

Longue fenêtre de contexte

La GLM 4.6 API accepte jusqu'à 200K tokens de contexte —— des dépôts entiers, de longs documents ou tout l'historique d'un agent en un seul appel.

Compatible OpenAI, une clé

La GLM 4.6 API parle le format chat-completions d'OpenAI ; la même clé RouterBase route aussi vers GPT-5.5, Claude, Gemini et plus de 200 modèles.

15% sous le prix catalogue

GLM-4.6 coûte 15% de moins que le tarif publié de Z.ai —— 0,51 $ / 1M entrée, 1,87 $ / 1M sortie, 0,0935 $ / 1M en cache. Vous payez les tokens que vous utilisez, rien par requête.

RouterBase dashboard preview
Démarrage rapide

Démarrez avec la GLM 4.6 API en 3 étapes

De l'inscription à votre première réponse en moins de 5 minutes.

  1. Créez une clé RouterBase

    Créez un compte et générez une clé —— elle débloque GLM-4.6 ainsi que tous les autres modèles du catalogue RouterBase.

  2. Envoyez votre premier message

    Pointez n'importe quel SDK compatible OpenAI vers routerbase.com/v1 et réglez le modèle sur glm-4-6. Les réponses suivent le schéma standard chat-completions, avec le streaming et les tool calls pris en charge d'emblée.

  3. Inspectez l'usage

    Chaque réponse porte un détail complet des tokens —— entrée, sortie et entrée en cache —— pour suivre le coût et le taux de cache de la GLM 4.6 API appel après appel.

Tarifs

Ne payez que ce que vous utilisez

RouterBase répercute les prix partenaires. Comparé au tarif public officiel du modèle.

Témoignages clients

Ce que les équipes construisent avec la GLM 4.6 API

Des charges de production réelles sur le catalogue de plus de 200 modèles de RouterBase.

Marcus Reyes
Marcus ReyesCTO, Paradigm AI

Nous avons fait passer nos agents de code de GLM-4.5 à la GLM 4.6 API —— des diffs multi-fichiers plus propres, et la baisse de la consommation de tokens se voit directement sur notre facture.

Priya Lakshmi
Priya LakshmiFounder, Quillo

Nous sommes passés à la GLM 4.6 API via RouterBase en une ligne —— aucun changement de SDK, et le plus grand contexte de 200K de 4.6 nous a permis d'abandonner nos anciens contournements de découpage.

Aoi Tanaka
Aoi TanakaML Lead, Daybreak Robotics

Le tool calling de la GLM 4.6 API est plus fiable que GLM-4.5 pour nos agents —— moins d'appels malformés, et toujours le même format OpenAI.

Ethan Nguyen
Ethan NguyenHead of Engineering, Compound Studio

RouterBase nous laisse faire de l'A/B entre la GLM 4.6 API, GPT et Claude derrière une seule clé —— 4.6 remporte nos évaluations de code pour une fraction du coût.

Sophia Martín
Sophia MartínCTO, Relay

La tarification d'entrée en cache plus le plus grand contexte de 4.6 ont encore réduit notre facture RAG —— les longs prompts système sur la GLM 4.6 API se remarquent à peine désormais.

Lucas Fernandes
Lucas FernandesEngineering Manager, Light

Nous avons pointé notre SDK OpenAI vers RouterBase et la GLM 4.6 API a tout simplement fonctionné —— passer de GLM-4.5 n'a été qu'un changement de modèle d'une ligne.

Questions fréquentes

Questions courantes sur la GLM 4.6 API.

La GLM 4.6 API est le passthrough de RouterBase vers la GLM-4.6 de Z.ai —— le nouveau modèle phare de Z.ai et une nette évolution par rapport à GLM-4.5, avec une fenêtre de contexte de 200K, un code et un tool calling d'agents plus solides et une meilleure efficacité en tokens, servi via une interface REST compatible OpenAI avec tool calling natif et sorties structurées.