Wir haben unsere Coding-Agenten von GLM-4.5 auf die GLM 4.6 API umgestellt —— sauberere Multi-File-Diffs, und der geringere Token-Verbrauch zeigt sich direkt auf unserer Rechnung.
Die GLM 4.6 API ist das neue Flaggschiff-GLM-Modell von Z.ai —— ein Fortschritt gegenüber GLM-4.5, mit einem 200K-Token-Kontextfenster, stärkerem Coding in der Praxis und token-effizienteren Agent-Workflows, dazu natives Tool-Calling und strukturierte Ausgaben. Die GLM 4.6 API ist OpenAI-kompatibel: Richte ein SDK auf RouterBase und setze das Modell auf glm-4-6. Eingabe $0.51 / 1M Tokens, Ausgabe $1.87 / 1M, Cached-Input $0.0935 / 1M —— 15% unter dem offiziellen Tarif, alles über einen REST-Endpoint.
GLM 4.6 API: Chat
Nutze die GLM 4.6 API für das neue Flaggschiff von Z.ai —— ein großer Schritt nach vorn gegenüber GLM-4.5, mit einem 200K-Token-Kontextfenster, stärkerem Coding in der Praxis und schlankeren, token-effizienteren Agent-Läufen.
Die GLM 4.6 API ist das neueste Flaggschiff von Z.ai —— ein Schritt nach vorn gegenüber GLM-4.5, mit einem 200K-Token-Kontextfenster, stärkerem Praxis-Coding und schlankeren, token-effizienteren Agent-Durchläufen, dazu nativem Tool-Calling und strukturierten Ausgaben. Über RouterBase ist die GLM 4.6 API vollständig OpenAI-kompatibel: Richte ein bestehendes SDK auf die Base-URL von RouterBase, setze das Modell auf glm-4-6, und dein erster GLM-4.6-API-Aufruf geht sofort durch.
Die GLM 4.6 API kostet $0.51 / 1M Eingabe-Tokens, $1.87 / 1M Ausgabe-Tokens und $0.0935 / 1M zwischengespeicherte Eingabe-Reads —— 15% unter dem offiziellen veröffentlichten Tarif. Ein RouterBase-Key erreicht die GLM 4.6 API und 200+ weitere Modelle —— kein Z.ai-Konto nötig.
Sechs Gründe für die GLM 4.6 API
Vom 200K-Kontextfenster bis zum 15%-Rabatt zum Launch —— was GLM-4.6 produktionsreif macht.
Ein echter Schritt nach vorn gegenüber GLM-4.5
Die GLM 4.6 API ist Z.ais neues Flaggschiff —— messbar besser bei Coding, Reasoning und Agent-Tool-Calling als GLM-4.5, und sie erledigt Aufgaben mit rund 15% weniger Tokens.
Für Code gebaut
Die GLM 4.6 API ist ein erstklassiges Coding-Modell —— Multi-File-Generierung, Refactoring, Debugging und schärfere Front-End-Arbeit, mit führenden Ergebnissen in praxisnahen Coding-Benchmarks.
Natives Tool-Calling
GLM-4.6 wurde für Agenten optimiert —— Function / Tool Calling läuft out of the box im OpenAI-Format, mit weniger fehlerhaften Aufrufen als GLM-4.5 beim Verketten von Schritten.
Langes Kontextfenster
Die GLM 4.6 API nimmt bis zu 200K Tokens Kontext an —— ganze Repositories, lange Dokumente oder eine komplette Agent-Historie in einem einzigen Aufruf.
OpenAI-kompatibel, ein Key
Die GLM 4.6 API spricht das OpenAI-chat-completions-Format; derselbe RouterBase-Key routet auch zu GPT-5.5, Claude, Gemini und 200+ weiteren Modellen.
15% unter dem Listenpreis
GLM-4.6 kostet 15% weniger als der veröffentlichte Z.ai-Tarif —— $0.51 / 1M Eingabe, $1.87 / 1M Ausgabe, $0.0935 / 1M Cache. Du zahlst für die genutzten Tokens, nichts pro Anfrage.

In 3 Schritten mit der GLM 4.6 API loslegen
Von der Anmeldung bis zur ersten Antwort in unter 5 Minuten.
RouterBase-API-Key erstellen
Konto anlegen und einen Key generieren —— er schaltet GLM-4.6 und jedes andere Modell im RouterBase-Katalog frei.
Erste Nachricht senden
Richte ein beliebiges OpenAI-kompatibles SDK auf routerbase.com/v1 und setze das Modell auf glm-4-6. Antworten folgen dem Standard-chat-completions-Schema, Streaming und Tool Calls sind out of the box dabei.
Nutzung prüfen
Jede Antwort trägt eine vollständige Token-Aufschlüsselung —— Eingabe, Ausgabe und zwischengespeicherte Eingabe —— so verfolgst du Kosten und Cache-Trefferquote der GLM 4.6 API Aufruf für Aufruf.
Nur für die Nutzung zahlen
RouterBase reicht Partner-Tier-Preise durch. Verglichen mit dem offiziellen API-Tarif des Modells.
Was Teams mit der GLM 4.6 API bauen
Echte Produktionslasten auf dem RouterBase-Katalog mit über 200 Modellen.
Wir sind über RouterBase mit einer Zeile auf die GLM 4.6 API gewechselt —— keine SDK-Änderungen, und der größere 200K-Kontext von 4.6 ließ uns unsere alten Chunking-Workarounds fallen lassen.
Das Tool-Calling der GLM 4.6 API ist für unsere Agenten zuverlässiger als GLM-4.5 —— weniger fehlerhafte Aufrufe, und dasselbe OpenAI-Format.
RouterBase lässt uns die GLM 4.6 API per A/B gegen GPT und Claude hinter einem Key testen —— 4.6 gewinnt unsere Coding-Evals zu einem Bruchteil der Kosten.
Die Cached-Input-Preise plus der größere Kontext von 4.6 haben unsere RAG-Rechnung erneut gesenkt —— lange System-Prompts auf der GLM 4.6 API fallen jetzt kaum noch ins Gewicht.
Wir haben unser OpenAI-SDK auf RouterBase gezeigt und die GLM 4.6 API lief sofort —— das Upgrade von GLM-4.5 war eine einzeilige Modelländerung.
Häufige Fragen
Häufige Fragen zur GLM 4.6 API.
Die GLM 4.6 API ist der Passthrough von RouterBase zu Z.ais GLM-4.6 —— Z.ais neues Flaggschiff und ein klares Upgrade gegenüber GLM-4.5, mit einem 200K-Kontextfenster, stärkerem Coding und Agent-Tool-Calling sowie besserer Token-Effizienz, bereitgestellt über eine OpenAI-kompatible REST-Schnittstelle mit nativem Tool-Calling und strukturierten Ausgaben.