chat.glm_4_6
zai/glm-4-6

Die GLM 4.6 API ist das neue Flaggschiff-GLM-Modell von Z.ai —— ein Fortschritt gegenüber GLM-4.5, mit einem 200K-Token-Kontextfenster, stärkerem Coding in der Praxis und token-effizienteren Agent-Workflows, dazu natives Tool-Calling und strukturierte Ausgaben. Die GLM 4.6 API ist OpenAI-kompatibel: Richte ein SDK auf RouterBase und setze das Modell auf glm-4-6. Eingabe $0.51 / 1M Tokens, Ausgabe $1.87 / 1M, Cached-Input $0.0935 / 1M —— 15% unter dem offiziellen Tarif, alles über einen REST-Endpoint.

Input
GLM-4.6
max_tokens4096
temperature1
top_p1
presence_penalty0
frequency_penalty0
GLM-4.6 Online
Hi! I'm a helpful AI assistant. What can I do for you?

GLM 4.6 API: Chat

Nutze die GLM 4.6 API für das neue Flaggschiff von Z.ai —— ein großer Schritt nach vorn gegenüber GLM-4.5, mit einem 200K-Token-Kontextfenster, stärkerem Coding in der Praxis und schlankeren, token-effizienteren Agent-Läufen.

Die GLM 4.6 API ist das neueste Flaggschiff von Z.ai —— ein Schritt nach vorn gegenüber GLM-4.5, mit einem 200K-Token-Kontextfenster, stärkerem Praxis-Coding und schlankeren, token-effizienteren Agent-Durchläufen, dazu nativem Tool-Calling und strukturierten Ausgaben. Über RouterBase ist die GLM 4.6 API vollständig OpenAI-kompatibel: Richte ein bestehendes SDK auf die Base-URL von RouterBase, setze das Modell auf glm-4-6, und dein erster GLM-4.6-API-Aufruf geht sofort durch.

Die GLM 4.6 API kostet $0.51 / 1M Eingabe-Tokens, $1.87 / 1M Ausgabe-Tokens und $0.0935 / 1M zwischengespeicherte Eingabe-Reads —— 15% unter dem offiziellen veröffentlichten Tarif. Ein RouterBase-Key erreicht die GLM 4.6 API und 200+ weitere Modelle —— kein Z.ai-Konto nötig.

Warum dieses Modell

Sechs Gründe für die GLM 4.6 API

Vom 200K-Kontextfenster bis zum 15%-Rabatt zum Launch —— was GLM-4.6 produktionsreif macht.

Ein echter Schritt nach vorn gegenüber GLM-4.5

Die GLM 4.6 API ist Z.ais neues Flaggschiff —— messbar besser bei Coding, Reasoning und Agent-Tool-Calling als GLM-4.5, und sie erledigt Aufgaben mit rund 15% weniger Tokens.

Für Code gebaut

Die GLM 4.6 API ist ein erstklassiges Coding-Modell —— Multi-File-Generierung, Refactoring, Debugging und schärfere Front-End-Arbeit, mit führenden Ergebnissen in praxisnahen Coding-Benchmarks.

Natives Tool-Calling

GLM-4.6 wurde für Agenten optimiert —— Function / Tool Calling läuft out of the box im OpenAI-Format, mit weniger fehlerhaften Aufrufen als GLM-4.5 beim Verketten von Schritten.

Langes Kontextfenster

Die GLM 4.6 API nimmt bis zu 200K Tokens Kontext an —— ganze Repositories, lange Dokumente oder eine komplette Agent-Historie in einem einzigen Aufruf.

OpenAI-kompatibel, ein Key

Die GLM 4.6 API spricht das OpenAI-chat-completions-Format; derselbe RouterBase-Key routet auch zu GPT-5.5, Claude, Gemini und 200+ weiteren Modellen.

15% unter dem Listenpreis

GLM-4.6 kostet 15% weniger als der veröffentlichte Z.ai-Tarif —— $0.51 / 1M Eingabe, $1.87 / 1M Ausgabe, $0.0935 / 1M Cache. Du zahlst für die genutzten Tokens, nichts pro Anfrage.

RouterBase dashboard preview
Schnellstart

In 3 Schritten mit der GLM 4.6 API loslegen

Von der Anmeldung bis zur ersten Antwort in unter 5 Minuten.

  1. RouterBase-API-Key erstellen

    Konto anlegen und einen Key generieren —— er schaltet GLM-4.6 und jedes andere Modell im RouterBase-Katalog frei.

  2. Erste Nachricht senden

    Richte ein beliebiges OpenAI-kompatibles SDK auf routerbase.com/v1 und setze das Modell auf glm-4-6. Antworten folgen dem Standard-chat-completions-Schema, Streaming und Tool Calls sind out of the box dabei.

  3. Nutzung prüfen

    Jede Antwort trägt eine vollständige Token-Aufschlüsselung —— Eingabe, Ausgabe und zwischengespeicherte Eingabe —— so verfolgst du Kosten und Cache-Trefferquote der GLM 4.6 API Aufruf für Aufruf.

Preise

Nur für die Nutzung zahlen

RouterBase reicht Partner-Tier-Preise durch. Verglichen mit dem offiziellen API-Tarif des Modells.

Kundenstimmen

Was Teams mit der GLM 4.6 API bauen

Echte Produktionslasten auf dem RouterBase-Katalog mit über 200 Modellen.

Marcus Reyes
Marcus ReyesCTO, Paradigm AI

Wir haben unsere Coding-Agenten von GLM-4.5 auf die GLM 4.6 API umgestellt —— sauberere Multi-File-Diffs, und der geringere Token-Verbrauch zeigt sich direkt auf unserer Rechnung.

Priya Lakshmi
Priya LakshmiFounder, Quillo

Wir sind über RouterBase mit einer Zeile auf die GLM 4.6 API gewechselt —— keine SDK-Änderungen, und der größere 200K-Kontext von 4.6 ließ uns unsere alten Chunking-Workarounds fallen lassen.

Aoi Tanaka
Aoi TanakaML Lead, Daybreak Robotics

Das Tool-Calling der GLM 4.6 API ist für unsere Agenten zuverlässiger als GLM-4.5 —— weniger fehlerhafte Aufrufe, und dasselbe OpenAI-Format.

Ethan Nguyen
Ethan NguyenHead of Engineering, Compound Studio

RouterBase lässt uns die GLM 4.6 API per A/B gegen GPT und Claude hinter einem Key testen —— 4.6 gewinnt unsere Coding-Evals zu einem Bruchteil der Kosten.

Sophia Martín
Sophia MartínCTO, Relay

Die Cached-Input-Preise plus der größere Kontext von 4.6 haben unsere RAG-Rechnung erneut gesenkt —— lange System-Prompts auf der GLM 4.6 API fallen jetzt kaum noch ins Gewicht.

Lucas Fernandes
Lucas FernandesEngineering Manager, Light

Wir haben unser OpenAI-SDK auf RouterBase gezeigt und die GLM 4.6 API lief sofort —— das Upgrade von GLM-4.5 war eine einzeilige Modelländerung.

Häufige Fragen

Häufige Fragen zur GLM 4.6 API.

Die GLM 4.6 API ist der Passthrough von RouterBase zu Z.ais GLM-4.6 —— Z.ais neues Flaggschiff und ein klares Upgrade gegenüber GLM-4.5, mit einem 200K-Kontextfenster, stärkerem Coding und Agent-Tool-Calling sowie besserer Token-Effizienz, bereitgestellt über eine OpenAI-kompatible REST-Schnittstelle mit nativem Tool-Calling und strukturierten Ausgaben.