chat.glm_4_6v
zai/glm-4-6v

Die GLM 4.6V API ist das Vision-Language-Modell der 4.6-Generation von Z.ai —— sie nimmt Bilder, Videoframes und Dokumente neben Text entgegen, für OCR, Diagramm- und Tabellenextraktion sowie visuelles Reasoning, mit nativem Tool-Calling und strukturierten Ausgaben. Die GLM 4.6V API ist OpenAI-kompatibel: Richte ein SDK auf RouterBase und setze das Modell auf glm-4-6v. Eingabe $0.255 / 1M Tokens, Ausgabe $0.765 / 1M, Cached-Input $0.0425 / 1M —— 15% unter dem offiziellen Tarif, alles über einen REST-Endpoint.

Input
GLM-4.6V
max_tokens4096
temperature1
top_p1
presence_penalty0
frequency_penalty0
GLM-4.6V Online
Hi! I'm a helpful AI assistant. What can I do for you?

GLM 4.6V API: Chat

Nutze die GLM 4.6V API, um deiner App Augen zu geben —— das Vision-Language-Modell der 4.6-Generation von Z.ai liest Bilder, Videoframes, Screenshots und Dokumente und antwortet in Text oder mit Tool-Calls.

Die GLM 4.6V API ist das Vision-Language-Modell (multimodal) der 4.6-Generation von Z.ai —— sie nimmt Bilder, Videoframes und Dokumente neben Text entgegen, für OCR, Diagramm- und Tabellenextraktion sowie visuelles Reasoning, mit nativem Tool-Calling und strukturierten Ausgaben. Über RouterBase ist die GLM 4.6V API vollständig OpenAI-kompatibel: Richte ein bestehendes SDK auf die Base-URL von RouterBase, setze das Modell auf glm-4-6v, und dein erster GLM-4.6V-API-Aufruf geht sofort durch.

Die GLM 4.6V API kostet $0.255 / 1M Eingabe-Tokens, $0.765 / 1M Ausgabe-Tokens und $0.0425 / 1M zwischengespeicherte Eingabe-Reads —— 15% unter dem offiziellen veröffentlichten Tarif. Ein RouterBase-Key erreicht die GLM 4.6V API und 200+ weitere Modelle —— kein Z.ai-Konto nötig.

Warum dieses Modell

Sechs Gründe für die GLM 4.6V API

Von framegenauer Bilderkennung bis zum 15%-Rabatt —— warum Teams GLM-4.6V hinter ihre multimodalen Funktionen stellen.

Sieht Bilder, Video & Dokumente

Die GLM 4.6V API nimmt Bilder, mehrseitige Dokumente und Videoframes neben Text entgegen —— und erledigt OCR, Diagramm- und Tabellenextraktion sowie visuelles Reasoning in einem multimodalen Aufruf.

Dokumente, Diagramme & OCR

Richte die GLM 4.6V API auf einen Screenshot, ein gescanntes PDF, eine Rechnung oder ein Dashboard, und sie zieht Text, Tabellen und Struktur heraus —— keine separate OCR-Pipeline zum Betreiben.

Natives Tool-Calling

Die GLM 4.6V API ruft Funktionen im OpenAI-Tool-Format direkt aus dem auf, was sie sieht —— lass sie ein Formular lesen und dann deine Tools in einer multimodalen Agent-Schleife auslösen.

Langes Kontextfenster

Packe lange Multi-Image-Dokumente, den vollständigen Chatverlauf und verschachtelte Bild-und-Text-Turns in eine einzige GLM-4.6V-API-Anfrage.

OpenAI-kompatibel, ein Key

Die GLM 4.6V API spricht das OpenAI-chat-completions-Format, Bilder inklusive; derselbe RouterBase-Key routet auch zu GPT-5.5, Claude, Gemini und 200+ weiteren Modellen.

15% unter dem offiziellen Tarif

Die GLM 4.6V API kostet 15% weniger als der veröffentlichte Z.ai-Tarif —— $0.255 / 1M Eingabe, $0.765 / 1M Ausgabe, $0.0425 / 1M Cached. Bildeingabe wird als Tokens abgerechnet, multimodal bleibt also günstig.

RouterBase dashboard preview
Schnellstart

In 3 Schritten mit der GLM 4.6V API loslegen

Von der Anmeldung bis zur ersten Antwort in unter 5 Minuten.

  1. RouterBase-API-Key erstellen

    Erstelle ein Konto und generiere einen Key —— er schaltet GLM-4.6V plus jedes andere Modell im RouterBase-Katalog frei.

  2. Erste Nachricht senden

    Richte ein OpenAI-kompatibles SDK auf routerbase.com/v1, setze das Modell auf glm-4-6v und sende Nachrichten mit image_url-Teilen neben dem Text. Die Antworten folgen dem Standard-chat-completions-Schema, Streaming inklusive.

  3. Nutzung prüfen

    Jede Antwort trägt eine vollständige Token-Aufschlüsselung —— Text- und Bildeingabe, Ausgabe und Cached-Input —— so behältst du die multimodalen Kosten der GLM 4.6V API Aufruf für Aufruf im Blick.

Preise

Nur für die Nutzung zahlen

RouterBase reicht Partner-Tier-Preise durch. Verglichen mit dem offiziellen API-Tarif des Modells.

Kundenstimmen

Was Teams mit der GLM 4.6V API bauen

Echte Produktionslasten auf dem RouterBase-Katalog mit über 200 Modellen.

Marcus Reyes
Marcus ReyesCTO, Paradigm AI

Unsere Support-Agenten schicken GLM-4.6V einen Screenshot von dem, was der Nutzer sieht, und es zeigt das defekte Element punktgenau —— weit günstiger als das Vision-Modell, das wir vorher liefen.

Priya Lakshmi
Priya LakshmiFounder, Quillo

Wir haben Beleg- und Rechnungsscan an einem Wochenende ausgeliefert —— ein Base-URL-Wechsel zur GLM 4.6V API und das Bild-Parsing lief einfach, ohne OCR-Anbieter.

Aoi Tanaka
Aoi TanakaML Lead, Daybreak Robotics

Unsere Roboter streamen Kameraframes an GLM-4.6V und es liefert fundierte Aktionen über Standard-Tool-Calls zurück —— das OpenAI-Format bedeutete null Adapter-Arbeit.

Ethan Nguyen
Ethan NguyenHead of Engineering, Compound Studio

Wir haben GLM-4.6V hinter einem RouterBase-Key gegen größere Vision-Modelle gebenchmarkt —— beim Lesen von Diagrammen und Tabellen hielt es zu einem Bruchteil des Preises mit.

Sophia Martín
Sophia MartínCTO, Relay

Unser RAG indiziert gescannte Verträge jetzt als Seitenbilder —— GLM-4.6V liest sie direkt, und der Cached-Input-Tarif hält lange Referenzdokumente günstig.

Lucas Fernandes
Lucas FernandesEngineering Manager, Light

Bilder und Text in einer Nachricht zu verschachteln, funktioniert mit der GLM 4.6V API einfach —— wir schicken ein Diagramm plus eine Frage und bekommen eine fundierte Antwort zurück.

Häufige Fragen

Häufige Fragen zur GLM 4.6V API.

Die GLM 4.6V API ist der Passthrough von RouterBase zu Z.ais GLM-4.6V —— ein Vision-Language-Modell der 4.6-Generation, das Bilder, Videoframes und Dokumente als Eingabe entgegennimmt, bereitgestellt über eine OpenAI-kompatible REST-Schnittstelle mit nativem Tool-Calling und strukturierten Ausgaben.