chat.glm_4_6v
zai/glm-4-6v

La GLM 4.6V API est le modèle de vision-langage de 4.6e génération de Z.ai —— elle prend images, trames vidéo et documents en plus du texte pour l'OCR, l'extraction de graphiques et de tableaux et le raisonnement visuel, avec tool calling natif et sorties structurées. La GLM 4.6V API est compatible OpenAI : pointez un SDK vers RouterBase et réglez le modèle sur glm-4-6v. Entrée 0,255 $ / 1M tokens, sortie 0,765 $ / 1M, entrée en cache 0,0425 $ / 1M —— 15% sous le tarif officiel, le tout par un endpoint REST.

Input
GLM-4.6V
max_tokens4096
temperature1
top_p1
presence_penalty0
frequency_penalty0
GLM-4.6V Online
Hi! I'm a helpful AI assistant. What can I do for you?

GLM 4.6V API : Chat

Utilisez la GLM 4.6V API pour donner des yeux à votre app —— le modèle de vision-langage de 4.6e génération de Z.ai lit images, trames vidéo, captures d'écran et documents, puis répond en texte ou par des appels d'outils.

La GLM 4.6V API est le modèle de vision-langage (multimodal) de 4.6e génération de Z.ai —— elle prend images, trames vidéo et documents en plus du texte pour l'OCR, l'extraction de graphiques et de tableaux et le raisonnement visuel, avec tool calling natif et sorties structurées. Via RouterBase, la GLM 4.6V API est entièrement compatible OpenAI : pointez n'importe quel SDK existant vers la base URL de RouterBase, réglez le modèle sur glm-4-6v, et votre premier appel à la GLM 4.6V API passe immédiatement.

Le tarif de la GLM 4.6V API est de 0,255 $ / 1M tokens en entrée, 0,765 $ / 1M tokens en sortie et 0,0425 $ / 1M de lectures d'entrée en cache —— 15% sous le tarif officiel publié. Une clé RouterBase atteint la GLM 4.6V API et plus de 200 modèles —— sans compte Z.ai.

Pourquoi ce modèle

Six raisons de choisir la GLM 4.6V API

De la lecture d'images précise à la trame près au tarif à -15% —— pourquoi les équipes placent GLM-4.6V derrière leurs fonctionnalités multimodales.

Voit images, vidéo et documents

La GLM 4.6V API prend images, documents multi-pages et trames vidéo en plus du texte —— gérant l'OCR, l'extraction de graphiques et de tableaux et le raisonnement visuel en un seul appel multimodal.

Documents, graphiques et OCR

Pointez la GLM 4.6V API sur une capture d'écran, un PDF scanné, une facture ou un tableau de bord, et elle en extrait texte, tableaux et structure —— sans pipeline d'OCR séparé à faire tourner.

Tool calling natif

La GLM 4.6V API appelle des fonctions au format outils d'OpenAI directement à partir de ce qu'elle voit —— laissez-la lire un formulaire, puis déclencher vos outils dans une même boucle d'agent multimodale.

Longue fenêtre de contexte

Faites tenir de longs documents multi-images, tout l'historique de chat et des tours alternant image et texte dans une seule requête à la GLM 4.6V API.

Compatible OpenAI, une clé

La GLM 4.6V API parle le format chat-completions d'OpenAI, images comprises ; la même clé RouterBase route aussi vers GPT-5.5, Claude, Gemini et plus de 200 modèles.

15% sous le tarif officiel

La GLM 4.6V API coûte 15% de moins que le tarif publié de Z.ai —— 0,255 $ / 1M entrée, 0,765 $ / 1M sortie, 0,0425 $ / 1M en cache. Les images en entrée sont facturées comme des tokens, le multimodal reste donc bon marché.

RouterBase dashboard preview
Démarrage rapide

Démarrez avec la GLM 4.6V API en 3 étapes

De l'inscription à votre première réponse en moins de 5 minutes.

  1. Créez une clé RouterBase

    Créez un compte et générez une clé —— elle débloque GLM-4.6V et tous les autres modèles du catalogue RouterBase.

  2. Envoyez votre premier message

    Pointez un SDK compatible OpenAI vers routerbase.com/v1, réglez le modèle sur glm-4-6v et envoyez des messages avec des parties image_url à côté du texte. Les réponses suivent le schéma standard chat-completions, streaming compris.

  3. Inspectez l'usage

    Chaque réponse porte un détail complet des tokens —— entrée texte et image, sortie et entrée en cache —— pour suivre le coût multimodal de la GLM 4.6V API appel après appel.

Tarifs

Ne payez que ce que vous utilisez

RouterBase répercute les prix partenaires. Comparé au tarif public officiel du modèle.

Témoignages clients

Ce que les équipes construisent avec la GLM 4.6V API

Des charges de production réelles sur le catalogue de plus de 200 modèles de RouterBase.

Marcus Reyes
Marcus ReyesCTO, Paradigm AI

Nos agents de support envoient à GLM-4.6V une capture de ce que voit l'utilisateur et il repère l'élément cassé —— bien moins cher que le modèle de vision qu'on utilisait avant.

Priya Lakshmi
Priya LakshmiFounder, Quillo

Nous avons livré la numérisation de reçus et de factures en un week-end —— un simple changement de base URL vers la GLM 4.6V API et l'analyse d'images a juste marché, sans fournisseur d'OCR.

Aoi Tanaka
Aoi TanakaML Lead, Daybreak Robotics

Nos robots streament des trames caméra vers GLM-4.6V et il renvoie des actions ancrées via des appels d'outils standard —— le format OpenAI a signifié zéro travail d'adaptateur.

Ethan Nguyen
Ethan NguyenHead of Engineering, Compound Studio

Nous avons benchmarké GLM-4.6V contre de plus gros modèles de vision derrière une seule clé RouterBase —— en lecture de graphiques et de tableaux, il a tenu tête à une fraction du prix.

Sophia Martín
Sophia MartínCTO, Relay

Notre RAG indexe désormais les contrats scannés comme des images de page —— GLM-4.6V les lit directement, et le tarif d'entrée en cache garde nos longs documents de référence bon marché.

Lucas Fernandes
Lucas FernandesEngineering Manager, Light

Entrelacer images et texte dans un seul message marche tout simplement avec la GLM 4.6V API —— on envoie un graphique plus une question et on récupère une réponse ancrée.

Questions fréquentes

Questions courantes sur la GLM 4.6V API.

La GLM 4.6V API est le passthrough de RouterBase vers la GLM-4.6V de Z.ai —— un modèle de vision-langage de 4.6e génération qui prend images, trames vidéo et documents en entrée, servi via une interface REST compatible OpenAI avec tool calling natif et sorties structurées.