지원 에이전트가 사용자가 보는 화면 스크린샷을 GLM-4.6V에 보내면 망가진 요소를 짚어냅니다 —— 전에 쓰던 비전 모델보다 훨씬 저렴합니다.
GLM 4.6V API는 Z.ai의 4.6세대 비전·언어 모델 —— 이미지, 비디오 프레임, 문서를 텍스트와 함께 받아 OCR, 차트·표 추출, 시각 추론을 수행하며, 네이티브 도구 호출과 구조화 출력을 지원합니다. GLM 4.6V API는 OpenAI 호환: 기존 SDK를 RouterBase로 향하게 하고 model을 glm-4-6v로 설정. 입력 $0.255 / 1M 토큰, 출력 $0.765 / 1M 토큰, 캐시 입력 읽기 $0.0425 / 1M —— 공식가보다 15% 저렴, 모두 하나의 REST 엔드포인트로.
GLM 4.6V API: 채팅
GLM 4.6V API로 앱에 '눈'을 달아주세요 —— Z.ai의 4.6세대 비전·언어 모델이 이미지, 비디오 프레임, 스크린샷, 문서를 읽고 텍스트나 도구 호출로 답합니다.
GLM 4.6V API는 Z.ai의 4.6세대 비전·언어(멀티모달) 모델입니다 —— 이미지, 비디오 프레임, 문서를 텍스트와 함께 받아 OCR, 차트·표 추출, 시각 추론을 수행하며, 네이티브 도구 호출과 구조화 출력을 지원합니다. RouterBase를 통해 GLM 4.6V API는 완전히 OpenAI 호환됩니다: 기존 SDK를 RouterBase의 base URL로 향하게 하고 model을 glm-4-6v로 설정하면 첫 GLM 4.6V API 호출이 바로 통과합니다.
GLM 4.6V API 요금은 입력 $0.255 / 1M 토큰, 출력 $0.765 / 1M 토큰, 캐시 입력 읽기 $0.0425 / 1M —— 공식 공개가보다 15% 저렴. 하나의 RouterBase 키로 GLM 4.6V API와 200개 이상 모델을 사용 —— Z.ai 계정이 필요 없습니다.
팀이 GLM 4.6V API를 선택하는 6가지 이유
프레임 단위의 정확한 이미지 판독부터 15% 할인 가격까지 —— 팀이 멀티모달 기능 뒤에 GLM-4.6V를 두는 이유.
이미지·비디오·문서를 봅니다
GLM 4.6V API는 텍스트와 함께 이미지, 여러 페이지 문서, 비디오 프레임을 받습니다 —— OCR, 차트·표 추출, 시각 추론을 한 번의 멀티모달 호출로 처리합니다.
문서·차트·OCR
스크린샷, 스캔 PDF, 인보이스, 대시보드를 GLM 4.6V API에 주면 텍스트, 표, 구조를 뽑아냅니다 —— 별도의 OCR 파이프라인을 돌릴 필요가 없습니다.
네이티브 도구 호출
GLM 4.6V API는 본 것에서 바로 OpenAI 도구 형식으로 함수를 호출합니다 —— 양식을 읽게 한 뒤 하나의 멀티모달 에이전트 루프에서 도구를 트리거하세요.
긴 컨텍스트 윈도우
긴 다중 이미지 문서, 전체 대화 기록, 이미지와 텍스트가 번갈아 나오는 턴을 하나의 GLM 4.6V API 요청에 담습니다.
OpenAI 호환, 키 하나
GLM 4.6V API는 이미지를 포함한 OpenAI chat-completions 형식을 사용 —— 같은 RouterBase 키로 GPT-5.5, Claude, Gemini, 200개 이상 모델로도 라우팅.
공식가 대비 15% 저렴
GLM 4.6V API는 Z.ai 공개가보다 15% 저렴 —— 입력 $0.255 / 1M, 출력 $0.765 / 1M, 캐시 $0.0425 / 1M. 이미지 입력도 토큰으로 과금돼 멀티모달이 저렴하게 유지됩니다.

3단계로 GLM 4.6V API 시작하기
가입부터 첫 응답까지 5분 이내.
RouterBase API 키 생성
계정을 만들고 키를 생성하세요 —— GLM-4.6V와 RouterBase 카탈로그의 모든 다른 모델이 열립니다.
첫 메시지 보내기
OpenAI 호환 SDK를 routerbase.com/v1로 향하게 하고 model을 glm-4-6v로 설정한 뒤, 텍스트 옆에 image_url 파트를 담아 메시지를 보내세요. 응답은 표준 chat-completions 스키마를 따르며 스트리밍도 포함됩니다.
사용량 확인
각 응답에는 텍스트·이미지 입력, 출력, 캐시 입력의 완전한 토큰 내역이 담겨, GLM 4.6V API의 멀티모달 비용을 호출마다 지켜볼 수 있습니다.
사용한 만큼만 지불
RouterBase 는 파트너 등급 가격을 그대로 전달합니다. 모델의 공식 API 가격과 비교해 보세요.
팀이 GLM 4.6V API로 만드는 것
RouterBase 200+ 모델 카탈로그에서 돌아가는 실제 프로덕션 워크로드.
영수증·인보이스 스캔을 주말 만에 출시했습니다 —— base URL을 GLM 4.6V API로 한 번 바꾸니 이미지 파싱이 바로 됐고, OCR 벤더가 필요 없었습니다.
로봇이 카메라 프레임을 GLM-4.6V로 스트리밍하면 표준 도구 호출로 근거 있는 동작을 돌려줍니다 —— OpenAI 형식 덕분에 어댑터 작업이 전혀 없었습니다.
하나의 RouterBase 키 뒤에서 GLM-4.6V를 더 큰 비전 모델들과 벤치마크했습니다 —— 차트·표 판독에서 아주 적은 비용으로 손색이 없었습니다.
우리 RAG는 이제 스캔한 계약서를 페이지 이미지로 인덱싱합니다 —— GLM-4.6V가 직접 읽고, 캐시 입력 요율 덕분에 긴 참조 문서도 저렴하게 유지됩니다.
한 메시지에 이미지와 텍스트를 섞어도 GLM 4.6V API에서는 그냥 됩니다 —— 차트와 질문을 함께 보내면 근거 있는 답을 받습니다.
자주 묻는 질문
GLM 4.6V API에 대한 일반적인 질문.
GLM 4.6V API는 RouterBase가 Z.ai GLM-4.6V로 연결하는 패스스루입니다 —— 이미지, 비디오 프레임, 문서를 입력으로 받는 4.6세대 비전·언어 모델로, 네이티브 도구 호출과 구조화 출력을 갖추고 OpenAI 호환 REST 인터페이스로 제공됩니다.