Gemini 3.1 Pro API는 80만 토큰짜리 문서 세트를 한 번의 호출로 처리합니다. 청킹도, 검색 연결 작업도 없습니다. 1M 컨텍스트가 우리의 개발 방식을 바꿨습니다.
Gemini 3.1 Pro API 는 Google 의 플래그십 멀티모달 추론 모델입니다 —— 100만 토큰 컨텍스트, 텍스트/이미지/오디오/비디오/PDF 네이티브 입력, 고급 추론, function calling, 구조화 JSON 출력. Gemini 3.1 Pro API 는 OpenAI 호환: 기존 SDK 를 RouterBase 로 지정하고 모델을 gemini-3-1-pro-preview 로 설정하면 됩니다. 입력 $1.40 / 1M, 출력 $8.40 / 1M, 캐시 읽기 $0.14 / 1M —— 표준가 대비 5% 저렴(기본가는 200K 토큰 이하 프롬프트에 적용), 모두 하나의 REST 엔드포인트로.
Gemini 3.1 Pro API: 채팅
Gemini 3.1 Pro API를 사용해 1M 토큰 컨텍스트 윈도우를 갖춘 Google의 플래그십 멀티모달 추론 모델을 실행하세요.
Gemini 3.1 Pro API는 Google의 플래그십 Gemini Pro 모델로, 1M 토큰 컨텍스트 윈도우, 네이티브 멀티모달 입력(텍스트, 이미지, 오디오, 비디오, PDF), 고급 추론, function calling, 구조화된 JSON 출력을 제공합니다. RouterBase를 통해 라우팅되며 완전히 OpenAI 호환됩니다. 기존 SDK를 RouterBase의 base URL로 향하게 하고 모델을 gemini-3-1-pro-preview로 설정하면 첫 호출이 즉시 통과합니다.
요금은 입력 토큰 $1.40 / 1M, 출력 토큰 $8.40 / 1M, 캐시 입력 읽기 $0.14 / 1M로 표준 요금보다 5% 저렴합니다. 기본 요금은 200K 토큰까지의 프롬프트에 적용됩니다. RouterBase 키 하나면 충분하며 Google 자격 증명은 필요하지 않습니다.
팀이 Gemini 3.1 Pro API로 출시하는 여섯 가지 이유
1M 토큰 멀티모달 컨텍스트부터 5% 할인 요금까지, Gemini 3.1 Pro가 돋보이는 이유를 소개합니다.
1M 토큰 컨텍스트
요청당 최대 100만 토큰을 받습니다(200K 토큰까지의 프롬프트는 기본 요금). 전체 코드베이스, 긴 문서, 비디오 자막이 단 한 번의 Gemini 3.1 Pro API 호출에 들어갑니다.
네이티브 멀티모달 입력
Gemini 3.1 Pro API는 텍스트, 이미지, 오디오, 비디오, PDF를 이해합니다. 여러 미디어를 한 요청으로 전달해 모달리티를 넘나들며 분석, 전사, 추론할 수 있습니다.
고급 추론
Gemini 3.1 Pro는 답하기 전에 사고하며, 어려운 문제에는 추가 연산을 할당합니다. 다단계 수학, 코딩, 복잡한 분석에 강합니다.
function calling 및 JSON
도구를 정의하고 JSON 스키마를 요청하면, Gemini 3.1 Pro API는 구조화된 도구 호출과 엄격하게 유효한 JSON을 반환합니다. 신뢰할 수 있는 에이전트 및 추출 파이프라인에 적합합니다.
OpenAI 호환 엔드포인트
Gemini 3.1 Pro API는 OpenAI chat-completions 와이어 포맷을 사용합니다. 어떤 OpenAI SDK든 RouterBase로 향하게 하기만 하면 되며, Google SDK나 별도 자격 증명은 필요하지 않습니다.
200+ 모델을 위한 키 하나
Gemini 3.1 Pro API를 호출하는 동일한 RouterBase 키로 GPT-5, Claude Opus 4.8, GPT-4o mini 및 200+ 다른 모델로도 라우팅됩니다. 공급자별 자격 증명 관리가 필요 없습니다.

3단계로 Gemini 3.1 Pro API 시작하기
가입부터 첫 응답까지 5분 이내입니다.
RouterBase API 키 생성하기
가입하고 API 키를 생성하세요. 키 하나로 Gemini 3.1 Pro API와 카탈로그의 모든 모델에 접근할 수 있습니다.
첫 메시지 보내기
OpenAI 호환 SDK를 routerbase.com/v1로 향하게 하고 모델을 gemini-3-1-pro-preview로 설정하세요. 응답은 표준 chat-completions 스키마를 따르며, 스트리밍과 멀티모달 입력을 지원합니다.
사용량 확인하기
모든 응답에는 입력, 출력, 캐시 읽기 토큰의 상세한 내역이 포함되어, 호출마다 비용과 캐시 적중률을 확인할 수 있습니다.
사용한 만큼만 지불
RouterBase 는 파트너 등급 가격을 그대로 전달합니다. 모델의 공식 API 가격과 비교해 보세요.
팀이 Gemini 3.1 Pro API로 만드는 것
Gemini 3.1 Pro API와 RouterBase 모델 카탈로그에서 실행되는 실제 프로덕션 부하를 소개합니다.
비디오와 PDF를 곧바로 Gemini 3.1 Pro API에 넣습니다. 한 번의 멀티모달 호출이 세 개의 별도 파이프라인을 대체했습니다.
Gemini 3.1 Pro API로의 전환은 RouterBase를 통한 두 줄짜리 변경이었습니다. 추론 품질이 뛰어올랐고 5% 할인은 그대로 마진이 됩니다.
Gemini 3.1 Pro의 추론은 이전 모델로는 손도 댈 수 없었던 계획 수립 작업을 해결했습니다. 내부 벤치마크에서 정확도가 31% 올랐습니다.
100만 토큰의 컨텍스트 덕분에 전체 레포와 문서를 통째로 Gemini 3.1 Pro API에 던질 수 있습니다. 더 이상 청킹 연결 작업이 필요 없습니다.
RouterBase는 Gemini 3.1 Pro API와 200+ 다른 모델을 키 하나 뒤에 둡니다. 우리 팀은 새 공급자 계정 요청을 더 이상 올리지 않게 되었습니다.
Gemini 3.1 Pro API의 구조화된 JSON 출력이 불안정하던 파싱 문제를 없앴습니다. 멀티모달 입력에서도 매번 엄격하게 유효한 JSON이 나옵니다.
주말 동안 42개 서비스를 Gemini 3.1 Pro API로 마이그레이션했습니다. 유일한 PR 코멘트는 '잠깐, 이게 다야?'였습니다.
Gemini 3.1 Pro API에서 캐시 읽기가 $0.14 / 1M인 덕분에 롱 컨텍스트 기능을 합리적인 비용으로 제공할 수 있었습니다. ROI 계산은 즉각적이었습니다.
자주 묻는 질문
Gemini 3.1 Pro API에 관한 자주 묻는 질문입니다.
RouterBase가 제공하는 Google Gemini 3.1 Pro로의 패스스루입니다. 1M 토큰 컨텍스트, 고급 추론, 네이티브 비전/오디오/비디오 입력, function calling, 구조화된 출력을 갖춘 플래그십 멀티모달 채팅 엔드포인트로, OpenAI 호환 REST 인터페이스를 통해 제공됩니다.