Gemini 3.1 Pro API は 800K トークンの文書セットを 1 回の呼び出しで処理します。チャンク分割も検索の繋ぎ込みも不要です。1M コンテキストは私たちの開発のあり方を変えました。
Gemini 3.1 Pro API は Google のフラッグシップなマルチモーダル推論モデルです —— 100 万トークンコンテキスト、テキスト/画像/音声/動画/PDF のネイティブ入力、高度な推論、function calling、構造化 JSON 出力。Gemini 3.1 Pro API は OpenAI 互換:既存 SDK を RouterBase に向け、モデルを gemini-3-1-pro-preview に設定するだけです。入力 $1.40 / 1M、出力 $8.40 / 1M、キャッシュ読み取り $0.14 / 1M —— 標準料金より 5% 引き(基本料金は 200K トークンまでのプロンプトに適用)、すべて 1 つの REST エンドポイントから。
Gemini 3.1 Pro API: チャット
Gemini 3.1 Pro API を使って、1M トークンのコンテキストウィンドウを備えた Google のフラッグシップなマルチモーダル推論モデルを実行できます。
Gemini 3.1 Pro API は Google のフラッグシップ Gemini Pro モデルです。1M トークンのコンテキストウィンドウ、ネイティブなマルチモーダル入力(テキスト、画像、音声、動画、PDF)、高度な推論、function calling、構造化された JSON 出力を備えています。RouterBase 経由でルーティングされ、完全に OpenAI 互換です。既存の任意の SDK を RouterBase のベース URL に向け、モデルを gemini-3-1-pro-preview に設定すれば、最初の呼び出しがすぐに通ります。
料金は入力トークンが $1.40 / 1M、出力トークンが $8.40 / 1M、キャッシュ入力の読み取りが $0.14 / 1M で、標準レートより 5% 安くなっています。ベースレートは 200K トークンまでのプロンプトに適用されます。RouterBase キーが 1 つあれば十分で、Google の認証情報は不要です。
チームが Gemini 3.1 Pro API で開発する 6 つの理由
1M トークンのマルチモーダルコンテキストから 5% オフの料金まで、Gemini 3.1 Pro が際立つ理由をご紹介します。
1M トークンのコンテキスト
1 リクエストあたり最大 100 万トークンを受け付けます(200K トークンまでのプロンプトはベースレート)。コードベース全体、長い文書、動画の文字起こしなどが、1 回の Gemini 3.1 Pro API 呼び出しに収まります。
ネイティブなマルチモーダル入力
Gemini 3.1 Pro API はテキスト、画像、音声、動画、PDF を理解します。複数のメディアを 1 つのリクエストで渡し、モダリティをまたいで分析、文字起こし、推論を行えます。
高度な推論
Gemini 3.1 Pro は回答する前に考え、難しい問題には追加の計算リソースを割り当てます。多段階の数学、コーディング、複雑な分析に強みを発揮します。
function calling と JSON
ツールを定義し JSON スキーマをリクエストすれば、Gemini 3.1 Pro API は構造化されたツール呼び出しと厳密に有効な JSON を返します。信頼性の高いエージェントや抽出パイプラインに最適です。
OpenAI 互換エンドポイント
Gemini 3.1 Pro API は OpenAI の chat-completions ワイヤーフォーマットに対応しています。任意の OpenAI SDK を RouterBase に向けるだけで、Google SDK や別途の認証情報は不要です。
200+ モデルに 1 つのキー
Gemini 3.1 Pro API を呼び出すのと同じ RouterBase キーで、GPT-5、Claude Opus 4.8、GPT-4o mini、その他 200+ モデルにもルーティングできます。プロバイダーごとの認証情報管理は不要です。

3 ステップで始める Gemini 3.1 Pro API
サインアップから最初のレスポンスまで 5 分以内です。
RouterBase API キーを作成する
サインアップして API キーを生成します。1 つのキーで Gemini 3.1 Pro API とカタログ内のすべてのモデルにアクセスできます。
最初のメッセージを送る
任意の OpenAI 互換 SDK を routerbase.com/v1 に向け、モデルを gemini-3-1-pro-preview に設定します。レスポンスは標準の chat-completions スキーマに従い、ストリーミングとマルチモーダル入力に対応しています。
使用状況を確認する
すべてのレスポンスには、入力、出力、キャッシュ読み取りトークンの詳細な内訳が含まれます。これにより、呼び出しごとにコストとキャッシュヒット率を把握できます。
使った分だけ支払う
RouterBase はパートナー料金を素通しで提供。モデルの公式 API 料金と比較してください。
チームが Gemini 3.1 Pro API で構築するもの
Gemini 3.1 Pro API と RouterBase のモデルカタログ上で稼働する、実際の本番負荷をご紹介します。
動画や PDF をそのまま Gemini 3.1 Pro API に投入しています。1 回のマルチモーダル呼び出しで、3 つの別々のパイプラインを置き換えられました。
Gemini 3.1 Pro API への切り替えは RouterBase 経由で 2 行の変更だけでした。推論品質が向上し、5% の割引はそのまま利益になります。
Gemini 3.1 Pro の推論は、以前のモデルでは手に負えなかった計画立案タスクを解決しました。社内ベンチマークで精度が 31% 向上しました。
100 万トークンのコンテキストがあれば、リポジトリ全体とドキュメントをまとめて Gemini 3.1 Pro API に投げられます。チャンク分割の繋ぎ込みはもう不要です。
RouterBase は Gemini 3.1 Pro API と 200+ の他モデルを 1 つのキーの背後にまとめます。チームが新しいプロバイダーアカウントを申請することはなくなりました。
Gemini 3.1 Pro API の構造化 JSON 出力が、不安定だったパースの問題を解消しました。マルチモーダル入力でも、毎回厳密に有効な JSON が返ってきます。
週末のうちに 42 のサービスを Gemini 3.1 Pro API へ移行しました。唯一の PR コメントは「待って、これだけ?」でした。
Gemini 3.1 Pro API のキャッシュ読み取りが $0.14 / 1M だったおかげで、ロングコンテキスト機能を手頃なコストで提供できました。ROI の計算は一瞬でした。
よくある質問
Gemini 3.1 Pro API に関するよくある質問です。
RouterBase が提供する Google の Gemini 3.1 Pro へのパススルーです。1M トークンのコンテキスト、高度な推論、ネイティブな視覚・音声・動画入力、function calling、構造化出力を備えたフラッグシップのマルチモーダルチャットエンドポイントで、OpenAI 互換の REST インターフェース経由で提供されます。