Gemini 3.1 Flash-Lite API は当社の大量処理のデフォルトです。最新世代の品質で高速、しかもほとんどの呼び出しでフラッグシップを使わずに済むほど安価です。RouterBase の 5% 割引はそのまま利益になります。
Gemini 3.1 Flash-Lite API は Google の最速・最もコスト効率の高い Gemini 3.1 モデルです —— 100 万トークンコンテキスト、テキスト/画像/音声/動画/PDF のネイティブ入力、function calling、構造化 JSON 出力を備え、低レイテンシと高スループット向けに最適化されています。Gemini 3.1 Flash-Lite API は OpenAI 互換:既存 SDK を RouterBase に向け、モデルを gemini-3-1-flash-lite に設定するだけです。入力 $0.2375 / 1M、出力 $1.425 / 1M、キャッシュ読み取り $0.02375 / 1M —— 公式公開価格より 5% 引き、すべて 1 つの REST エンドポイントから。
Gemini 3.1 Flash-Lite API: チャット
Gemini 3.1 Flash-Lite API を使って、Google で最速かつ最安の Gemini 3.1 モデルを実行できます。1M トークンのコンテキスト、ネイティブなマルチモーダル入力、構造化された出力に対応しています。
Gemini 3.1 Flash-Lite API は、Google で最速かつ最もコスト効率の高い Gemini 3.1 モデルです。1M トークンのコンテキストウィンドウ、テキスト・画像・音声・動画・PDF のネイティブ入力、function calling、構造化された JSON 出力を備え、低レイテンシと高スループット向けに調整されています。RouterBase 経由でルーティングされる Gemini 3.1 Flash-Lite API は、完全に OpenAI 互換です。既存の任意の SDK を RouterBase のベース URL に向け、モデルを gemini-3-1-flash-lite に設定すれば、最初の呼び出しがすぐに通ります。
料金は入力トークンが $0.2375 / 1M、出力トークンが $1.425 / 1M、キャッシュ入力の読み取りが $0.02375 / 1M で、公式の公開料金より 5% 低く設定されています。RouterBase のキー 1 つだけで、Google の認証情報は不要です。
チームが Gemini 3.1 Flash-Lite API で開発する 6 つの理由
最新世代の速度から 5% オフの料金まで、Gemini 3.1 Flash-Lite API が際立つポイントをご紹介します。
最速かつ最安の Gemini 3.1
Gemini 3.1 Flash-Lite API は Google 最新の軽量モデルです。Gemini 3.1 ファミリーの中で最も低コストかつ最も高いスループットを実現するために構築されています。
1M トークンのコンテキスト
1 リクエストあたり最大 100 万トークンを受け付けます。長いドキュメント、複数ファイルのコード、動画の文字起こしも、チャンク分割せずに 1 回の Gemini 3.1 Flash-Lite API 呼び出しに収まります。
ネイティブなマルチモーダル入力
Gemini 3.1 Flash-Lite API はテキスト・画像・音声・動画・PDF を理解します。複数のメディアを 1 リクエストで渡して、モダリティをまたいで分析・文字起こし・推論できます。
function calling と JSON
ツールを定義し、JSON スキーマをリクエストすれば、Gemini 3.1 Flash-Lite API は構造化されたツール呼び出しと厳密に有効な JSON を返します。信頼性の高いエージェントや抽出パイプラインに最適です。
OpenAI 互換エンドポイント
Gemini 3.1 Flash-Lite API は OpenAI の chat-completions ワイヤーフォーマットに対応しています。任意の OpenAI SDK を RouterBase に向けるだけで、Google SDK も別の認証情報も不要です。
200+ モデルを 1 つのキーで
Gemini 3.1 Flash-Lite API を呼び出すのと同じ RouterBase キーで、GPT-5、Claude Opus 4.8、Gemini 3.1 Pro、その他 200+ のモデルにもルーティングできます。プロバイダーごとの認証情報管理は不要です。

Gemini 3.1 Flash-Lite API を 3 ステップで始める
サインアップから最初のレスポンスまで 5 分以内で完了します。
RouterBase API キーを作成する
サインアップして API キーを生成します。1 つのキーで Gemini 3.1 Flash-Lite API とカタログ内のすべてのモデルにアクセスできます。
最初のメッセージを送信する
任意の OpenAI 互換 SDK を routerbase.com/v1 に向け、モデルを gemini-3-1-flash-lite に設定します。レスポンスは標準の chat-completions スキーマに従い、ストリーミングとマルチモーダル入力に対応しています。
使用量を確認する
すべてのレスポンスに、入力・出力・キャッシュ読み取りトークンの詳細な内訳が含まれます。これにより、呼び出しごとにコストとキャッシュヒット率を把握できます。
使った分だけ支払う
RouterBase はパートナー料金を素通しで提供。モデルの公式 API 料金と比較してください。
チームが Gemini 3.1 Flash-Lite API で構築するもの
Gemini 3.1 Flash-Lite API と RouterBase のモデルカタログ上で稼働する実際の本番ワークロードです。
Gemini 3.1 Flash-Lite API のネイティブマルチモーダルは動画と音声を直接読み取ります。1 回の高速な呼び出しで文字起こしとコンテンツの推論をまとめて行えます。
Gemini 3.1 Flash-Lite API の構造化 JSON 出力で、不安定だった正規表現パースを廃止できました。毎回厳密に有効な JSON が返り、リトライはゼロです。
分類とルーティングを Gemini 3.1 Flash-Lite API に移行したところ、レイテンシが下がり品質は向上しました。RouterBase はそれを 5% 安くし、障害も自動で回避してくれます。
Flash-Lite の価格で 1M トークンのコンテキストが使えるので、ドキュメント丸ごとを安価に投げられます。Gemini 3.1 Flash-Lite API はそれを高速にさばいてくれます。
RouterBase は Gemini 3.1 Flash-Lite API と 200+ のモデルを 1 つのキーの背後にまとめます。チームは新しいプロバイダーアカウントの申請をしなくなりました。
リクエストごとに Gemini 3.1 Flash-Lite API と 3.1 Pro を A/B テストしています。同じ SDK で、変えるのはモデルフィールド 1 つだけ。ほとんどのトラフィックは Flash-Lite に残り、請求額は大きく下がりました。
週末のうちに大量処理のエンドポイントを Gemini 3.1 Flash-Lite API へルーティングしました。唯一の PR コメントは「えっ、これだけ?」でした。
$0.2375 / 1M の入力からさらに 5% 引きで、Gemini 3.1 Flash-Lite API は最新世代のマルチモーダル推論をスケールする価格で提供してくれました。ROI の計算は即座に成り立ちました。
よくある質問
Gemini 3.1 Flash-Lite API に関するよくある質問です。
これは Google の Gemini 3.1 Flash-Lite への RouterBase のパススルーです。Google で最速かつ最もコスト効率の高い Gemini 3.1 モデルで、1M トークンのコンテキスト、ネイティブな画像・音声・動画入力、function calling、構造化された出力を備え、OpenAI 互換の REST インターフェースを介して提供されます。