トラフィックの 90% を Gemini 2.5 Flash Lite API でルーティングしています。分類と抽出をわずかなコストで実現できます。RouterBase の 5% 割引はそのまま利益になります。
Gemini 2.5 Flash Lite API は Google で最も高速・最もコスト効率に優れた Gemini 2.5 モデルです —— 100 万トークンコンテキスト、テキスト/画像/音声/動画/PDF のネイティブ入力、function calling、構造化 JSON 出力を備え、低レイテンシと高スループット向けに最適化されています。Gemini 2.5 Flash Lite API は OpenAI 互換:既存 SDK を RouterBase に向け、モデルを gemini-2-5-flash-lite に設定するだけです。入力 $0.095 / 1M、出力 $0.34 / 1M、キャッシュ読み取り $0.0095 / 1M —— 公式公開価格より 5% 引き、すべて 1 つの REST エンドポイントから。
Gemini 2.5 Flash Lite API:チャット
Gemini 2.5 Flash Lite API を使えば、1M トークンのコンテキストウィンドウとマルチモーダル入力を備えた、Google で最速かつ最もコスト効率に優れた Gemini 2.5 モデルを実行できます。
Gemini 2.5 Flash Lite API は、Google で最小かつ最もコスト効率に優れた Gemini 2.5 モデルです。1M トークンのコンテキストウィンドウ、テキスト・画像・音声・動画・PDF のネイティブ入力、function calling、構造化された JSON 出力を備え、大規模環境での最小レイテンシと最大スループットに最適化されています。RouterBase 経由でルーティングされる Gemini 2.5 Flash Lite API は OpenAI 完全互換です。既存の SDK を RouterBase のベース URL に向け、モデルを gemini-2-5-flash-lite に設定するだけで、最初の呼び出しがすぐに通ります。
料金は入力トークン $0.095 / 1M、出力トークン $0.34 / 1M、キャッシュ入力読み取り $0.0095 / 1M で、公式公開料金より 5% お得です。RouterBase キーが 1 つあれば十分で、Google の認証情報は不要です。
チームが Gemini 2.5 Flash Lite API でリリースする 6 つの理由
1M トークンのコンテキストから 5% オフの料金まで、Gemini 2.5 Flash Lite API が際立つ理由をご紹介します。
1M トークンのコンテキスト
1 リクエストあたり最大 100 万トークンを受け付けます。長文ドキュメント、複数ファイルのコード、動画の文字起こしも、チャンク分割なしで 1 回の Gemini 2.5 Flash Lite API 呼び出しに収まります。
最速・最安の 2.5 ティア
大量処理向けに構築されています。Gemini 2.5 Flash Lite API は入力トークン $0.095 / 1M という最も低コストな Gemini 2.5 モデルで、大規模な分類・要約・抽出・ルーティングに最適です。
ネイティブなマルチモーダル入力
Gemini 2.5 Flash Lite API はテキスト・画像・音声・動画・PDF を理解します。複数のメディアを 1 リクエストにまとめて渡し、モダリティをまたいで分析・文字起こし・推論ができます。
function calling と JSON
ツールを定義して JSON スキーマをリクエストすれば、Gemini 2.5 Flash Lite API は構造化されたツール呼び出しと厳密に有効な JSON を返し、信頼性の高いエージェントや抽出パイプラインを実現します。
OpenAI 互換エンドポイント
Gemini 2.5 Flash Lite API は OpenAI の chat-completions ワイヤーフォーマットに対応しています。任意の OpenAI SDK を RouterBase に向けるだけで、Google の SDK も別の認証情報も不要です。
200+ モデルを 1 つのキーで
Gemini 2.5 Flash Lite API を呼び出すのと同じ RouterBase キーで、GPT-5、Claude Opus 4.8、Gemini 2.5 Pro、その他 200+ のモデルにもルーティングできます。プロバイダーごとの認証情報管理は不要です。

Gemini 2.5 Flash Lite API を 3 ステップで使い始める
サインアップから最初のレスポンスまで 5 分以内。
RouterBase API キーを作成する
サインアップして API キーを生成します。1 つのキーで Gemini 2.5 Flash Lite API と、カタログ内のすべてのモデルにアクセスできます。
最初のメッセージを送信する
任意の OpenAI 互換 SDK を routerbase.com/v1 に向け、モデルを gemini-2-5-flash-lite に設定します。レスポンスは標準の chat-completions スキーマに従い、ストリーミングとマルチモーダル入力に対応しています。
使用状況を確認する
すべてのレスポンスには、入力・出力・キャッシュ読み取りトークンの詳細な内訳が含まれるため、呼び出しごとにコストとキャッシュヒット率を把握できます。
使った分だけ支払う
RouterBase はパートナー料金を素通しで提供。モデルの公式 API 料金と比較してください。
チームが Gemini 2.5 Flash Lite API で構築するもの
Gemini 2.5 Flash Lite API と RouterBase のモデルカタログ上で実際に稼働している本番負荷。
Gemini 2.5 Flash Lite API のネイティブマルチモーダルは画像と音声を直接読み取り、高速で安価な 1 回の呼び出しでキャプション付けと文字起こしを同時にこなします。
Gemini 2.5 Flash Lite API の構造化 JSON 出力で、不安定な正規表現解析を撲滅できました。毎回厳密に有効な JSON が返り、リトライはゼロです。
私たちの処理量では、採算が合う Gemini 2.5 モデルは Flash-Lite だけです。RouterBase でさらに 5% 安くなります。
Gemini 2.5 Flash Lite API は私の大量要約ループをこなしてくれます。十分に安いので、トークンを数えるのをやめました。
RouterBase は Gemini 2.5 Flash Lite API とその他 200+ モデルを 1 つのキーの背後にまとめます。チームは新しいプロバイダーアカウントの申請をしなくなりました。
リクエストごとに Gemini 2.5 Flash Lite API と Gemini 2.5 Pro を A/B テストしています。同じ SDK で、モデルフィールドは 1 つだけ。トラフィックの大半は Flash-Lite に残り、請求額は 70% 下がりました。
週末に 42 のサービスを Gemini 2.5 Flash Lite API に移行しました。PR のコメントは『え、これだけ?』の一言だけでした。
入力 $0.095 / 1M からさらに 5% オフで、Gemini 2.5 Flash Lite API は私たちの大量処理機能を実際に黒字化してくれました。ROI の計算は一瞬でした。
よくある質問
Gemini 2.5 Flash Lite API に関するよくある質問。
RouterBase が提供する Google の Gemini 2.5 Flash-Lite へのパススルーです。1M トークンのコンテキスト、ネイティブな映像・音声・動画入力、function calling、構造化出力を備えた、最速かつ最安の Gemini 2.5 チャットエンドポイントで、OpenAI 互換の REST インターフェースで提供されます。