Gemini 2.5 Flash API は私たちの日常的なデフォルトです。高速でマルチモーダル、しかもほとんどの呼び出しでフラッグシップを使わずに済むほど優秀です。RouterBase の 5% 割引はそのまま利益になります。
Gemini 2.5 Flash API は Google のスピードとコストのバランスに優れた Gemini 2.5 モデルです —— 100 万トークンコンテキスト、オプションの思考、テキスト/画像/音声/動画/PDF のネイティブ入力、function calling、構造化 JSON 出力を備え、低レイテンシと高スループット向けに最適化されています。Gemini 2.5 Flash API は OpenAI 互換:既存 SDK を RouterBase に向け、モデルを gemini-2-5-flash に設定するだけです。入力 $0.285 / 1M、出力 $2.375 / 1M、キャッシュ読み取り $0.0285 / 1M —— 公式公開価格より 5% 引き、すべて 1 つの REST エンドポイントから。
Gemini 2.5 Flash API: チャット
Gemini 2.5 Flash API を使って、Google の高速かつ効率的なマルチモーダルモデルを 1M トークンのコンテキストウィンドウと組み込みの思考機能とともに実行できます。
Gemini 2.5 Flash API は、Google が速度とコストのバランスを追求した Gemini 2.5 モデルです。1M トークンのコンテキストウィンドウ、オプションの思考機能、テキスト・画像・音声・動画・PDF のネイティブ入力、function calling、構造化された JSON 出力を備え、低レイテンシーと高スループット向けに最適化されています。RouterBase 経由でルーティングされる Gemini 2.5 Flash API は完全に OpenAI 互換です。既存の任意の SDK を RouterBase のベース URL に向け、モデルを gemini-2-5-flash に設定すれば、最初の呼び出しがすぐに通ります。
料金は入力トークン $0.285 / 1M、出力トークン $2.375 / 1M、キャッシュ入力の読み取り $0.0285 / 1M で、公式の公表料金より 5% 安くなっています。RouterBase キーは 1 つだけ。Google の認証情報は不要です。
チームが Gemini 2.5 Flash API で開発を進める 6 つの理由
組み込みの思考機能から 5% オフの料金まで。Gemini 2.5 Flash API が際立つ理由をご紹介します。
1M トークンのコンテキスト
1 リクエストあたり最大 100 万トークンを受け付けます。長いドキュメント、複数ファイルのコード、動画の文字起こしも、チャンク分割せずに 1 回の Gemini 2.5 Flash API 呼び出しに収まります。
オプションの思考機能
思考機能を有効にすると、Gemini 2.5 Flash API は回答前に段階的に推論します。無効にすれば、最速かつ最安の応答が得られます。速度と品質のトレードオフをリクエストごとに制御できます。
ネイティブなマルチモーダル入力
Gemini 2.5 Flash API はテキスト・画像・音声・動画・PDF を理解します。複数のメディアを 1 つのリクエストで渡し、モダリティをまたいで分析・文字起こし・推論できます。
function calling と JSON
ツールを定義して JSON スキーマをリクエストすれば、Gemini 2.5 Flash API は構造化されたツール呼び出しと厳密に有効な JSON を返します。信頼性の高いエージェントや抽出パイプラインに最適です。
OpenAI 互換エンドポイント
Gemini 2.5 Flash API は OpenAI の chat-completions ワイヤーフォーマットに対応しています。任意の OpenAI SDK を RouterBase に向けるだけ。Google SDK や別の認証情報は必要ありません。
200+ モデルを 1 つのキーで
Gemini 2.5 Flash API を呼び出すのと同じ RouterBase キーで、GPT-5、Claude Opus 4.8、Gemini 2.5 Pro をはじめ 200+ のモデルにもルーティングできます。プロバイダーごとの認証情報管理は不要です。

3 ステップで Gemini 2.5 Flash API を使い始める
サインアップから最初の応答まで 5 分以内。
RouterBase API キーを作成する
サインアップして API キーを生成します。1 つのキーで Gemini 2.5 Flash API とカタログ内の他のすべてのモデルにアクセスできます。
最初のメッセージを送信する
任意の OpenAI 互換 SDK を routerbase.com/v1 に向け、モデルを gemini-2-5-flash に設定します。応答は標準の chat-completions スキーマに従い、ストリーミングとマルチモーダル入力に対応しています。
使用状況を確認する
すべての応答には入力・出力・キャッシュ読み取りトークンの詳細な内訳が含まれます。これにより、すべての呼び出しでコストとキャッシュヒット率を把握できます。
使った分だけ支払う
RouterBase はパートナー料金を素通しで提供。モデルの公式 API 料金と比較してください。
チームが Gemini 2.5 Flash API で構築するもの
Gemini 2.5 Flash API と RouterBase のモデルカタログ上で稼働する実際の本番ワークロード。
Gemini 2.5 Flash API のネイティブなマルチモーダル機能は動画と音声を直接読み取ります。1 回の高速な呼び出しで文字起こしと内容の推論をまとめて行えます。
Gemini 2.5 Flash API の構造化 JSON 出力のおかげで、不安定だった正規表現のパースが不要になりました。毎回厳密に有効な JSON が返り、リトライはゼロです。
Gemini 2.5 Flash API で思考機能を切り替えれば、タスクごとに速度と品質を調整できます。RouterBase はそれを 5% 安くし、障害時には自動で迂回してくれます。
1M トークンのコンテキストがあるので、ドキュメント丸ごと投げ込めます。Gemini 2.5 Flash API はそれを高速かつ安価に処理してくれます。
RouterBase は Gemini 2.5 Flash API と 200+ の他モデルを 1 つのキーの背後にまとめてくれます。チームは新しいプロバイダーアカウントの申請をしなくなりました。
私たちはリクエストごとに Gemini 2.5 Flash API と 2.5 Pro を A/B テストしています。同じ SDK で、モデルフィールドを 1 つ変えるだけ。トラフィックのほとんどは Flash のままで、請求額が大幅に下がりました。
週末に 42 のサービスを Gemini 2.5 Flash API へ移行しました。唯一の PR コメントは「えっ、これだけ?」でした。
入力 $0.285 / 1M からさらに 5% オフで、Gemini 2.5 Flash API はフラッグシップの請求なしに高速なマルチモーダル推論を実現してくれました。ROI の計算は一瞬でした。
よくある質問
Gemini 2.5 Flash API に関するよくある質問。
RouterBase が提供する Google の Gemini 2.5 Flash へのパススルーです。1M トークンのコンテキスト、オプションの思考機能、ネイティブな視覚・音声・動画入力、function calling、構造化出力を備えた高速かつ効率的なマルチモーダルチャットエンドポイントで、OpenAI 互換の REST インターフェース経由で提供されます。