大量のチャットを Gemini 3.5 Flash API でルーティングしています。大規模でも高速なマルチモーダルレスポンスが得られ、RouterBase の 5% 割引はそのまま利益になります。
Gemini 3.5 Flash API は Google の高速・高効率なマルチモーダルモデルです —— 100 万トークンコンテキスト、テキスト/画像/音声/動画/PDF のネイティブ入力、function calling、構造化 JSON 出力を備え、低レイテンシと高スループットに最適化されています。Gemini 3.5 Flash API は OpenAI 互換:既存 SDK を RouterBase に向け、モデルを gemini-3-5-flash に設定するだけです。入力 $1.05 / 1M、出力 $6.30 / 1M、キャッシュ読み取り $0.105 / 1M —— 標準価格より 5% 引き、すべて 1 つの REST エンドポイントから。
Gemini 3.5 Flash API:チャット
Gemini 3.5 Flash API を使って、1M トークンのコンテキストウィンドウを備えた Google の高速で効率的なマルチモーダルモデルを実行できます。
Gemini 3.5 Flash API は Google の速度最適化マルチモーダルモデルです。1M トークンのコンテキストウィンドウ、テキスト・画像・音声・動画・PDF のネイティブ入力、function calling、構造化された JSON 出力を備え、低レイテンシと高スループット向けにチューニングされています。RouterBase 経由なら完全に OpenAI 互換です。既存の任意の SDK を RouterBase のベース URL に向け、モデルを gemini-3-5-flash に設定すれば、最初の呼び出しがすぐに通ります。
料金は入力トークンが $1.05 / 1M、出力トークンが $6.30 / 1M、キャッシュ入力読み取りが $0.105 / 1M で、標準レートより 5% 安くなっています。RouterBase キーひとつで済み、Google の認証情報は不要です。
チームが Gemini 3.5 Flash API でリリースする 6 つの理由
高速なマルチモーダル推論から 5% 割引の料金まで、Gemini 3.5 Flash が際立つ理由をご紹介します。
1M トークンのコンテキスト
1 リクエストあたり最大 100 万トークンを受け付けます。長大なドキュメント、複数ファイルのコード、動画の文字起こしも、1 回の Gemini 3.5 Flash API 呼び出しに収まります。
ネイティブなマルチモーダル入力
Gemini 3.5 Flash API はテキスト・画像・音声・動画・PDF を理解します。混在したメディアを 1 リクエストで渡し、モダリティをまたいで分析・文字起こし・推論できます。
高速・高スループット
低レイテンシと大量処理向けにチューニング。Gemini 3.5 Flash API は、チャット・分類・抽出・ルーティングを大規模に Flash ティアの速度で提供します。
function calling と JSON
ツールを定義し JSON スキーマを要求すると、Gemini 3.5 Flash API は構造化されたツール呼び出しと厳密に有効な JSON を返します。信頼性の高いエージェントや抽出パイプラインに最適です。
OpenAI 互換エンドポイント
Gemini 3.5 Flash API は OpenAI の chat-completions ワイヤーフォーマットに対応しています。任意の OpenAI SDK を RouterBase に向けるだけで、Google SDK も別の認証情報も不要です。
200+ モデルをキーひとつで
Gemini 3.5 Flash API を呼び出すのと同じ RouterBase キーで、GPT-5、Claude Opus 4.8、GPT-4o mini など 200+ の他モデルにもルーティングできます。プロバイダーごとの認証情報管理は不要です。

Gemini 3.5 Flash API を 3 ステップで始める
サインアップから最初のレスポンスまで 5 分以内で完了します。
RouterBase API キーを作成する
サインアップして API キーを生成します。キーひとつで Gemini 3.5 Flash API とカタログ内の他のすべてのモデルにアクセスできます。
最初のメッセージを送信する
任意の OpenAI 互換 SDK を routerbase.com/v1 に向け、モデルを gemini-3-5-flash に設定します。レスポンスは標準の chat-completions スキーマに従い、ストリーミングとマルチモーダル入力に対応しています。
使用状況を確認する
すべてのレスポンスには、入力・出力・キャッシュ読み取りトークンの詳細な内訳が含まれます。これにより、呼び出しごとにコストとキャッシュヒット率を把握できます。
使った分だけ支払う
RouterBase はパートナー料金を素通しで提供。モデルの公式 API 料金と比較してください。
チームが Gemini 3.5 Flash API で構築するもの
Gemini 3.5 Flash API と RouterBase モデルカタログで稼働している、実際の本番ワークロードです。
Gemini 3.5 Flash API のネイティブビジョンで OCR パイプラインを置き換えました。1 回の高速な呼び出しで、テキストと画像をまとめてキャプション付けし抽出できます。
Gemini 3.5 Flash API の構造化 JSON 出力で、不安定なパースがなくなりました。マルチモーダル入力でも、毎回厳密に有効な JSON が返ってきます。
Gemini 3.5 Flash API の Flash ティアのレイテンシのおかげで、分類をオンラインに移せました。RouterBase でさらに 5% 安くなります。
Gemini 3.5 Flash API の 1M コンテキストなら、ドキュメント全体を投げ込んでも高速に回答が得られます。分割のための面倒なコードは不要です。
RouterBase は Gemini 3.5 Flash API と 200+ の他モデルをキーひとつにまとめてくれます。チームが新しいプロバイダーアカウントの申請を出さなくなりました。
リクエストごとに Gemini 3.5 Flash API と Pro を A/B テストしています。同じ SDK でモデルフィールドひとつだけ。トラフィックの大半は Flash に留まり、レイテンシが下がりました。
週末のうちに 42 のサービスを Gemini 3.5 Flash API へ移行しました。唯一の PR コメントは「えっ、これだけ?」でした。
Gemini 3.5 Flash API のキャッシュ読み取りが $0.105 / 1M なので、長コンテキスト機能が手頃になりました。ROI の計算は一瞬でした。
よくある質問
Gemini 3.5 Flash API に関するよくある質問です。
RouterBase が提供する Google の Gemini 3.5 Flash へのパススルーです。1M トークンのコンテキスト、ネイティブな画像・音声・動画入力、function calling、構造化出力を備えた高速で効率的なマルチモーダルチャットエンドポイントで、OpenAI 互換の REST インターフェース経由で提供されます。