chat.gemini_3_5_flash
google/gemini-3-5-flash

Gemini 3.5 Flash API は Google の高速・高効率なマルチモーダルモデルです —— 100 万トークンコンテキスト、テキスト/画像/音声/動画/PDF のネイティブ入力、function calling、構造化 JSON 出力を備え、低レイテンシと高スループットに最適化されています。Gemini 3.5 Flash API は OpenAI 互換:既存 SDK を RouterBase に向け、モデルを gemini-3-5-flash に設定するだけです。入力 $1.05 / 1M、出力 $6.30 / 1M、キャッシュ読み取り $0.105 / 1M —— 標準価格より 5% 引き、すべて 1 つの REST エンドポイントから。

Input
Gemini 3.5 Flash
max_tokens4096
temperature1
top_p1
presence_penalty0
frequency_penalty0
Gemini 3.5 Flash Online
Hi! I'm a helpful AI assistant. What can I do for you?

Gemini 3.5 Flash API:チャット

Gemini 3.5 Flash API を使って、1M トークンのコンテキストウィンドウを備えた Google の高速で効率的なマルチモーダルモデルを実行できます。

Gemini 3.5 Flash API は Google の速度最適化マルチモーダルモデルです。1M トークンのコンテキストウィンドウ、テキスト・画像・音声・動画・PDF のネイティブ入力、function calling、構造化された JSON 出力を備え、低レイテンシと高スループット向けにチューニングされています。RouterBase 経由なら完全に OpenAI 互換です。既存の任意の SDK を RouterBase のベース URL に向け、モデルを gemini-3-5-flash に設定すれば、最初の呼び出しがすぐに通ります。

料金は入力トークンが $1.05 / 1M、出力トークンが $6.30 / 1M、キャッシュ入力読み取りが $0.105 / 1M で、標準レートより 5% 安くなっています。RouterBase キーひとつで済み、Google の認証情報は不要です。

このモデルを選ぶ理由

チームが Gemini 3.5 Flash API でリリースする 6 つの理由

高速なマルチモーダル推論から 5% 割引の料金まで、Gemini 3.5 Flash が際立つ理由をご紹介します。

1M トークンのコンテキスト

1 リクエストあたり最大 100 万トークンを受け付けます。長大なドキュメント、複数ファイルのコード、動画の文字起こしも、1 回の Gemini 3.5 Flash API 呼び出しに収まります。

ネイティブなマルチモーダル入力

Gemini 3.5 Flash API はテキスト・画像・音声・動画・PDF を理解します。混在したメディアを 1 リクエストで渡し、モダリティをまたいで分析・文字起こし・推論できます。

高速・高スループット

低レイテンシと大量処理向けにチューニング。Gemini 3.5 Flash API は、チャット・分類・抽出・ルーティングを大規模に Flash ティアの速度で提供します。

function calling と JSON

ツールを定義し JSON スキーマを要求すると、Gemini 3.5 Flash API は構造化されたツール呼び出しと厳密に有効な JSON を返します。信頼性の高いエージェントや抽出パイプラインに最適です。

OpenAI 互換エンドポイント

Gemini 3.5 Flash API は OpenAI の chat-completions ワイヤーフォーマットに対応しています。任意の OpenAI SDK を RouterBase に向けるだけで、Google SDK も別の認証情報も不要です。

200+ モデルをキーひとつで

Gemini 3.5 Flash API を呼び出すのと同じ RouterBase キーで、GPT-5、Claude Opus 4.8、GPT-4o mini など 200+ の他モデルにもルーティングできます。プロバイダーごとの認証情報管理は不要です。

RouterBase dashboard preview
クイックスタート

Gemini 3.5 Flash API を 3 ステップで始める

サインアップから最初のレスポンスまで 5 分以内で完了します。

  1. RouterBase API キーを作成する

    サインアップして API キーを生成します。キーひとつで Gemini 3.5 Flash API とカタログ内の他のすべてのモデルにアクセスできます。

  2. 最初のメッセージを送信する

    任意の OpenAI 互換 SDK を routerbase.com/v1 に向け、モデルを gemini-3-5-flash に設定します。レスポンスは標準の chat-completions スキーマに従い、ストリーミングとマルチモーダル入力に対応しています。

  3. 使用状況を確認する

    すべてのレスポンスには、入力・出力・キャッシュ読み取りトークンの詳細な内訳が含まれます。これにより、呼び出しごとにコストとキャッシュヒット率を把握できます。

料金

使った分だけ支払う

RouterBase はパートナー料金を素通しで提供。モデルの公式 API 料金と比較してください。

お客様の事例

チームが Gemini 3.5 Flash API で構築するもの

Gemini 3.5 Flash API と RouterBase モデルカタログで稼働している、実際の本番ワークロードです。

Marcus Reyes
Marcus ReyesCTO, Paradigm AI

大量のチャットを Gemini 3.5 Flash API でルーティングしています。大規模でも高速なマルチモーダルレスポンスが得られ、RouterBase の 5% 割引はそのまま利益になります。

Priya Lakshmi
Priya LakshmiFounder, Quillo

Gemini 3.5 Flash API のネイティブビジョンで OCR パイプラインを置き換えました。1 回の高速な呼び出しで、テキストと画像をまとめてキャプション付けし抽出できます。

Thomas Beck
Thomas BeckStaff Engineer, Northbeam

Gemini 3.5 Flash API の構造化 JSON 出力で、不安定なパースがなくなりました。マルチモーダル入力でも、毎回厳密に有効な JSON が返ってきます。

Aoi Tanaka
Aoi TanakaML Lead, Daybreak Robotics

Gemini 3.5 Flash API の Flash ティアのレイテンシのおかげで、分類をオンラインに移せました。RouterBase でさらに 5% 安くなります。

Jonas Keller
Jonas KellerIndie Developer

Gemini 3.5 Flash API の 1M コンテキストなら、ドキュメント全体を投げ込んでも高速に回答が得られます。分割のための面倒なコードは不要です。

Ethan Nguyen
Ethan NguyenHead of Engineering, Compound Studio

RouterBase は Gemini 3.5 Flash API と 200+ の他モデルをキーひとつにまとめてくれます。チームが新しいプロバイダーアカウントの申請を出さなくなりました。

Sophia Martín
Sophia MartínCTO, Relay

リクエストごとに Gemini 3.5 Flash API と Pro を A/B テストしています。同じ SDK でモデルフィールドひとつだけ。トラフィックの大半は Flash に留まり、レイテンシが下がりました。

Lucas Fernandes
Lucas FernandesEngineering Manager, Light

週末のうちに 42 のサービスを Gemini 3.5 Flash API へ移行しました。唯一の PR コメントは「えっ、これだけ?」でした。

David Okonkwo
David OkonkwoCo-founder, Figment

Gemini 3.5 Flash API のキャッシュ読み取りが $0.105 / 1M なので、長コンテキスト機能が手頃になりました。ROI の計算は一瞬でした。

よくある質問

Gemini 3.5 Flash API に関するよくある質問です。

RouterBase が提供する Google の Gemini 3.5 Flash へのパススルーです。1M トークンのコンテキスト、ネイティブな画像・音声・動画入力、function calling、構造化出力を備えた高速で効率的なマルチモーダルチャットエンドポイントで、OpenAI 互換の REST インターフェース経由で提供されます。