我們透過 Gemini 3.5 Flash API 路由大流量對話——大規模的快速多模態回應,而 RouterBase 5% 的折扣純屬利潤。
Gemini 3.5 Flash API 是 Google 快速、高效的多模態模型 —— 100 萬 token 上下文、原生支援文字/圖像/音訊/影片/PDF 輸入、function calling、結構化 JSON 輸出,針對低延遲與高吞吐最佳化。Gemini 3.5 Flash API 相容 OpenAI:現有 SDK 指向 RouterBase、模型設為 gemini-3-5-flash 即可。輸入 $1.05 / 1M tokens,輸出 $6.30 / 1M tokens,快取讀取 $0.105 / 1M tokens —— 比標準價低 5%,全部透過一個 REST 介面完成。
Gemini 3.5 Flash API:對話
使用 Gemini 3.5 Flash API 執行 Google 快速、高效的多模態模型,支援 1M token 上下文視窗。
Gemini 3.5 Flash API 是 Google 速度最佳化的多模態模型——擁有 1M token 上下文視窗,原生支援文字、圖像、音訊、影片和 PDF 輸入,支援 function calling 和結構化 JSON 輸出,專為低延遲、高吞吐量調校。透過 RouterBase 路由後,它完全相容 OpenAI:將任何現有 SDK 指向 RouterBase 的基礎 URL,將模型設為 gemini-3-5-flash,首次呼叫即刻生效。
定價為輸入 token $1.05 / 1M、輸出 token $6.30 / 1M、快取輸入讀取 $0.105 / 1M——比標準費率低 5%。一把 RouterBase 金鑰——無需 Google 憑證。
團隊以 Gemini 3.5 Flash API 上線的六大理由
從快速多模態推論到 5% 折扣定價——Gemini 3.5 Flash 脫穎而出的原因。
1M token 上下文
每次請求最多接受 100 萬 token——長文件、多檔案程式碼或影片逐字稿都能裝進一次 Gemini 3.5 Flash API 呼叫。
原生多模態輸入
Gemini 3.5 Flash API 能理解文字、圖像、音訊、影片和 PDF。在一次請求中傳入混合媒體,即可跨模態分析、轉錄或推理。
快速且高吞吐
專為低延遲、大流量調校:Gemini 3.5 Flash API 以 Flash 級速度大規模支撐對話、分類、擷取和路由。
function calling 與 JSON
定義工具並請求 JSON schema;Gemini 3.5 Flash API 回傳結構化的工具呼叫和嚴格有效的 JSON,為可靠的代理和擷取流水線服務。
相容 OpenAI 的端點
Gemini 3.5 Flash API 使用 OpenAI 對話補全協定格式。將任何 OpenAI SDK 指向 RouterBase——無需 Google SDK 或另外的憑證。
一把金鑰暢通 200+ 模型
呼叫 Gemini 3.5 Flash API 的同一把 RouterBase 金鑰,也能路由到 GPT-5、Claude Opus 4.8、GPT-4o mini 及 200+ 其他模型——無需逐家管理憑證。

三步開始使用 Gemini 3.5 Flash API
從註冊到首個回應,不到 5 分鐘。
建立 RouterBase API 金鑰
註冊並產生 API 金鑰——一把金鑰即可觸及 Gemini 3.5 Flash API 以及目錄中的每一個模型。
傳送你的第一則訊息
將任何相容 OpenAI 的 SDK 指向 routerbase.com/v1,將模型設為 gemini-3-5-flash。回應遵循標準的對話補全 schema——支援串流和多模態輸入。
檢視用量
每個回應都包含詳細的 token 明細——輸入、輸出和快取讀取 token——讓每次呼叫的成本與快取命中率一目了然。
按使用量付費
RouterBase 透傳合作方價格,與模型官方公開 API 價格對比。
團隊用 Gemini 3.5 Flash API 打造了什麼
真實的生產負載,執行在 Gemini 3.5 Flash API 和 RouterBase 模型目錄之上。
Gemini 3.5 Flash API 上的原生視覺替換了一整套 OCR 流水線——一次快速呼叫就把文字和圖像一起配文並擷取。
Gemini 3.5 Flash API 的結構化 JSON 輸出終結了我們不穩定的解析——每次都是嚴格有效的 JSON,即便是多模態輸入也不例外。
Gemini 3.5 Flash API 的 Flash 級延遲讓我們把分類搬到了線上處理。RouterBase 還讓它再便宜 5%。
Gemini 3.5 Flash API 的 1M 上下文意味著我能把整份文件丟給它,仍然得到快速回答。不用寫分塊膠水程式碼。
RouterBase 把 Gemini 3.5 Flash API 和 200+ 其他模型統一在一把金鑰背後。我們團隊不用再為新的供應商帳號提工單了。
我們按請求對 Gemini 3.5 Flash API 與 Pro 做 A/B 測試——同一個 SDK,只改一個模型欄位。大部分流量留在 Flash 上,延遲也下降了。
我們一個週末就把 42 個服務遷移到了 Gemini 3.5 Flash API。唯一一條 PR 留言是「等等,就這麼簡單?」。
Gemini 3.5 Flash API 上 $0.105 / 1M 的快取讀取讓我們的長上下文功能變得划算。ROI 的帳一算就清楚了。
常見問題
關於 Gemini 3.5 Flash API 的常見問題。
它是 RouterBase 對 Google Gemini 3.5 Flash 的透傳——一個快速、高效的多模態對話端點,具備 1M token 上下文、原生視覺/音訊/影片輸入、function calling 和結構化輸出,透過相容 OpenAI 的 REST 介面提供。