chat.gemini_3_5_flash
google/gemini-3-5-flash

Gemini 3.5 Flash API 是 Google 快速、高效的多模態模型 —— 100 萬 token 上下文、原生支援文字/圖像/音訊/影片/PDF 輸入、function calling、結構化 JSON 輸出,針對低延遲與高吞吐最佳化。Gemini 3.5 Flash API 相容 OpenAI:現有 SDK 指向 RouterBase、模型設為 gemini-3-5-flash 即可。輸入 $1.05 / 1M tokens,輸出 $6.30 / 1M tokens,快取讀取 $0.105 / 1M tokens —— 比標準價低 5%,全部透過一個 REST 介面完成。

Input
Gemini 3.5 Flash
max_tokens4096
temperature1
top_p1
presence_penalty0
frequency_penalty0
Gemini 3.5 Flash Online
Hi! I'm a helpful AI assistant. What can I do for you?

Gemini 3.5 Flash API:對話

使用 Gemini 3.5 Flash API 執行 Google 快速、高效的多模態模型,支援 1M token 上下文視窗。

Gemini 3.5 Flash API 是 Google 速度最佳化的多模態模型——擁有 1M token 上下文視窗,原生支援文字、圖像、音訊、影片和 PDF 輸入,支援 function calling 和結構化 JSON 輸出,專為低延遲、高吞吐量調校。透過 RouterBase 路由後,它完全相容 OpenAI:將任何現有 SDK 指向 RouterBase 的基礎 URL,將模型設為 gemini-3-5-flash,首次呼叫即刻生效。

定價為輸入 token $1.05 / 1M、輸出 token $6.30 / 1M、快取輸入讀取 $0.105 / 1M——比標準費率低 5%。一把 RouterBase 金鑰——無需 Google 憑證。

為何選擇此模型

團隊以 Gemini 3.5 Flash API 上線的六大理由

從快速多模態推論到 5% 折扣定價——Gemini 3.5 Flash 脫穎而出的原因。

1M token 上下文

每次請求最多接受 100 萬 token——長文件、多檔案程式碼或影片逐字稿都能裝進一次 Gemini 3.5 Flash API 呼叫。

原生多模態輸入

Gemini 3.5 Flash API 能理解文字、圖像、音訊、影片和 PDF。在一次請求中傳入混合媒體,即可跨模態分析、轉錄或推理。

快速且高吞吐

專為低延遲、大流量調校:Gemini 3.5 Flash API 以 Flash 級速度大規模支撐對話、分類、擷取和路由。

function calling 與 JSON

定義工具並請求 JSON schema;Gemini 3.5 Flash API 回傳結構化的工具呼叫和嚴格有效的 JSON,為可靠的代理和擷取流水線服務。

相容 OpenAI 的端點

Gemini 3.5 Flash API 使用 OpenAI 對話補全協定格式。將任何 OpenAI SDK 指向 RouterBase——無需 Google SDK 或另外的憑證。

一把金鑰暢通 200+ 模型

呼叫 Gemini 3.5 Flash API 的同一把 RouterBase 金鑰,也能路由到 GPT-5、Claude Opus 4.8、GPT-4o mini 及 200+ 其他模型——無需逐家管理憑證。

RouterBase dashboard preview
快速上手

三步開始使用 Gemini 3.5 Flash API

從註冊到首個回應,不到 5 分鐘。

  1. 建立 RouterBase API 金鑰

    註冊並產生 API 金鑰——一把金鑰即可觸及 Gemini 3.5 Flash API 以及目錄中的每一個模型。

  2. 傳送你的第一則訊息

    將任何相容 OpenAI 的 SDK 指向 routerbase.com/v1,將模型設為 gemini-3-5-flash。回應遵循標準的對話補全 schema——支援串流和多模態輸入。

  3. 檢視用量

    每個回應都包含詳細的 token 明細——輸入、輸出和快取讀取 token——讓每次呼叫的成本與快取命中率一目了然。

定價

按使用量付費

RouterBase 透傳合作方價格,與模型官方公開 API 價格對比。

客戶故事

團隊用 Gemini 3.5 Flash API 打造了什麼

真實的生產負載,執行在 Gemini 3.5 Flash API 和 RouterBase 模型目錄之上。

Marcus Reyes
Marcus ReyesCTO, Paradigm AI

我們透過 Gemini 3.5 Flash API 路由大流量對話——大規模的快速多模態回應,而 RouterBase 5% 的折扣純屬利潤。

Priya Lakshmi
Priya LakshmiFounder, Quillo

Gemini 3.5 Flash API 上的原生視覺替換了一整套 OCR 流水線——一次快速呼叫就把文字和圖像一起配文並擷取。

Thomas Beck
Thomas BeckStaff Engineer, Northbeam

Gemini 3.5 Flash API 的結構化 JSON 輸出終結了我們不穩定的解析——每次都是嚴格有效的 JSON,即便是多模態輸入也不例外。

Aoi Tanaka
Aoi TanakaML Lead, Daybreak Robotics

Gemini 3.5 Flash API 的 Flash 級延遲讓我們把分類搬到了線上處理。RouterBase 還讓它再便宜 5%。

Jonas Keller
Jonas KellerIndie Developer

Gemini 3.5 Flash API 的 1M 上下文意味著我能把整份文件丟給它,仍然得到快速回答。不用寫分塊膠水程式碼。

Ethan Nguyen
Ethan NguyenHead of Engineering, Compound Studio

RouterBase 把 Gemini 3.5 Flash API 和 200+ 其他模型統一在一把金鑰背後。我們團隊不用再為新的供應商帳號提工單了。

Sophia Martín
Sophia MartínCTO, Relay

我們按請求對 Gemini 3.5 Flash API 與 Pro 做 A/B 測試——同一個 SDK,只改一個模型欄位。大部分流量留在 Flash 上,延遲也下降了。

Lucas Fernandes
Lucas FernandesEngineering Manager, Light

我們一個週末就把 42 個服務遷移到了 Gemini 3.5 Flash API。唯一一條 PR 留言是「等等,就這麼簡單?」。

David Okonkwo
David OkonkwoCo-founder, Figment

Gemini 3.5 Flash API 上 $0.105 / 1M 的快取讀取讓我們的長上下文功能變得划算。ROI 的帳一算就清楚了。

常見問題

關於 Gemini 3.5 Flash API 的常見問題。

它是 RouterBase 對 Google Gemini 3.5 Flash 的透傳——一個快速、高效的多模態對話端點,具備 1M token 上下文、原生視覺/音訊/影片輸入、function calling 和結構化輸出,透過相容 OpenAI 的 REST 介面提供。