chat.gemini_2_5_flash
google/gemini-2-5-flash

Gemini 2.5 Flash API 是 Google 在速度與成本之間取得平衡的 Gemini 2.5 模型 —— 100 萬 token 上下文、可選思考、原生支援文字/圖像/音訊/影片/PDF 輸入、function calling、結構化 JSON 輸出,針對低延遲與高吞吐最佳化。Gemini 2.5 Flash API 相容 OpenAI:現有 SDK 指向 RouterBase、模型設為 gemini-2-5-flash 即可。輸入 $0.285 / 1M tokens,輸出 $2.375 / 1M tokens,快取讀取 $0.0285 / 1M tokens —— 比官方公布價低 5%,全部透過一個 REST 介面完成。

Input
Gemini 2.5 Flash
max_tokens4096
temperature1
top_p1
presence_penalty0
frequency_penalty0
Gemini 2.5 Flash Online
Hi! I'm a helpful AI assistant. What can I do for you?

Gemini 2.5 Flash API:對話

使用 Gemini 2.5 Flash API 執行 Google 這款快速、高效的多模態模型,支援 1M token 上下文視窗與內建思考能力。

Gemini 2.5 Flash API 是 Google 在速度與成本之間取得平衡的 Gemini 2.5 模型——具備 1M token 上下文視窗、可選思考能力,原生支援文字、圖像、音訊、影片和 PDF 輸入,支援 function calling 與結構化 JSON 輸出,專為低延遲、高吞吐而調校。透過 RouterBase 接入後,Gemini 2.5 Flash API 完全相容 OpenAI:將任意現有 SDK 指向 RouterBase 的 base URL,把模型設為 gemini-2-5-flash,第一次呼叫即可立即跑通。

定價為每 1M 輸入 token $0.285 / 1M、每 1M 輸出 token $2.375 / 1M、每 1M 快取輸入讀取 $0.0285 / 1M——比官方公開價低 5%。一把 RouterBase 金鑰——無需任何 Google 憑證。

為何選它

團隊選擇 Gemini 2.5 Flash API 上線的六大理由

從內建思考到 5% 折扣價——看看 Gemini 2.5 Flash API 的過人之處。

1M token 上下文

單次請求最多接受 100 萬 token——長文件、多檔案程式碼或影片逐字稿都能裝進一次 Gemini 2.5 Flash API 呼叫,無需分塊。

可選思考能力

開啟思考可讓 Gemini 2.5 Flash API 在作答前逐步推理,或關閉它以取得最快、最省錢的回應——每次請求都由你掌控速度與品質的取捨。

原生多模態輸入

Gemini 2.5 Flash API 能理解文字、圖像、音訊、影片和 PDF。在一次請求中傳入混合媒體,即可跨模態分析、轉錄或推理。

function calling 與 JSON

定義工具並請求 JSON schema,Gemini 2.5 Flash API 會回傳結構化的工具呼叫和嚴格有效的 JSON,為可靠的代理與擷取流水線服務。

相容 OpenAI 的端點

Gemini 2.5 Flash API 使用 OpenAI 的 chat-completions 通訊格式。將任意 OpenAI SDK 指向 RouterBase——無需 Google SDK 或單獨憑證。

一把金鑰通 200+ 模型

呼叫 Gemini 2.5 Flash API 的同一把 RouterBase 金鑰,也能路由到 GPT-5、Claude Opus 4.8、Gemini 2.5 Pro 及 200+ 其他模型——無需逐個管理各家憑證。

RouterBase dashboard preview
快速上手

3 步開始使用 Gemini 2.5 Flash API

從註冊到首個回應,不到 5 分鐘。

  1. 建立 RouterBase API 金鑰

    註冊並產生 API 金鑰——一把金鑰即可存取 Gemini 2.5 Flash API 以及目錄中的每一個模型。

  2. 傳送你的第一則訊息

    將任意相容 OpenAI 的 SDK 指向 routerbase.com/v1,把模型設為 gemini-2-5-flash。回應遵循標準的 chat-completions schema——支援串流與多模態輸入。

  3. 查看用量

    每個回應都附帶詳細的 token 明細——輸入、輸出與快取讀取 token——讓每次呼叫的成本與快取命中率一目了然。

定價

按使用量付費

RouterBase 透傳合作方價格,與模型官方公開 API 價格對比。

客戶故事

團隊用 Gemini 2.5 Flash API 建構什麼

執行在 Gemini 2.5 Flash API 與 RouterBase 模型目錄之上的真實生產負載。

Marcus Reyes
Marcus ReyesCTO, Paradigm AI

Gemini 2.5 Flash API 是我們的日常預設選擇——快速、多模態,好到大多數呼叫都能跳過旗艦模型。RouterBase 的 5% 折扣純粹是利潤。

Priya Lakshmi
Priya LakshmiFounder, Quillo

Gemini 2.5 Flash API 的原生多模態能直接讀取影片和音訊——一次快速呼叫就能把內容一起轉錄並推理。

Thomas Beck
Thomas BeckStaff Engineer, Northbeam

Gemini 2.5 Flash API 的結構化 JSON 輸出終結了我們脆弱的正規表示式解析。每次都是嚴格有效的 JSON,零重試。

Aoi Tanaka
Aoi TanakaML Lead, Daybreak Robotics

在 Gemini 2.5 Flash API 上切換思考開關,讓我們能為每個任務在速度與品質間靈活調節。RouterBase 讓它便宜 5%,還能自動繞過當機。

Jonas Keller
Jonas KellerIndie Developer

1M token 的上下文意味著我能把整份文件丟給它。Gemini 2.5 Flash API 又快又省地處理掉。

Ethan Nguyen
Ethan NguyenHead of Engineering, Compound Studio

RouterBase 把 Gemini 2.5 Flash API 和 200+ 其他模型放在一把金鑰之後。我們團隊再也不用為新的服務商帳號提工單了。

Sophia Martín
Sophia MartínCTO, Relay

我們按請求對 Gemini 2.5 Flash API 與 2.5 Pro 做 A/B 測試——同一個 SDK,只改一個 model 欄位。大部分流量留在 Flash 上,帳單大幅下降。

Lucas Fernandes
Lucas FernandesEngineering Manager, Light

我們用一個週末把 42 個服務遷移到 Gemini 2.5 Flash API。唯一的 PR 評論是『等等,就這麼簡單?』

David Okonkwo
David OkonkwoCo-founder, Figment

在 $0.285 / 1M 輸入再減 5% 的價位下,Gemini 2.5 Flash API 給了我們快速的多模態推理,卻沒有旗艦級的帳單。ROI 的帳一算就明白。

常見問題

關於 Gemini 2.5 Flash API 的常見問題。

它是 RouterBase 對 Google Gemini 2.5 Flash 的透明轉發——一個快速、高效的多模態對話端點,具備 1M token 上下文、可選思考能力、原生視覺/音訊/影片輸入、function calling 與結構化輸出,透過相容 OpenAI 的 REST 介面提供。