我們把 90% 的流量都透過 Gemini 2.5 Flash Lite API 路由——分類和擷取的成本只是零頭。RouterBase 立減 5% 是純利潤。
Gemini 2.5 Flash Lite API 是 Google 速度最快、性價比最高的 Gemini 2.5 模型 —— 100 萬 token 上下文、原生支援文字/圖像/音訊/影片/PDF 輸入、function calling、結構化 JSON 輸出,針對低延遲與高吞吐最佳化。Gemini 2.5 Flash Lite API 相容 OpenAI:現有 SDK 指向 RouterBase、模型設為 gemini-2-5-flash-lite 即可。輸入 $0.095 / 1M tokens,輸出 $0.34 / 1M tokens,快取讀取 $0.0095 / 1M tokens —— 比官方公布價低 5%,全部透過一個 REST 介面完成。
Gemini 2.5 Flash Lite API:對話
使用 Gemini 2.5 Flash Lite API 執行 Google 速度最快、最具成本效益的 Gemini 2.5 模型,配備 1M token 上下文視窗與多模態輸入。
Gemini 2.5 Flash Lite API 是 Google 體積最小、最具成本效益的 Gemini 2.5 模型——擁有 1M token 上下文視窗,原生支援文字、圖片、音訊、影片和 PDF 輸入,支援 function calling 和結構化 JSON 輸出,專為在規模化場景下達成最低延遲與最高吞吐量而調校。透過 RouterBase 接入,Gemini 2.5 Flash Lite API 完全相容 OpenAI:將任何現有 SDK 指向 RouterBase 的基礎 URL,把模型設為 gemini-2-5-flash-lite,首次呼叫即可立即生效。
定價為輸入 $0.095 / 1M token、輸出 $0.34 / 1M token、快取輸入讀取 $0.0095 / 1M token——比官方公布價低 5%。一把 RouterBase 金鑰——無需 Google 憑證。
團隊選擇 Gemini 2.5 Flash Lite API 上線的六大理由
從 1M token 上下文到立減 5% 的定價——看看 Gemini 2.5 Flash Lite API 的出眾之處。
1M token 上下文
每次請求最多接受 100 萬 token——長文件、多檔案程式碼或影片逐字稿都能在一次 Gemini 2.5 Flash Lite API 呼叫中完整處理,無需分塊。
最快、最便宜的 2.5 級距
專為大量工作負載打造:Gemini 2.5 Flash Lite API 是成本最低的 Gemini 2.5 模型,輸入僅 $0.095 / 1M token——非常適合規模化的分類、摘要、擷取和路由任務。
原生多模態輸入
Gemini 2.5 Flash Lite API 能理解文字、圖片、音訊、影片和 PDF。在一次請求中傳入混合媒體,即可跨模態分析、轉錄或推理。
Function calling 與 JSON
定義工具並請求 JSON schema;Gemini 2.5 Flash Lite API 會回傳結構化的工具呼叫和嚴格有效的 JSON,為可靠的代理與擷取流程服務。
相容 OpenAI 的端點
Gemini 2.5 Flash Lite API 採用 OpenAI chat-completions 通訊格式。將任何 OpenAI SDK 指向 RouterBase——無需 Google SDK 或另外的憑證。
一把金鑰暢用 200+ 模型
呼叫 Gemini 2.5 Flash Lite API 的同一把 RouterBase 金鑰也能路由到 GPT-5、Claude Opus 4.8、Gemini 2.5 Pro 及 200+ 其他模型——無需逐一管理服務商憑證。

3 步上手 Gemini 2.5 Flash Lite API
從註冊到收到首個回應,不到 5 分鐘。
建立 RouterBase API 金鑰
註冊並產生 API 金鑰——一把金鑰即可存取 Gemini 2.5 Flash Lite API 及目錄中的所有其他模型。
傳送第一則訊息
將任何相容 OpenAI 的 SDK 指向 routerbase.com/v1,並把模型設為 gemini-2-5-flash-lite。回應遵循標準的 chat-completions schema——支援串流與多模態輸入。
檢視用量
每個回應都包含詳細的 token 明細——輸入、輸出和快取讀取 token——讓每次呼叫的成本與快取命中率一目了然。
按使用量付費
RouterBase 透傳合作方價格,與模型官方公開 API 價格對比。
團隊用 Gemini 2.5 Flash Lite API 打造什麼
執行在 Gemini 2.5 Flash Lite API 與 RouterBase 模型目錄上的真實正式環境負載。
Gemini 2.5 Flash Lite API 上的原生多模態可直接讀取圖片和音訊——一次又快又便宜的呼叫就能同時產生字幕和轉錄。
Gemini 2.5 Flash Lite API 的結構化 JSON 輸出幹掉了我們時靈時不靈的正規表達式剖析。每次都是嚴格有效的 JSON,零重試。
以我們的量級,Flash-Lite 是唯一划算的 Gemini 2.5 模型。RouterBase 還讓它再便宜 5%。
Gemini 2.5 Flash Lite API 撐起了我那個大量摘要迴圈。便宜到我都懶得數 token 了。
RouterBase 把 Gemini 2.5 Flash Lite API 和 200+ 其他模型放到一把金鑰後面。我們團隊再也不用申請新的服務商帳號了。
我們按請求把 Gemini 2.5 Flash Lite API 和 Gemini 2.5 Pro 做 A/B——同一 SDK,只換一個 model 欄位。大部分流量留在 Flash-Lite 上,帳單降了 70%。
我們一個週末就把 42 個服務遷到了 Gemini 2.5 Flash Lite API。唯一的 PR 評論是「等等,就這樣?」。
在 $0.095 / 1M 輸入再減 5% 的價格下,Gemini 2.5 Flash Lite API 讓我們的大量功能真正實現了獲利。ROI 一目了然。
常見問題
關於 Gemini 2.5 Flash Lite API 的常見問題。
它是 RouterBase 對 Google Gemini 2.5 Flash-Lite 的直通介面——速度最快、最便宜的 Gemini 2.5 對話端點,擁有 1M token 上下文、原生視覺/音訊/影片輸入、function calling 和結構化輸出,透過相容 OpenAI 的 REST 介面提供。