chat.gemini_2_5_flash_lite
google/gemini-2-5-flash-lite

Gemini 2.5 Flash Lite API 是 Google 速度最快、性價比最高的 Gemini 2.5 模型 —— 100 萬 token 上下文、原生支援文字/圖像/音訊/影片/PDF 輸入、function calling、結構化 JSON 輸出,針對低延遲與高吞吐最佳化。Gemini 2.5 Flash Lite API 相容 OpenAI:現有 SDK 指向 RouterBase、模型設為 gemini-2-5-flash-lite 即可。輸入 $0.095 / 1M tokens,輸出 $0.34 / 1M tokens,快取讀取 $0.0095 / 1M tokens —— 比官方公布價低 5%,全部透過一個 REST 介面完成。

Input
Gemini 2.5 Flash-Lite
max_tokens4096
temperature1
top_p1
presence_penalty0
frequency_penalty0
Gemini 2.5 Flash-Lite Online
Hi! I'm a helpful AI assistant. What can I do for you?

Gemini 2.5 Flash Lite API:對話

使用 Gemini 2.5 Flash Lite API 執行 Google 速度最快、最具成本效益的 Gemini 2.5 模型,配備 1M token 上下文視窗與多模態輸入。

Gemini 2.5 Flash Lite API 是 Google 體積最小、最具成本效益的 Gemini 2.5 模型——擁有 1M token 上下文視窗,原生支援文字、圖片、音訊、影片和 PDF 輸入,支援 function calling 和結構化 JSON 輸出,專為在規模化場景下達成最低延遲與最高吞吐量而調校。透過 RouterBase 接入,Gemini 2.5 Flash Lite API 完全相容 OpenAI:將任何現有 SDK 指向 RouterBase 的基礎 URL,把模型設為 gemini-2-5-flash-lite,首次呼叫即可立即生效。

定價為輸入 $0.095 / 1M token、輸出 $0.34 / 1M token、快取輸入讀取 $0.0095 / 1M token——比官方公布價低 5%。一把 RouterBase 金鑰——無需 Google 憑證。

為何選擇此模型

團隊選擇 Gemini 2.5 Flash Lite API 上線的六大理由

從 1M token 上下文到立減 5% 的定價——看看 Gemini 2.5 Flash Lite API 的出眾之處。

1M token 上下文

每次請求最多接受 100 萬 token——長文件、多檔案程式碼或影片逐字稿都能在一次 Gemini 2.5 Flash Lite API 呼叫中完整處理,無需分塊。

最快、最便宜的 2.5 級距

專為大量工作負載打造:Gemini 2.5 Flash Lite API 是成本最低的 Gemini 2.5 模型,輸入僅 $0.095 / 1M token——非常適合規模化的分類、摘要、擷取和路由任務。

原生多模態輸入

Gemini 2.5 Flash Lite API 能理解文字、圖片、音訊、影片和 PDF。在一次請求中傳入混合媒體,即可跨模態分析、轉錄或推理。

Function calling 與 JSON

定義工具並請求 JSON schema;Gemini 2.5 Flash Lite API 會回傳結構化的工具呼叫和嚴格有效的 JSON,為可靠的代理與擷取流程服務。

相容 OpenAI 的端點

Gemini 2.5 Flash Lite API 採用 OpenAI chat-completions 通訊格式。將任何 OpenAI SDK 指向 RouterBase——無需 Google SDK 或另外的憑證。

一把金鑰暢用 200+ 模型

呼叫 Gemini 2.5 Flash Lite API 的同一把 RouterBase 金鑰也能路由到 GPT-5、Claude Opus 4.8、Gemini 2.5 Pro 及 200+ 其他模型——無需逐一管理服務商憑證。

RouterBase dashboard preview
快速開始

3 步上手 Gemini 2.5 Flash Lite API

從註冊到收到首個回應,不到 5 分鐘。

  1. 建立 RouterBase API 金鑰

    註冊並產生 API 金鑰——一把金鑰即可存取 Gemini 2.5 Flash Lite API 及目錄中的所有其他模型。

  2. 傳送第一則訊息

    將任何相容 OpenAI 的 SDK 指向 routerbase.com/v1,並把模型設為 gemini-2-5-flash-lite。回應遵循標準的 chat-completions schema——支援串流與多模態輸入。

  3. 檢視用量

    每個回應都包含詳細的 token 明細——輸入、輸出和快取讀取 token——讓每次呼叫的成本與快取命中率一目了然。

定價

按使用量付費

RouterBase 透傳合作方價格,與模型官方公開 API 價格對比。

客戶故事

團隊用 Gemini 2.5 Flash Lite API 打造什麼

執行在 Gemini 2.5 Flash Lite API 與 RouterBase 模型目錄上的真實正式環境負載。

Marcus Reyes
Marcus ReyesCTO, Paradigm AI

我們把 90% 的流量都透過 Gemini 2.5 Flash Lite API 路由——分類和擷取的成本只是零頭。RouterBase 立減 5% 是純利潤。

Priya Lakshmi
Priya LakshmiFounder, Quillo

Gemini 2.5 Flash Lite API 上的原生多模態可直接讀取圖片和音訊——一次又快又便宜的呼叫就能同時產生字幕和轉錄。

Thomas Beck
Thomas BeckStaff Engineer, Northbeam

Gemini 2.5 Flash Lite API 的結構化 JSON 輸出幹掉了我們時靈時不靈的正規表達式剖析。每次都是嚴格有效的 JSON,零重試。

Aoi Tanaka
Aoi TanakaML Lead, Daybreak Robotics

以我們的量級,Flash-Lite 是唯一划算的 Gemini 2.5 模型。RouterBase 還讓它再便宜 5%。

Jonas Keller
Jonas KellerIndie Developer

Gemini 2.5 Flash Lite API 撐起了我那個大量摘要迴圈。便宜到我都懶得數 token 了。

Ethan Nguyen
Ethan NguyenHead of Engineering, Compound Studio

RouterBase 把 Gemini 2.5 Flash Lite API 和 200+ 其他模型放到一把金鑰後面。我們團隊再也不用申請新的服務商帳號了。

Sophia Martín
Sophia MartínCTO, Relay

我們按請求把 Gemini 2.5 Flash Lite API 和 Gemini 2.5 Pro 做 A/B——同一 SDK,只換一個 model 欄位。大部分流量留在 Flash-Lite 上,帳單降了 70%。

Lucas Fernandes
Lucas FernandesEngineering Manager, Light

我們一個週末就把 42 個服務遷到了 Gemini 2.5 Flash Lite API。唯一的 PR 評論是「等等,就這樣?」。

David Okonkwo
David OkonkwoCo-founder, Figment

在 $0.095 / 1M 輸入再減 5% 的價格下,Gemini 2.5 Flash Lite API 讓我們的大量功能真正實現了獲利。ROI 一目了然。

常見問題

關於 Gemini 2.5 Flash Lite API 的常見問題。

它是 RouterBase 對 Google Gemini 2.5 Flash-Lite 的直通介面——速度最快、最便宜的 Gemini 2.5 對話端點,擁有 1M token 上下文、原生視覺/音訊/影片輸入、function calling 和結構化輸出,透過相容 OpenAI 的 REST 介面提供。