Gemini 3.1 Flash-Lite API 是我們高吞吐量的預設選擇——最新一代品質,快速,而且便宜到大多數呼叫都無需動用旗艦模型。RouterBase 的 5% 折扣純屬利潤。
Gemini 3.1 Flash-Lite API 是 Google 最快、最具性價比的 Gemini 3.1 模型 —— 100 萬 token 上下文、原生支援文字/影像/音訊/影片/PDF 輸入、function calling、結構化 JSON 輸出,針對低延遲與高吞吐最佳化。Gemini 3.1 Flash-Lite API 相容 OpenAI:現有 SDK 指向 RouterBase、模型設為 gemini-3-1-flash-lite 即可。輸入 $0.2375 / 1M tokens,輸出 $1.425 / 1M tokens,快取讀取 $0.02375 / 1M tokens —— 比官方公布價低 5%,全部透過一個 REST 介面完成。
Gemini 3.1 Flash-Lite API:對話
使用 Gemini 3.1 Flash-Lite API 執行 Google 最快、最便宜的 Gemini 3.1 模型——1M token 上下文、原生多模態輸入與結構化輸出。
Gemini 3.1 Flash-Lite API 是 Google 最快、最具性價比的 Gemini 3.1 模型——擁有 1M token 上下文視窗,原生支援文字、圖像、音訊、影片和 PDF 輸入,支援 function calling 和結構化 JSON 輸出,專為低延遲和高吞吐量調校。透過 RouterBase 路由,Gemini 3.1 Flash-Lite API 完全相容 OpenAI:將任何現有 SDK 指向 RouterBase 的 base URL,把模型設為 gemini-3-1-flash-lite,首次呼叫即刻通過。
定價為每 1M 輸入 token $0.2375、每 1M 輸出 token $1.425、每 1M 快取輸入讀取 $0.02375——比官方公布價低 5%。一把 RouterBase 金鑰——無需 Google 憑證。
團隊選擇 Gemini 3.1 Flash-Lite API 上線的六大理由
從最新一代的速度到立減 5% 的定價——看 Gemini 3.1 Flash-Lite API 何以脫穎而出。
最快、最便宜的 Gemini 3.1
Gemini 3.1 Flash-Lite API 是 Google 最新的輕量級模型——在 Gemini 3.1 家族中專為最低成本和最高吞吐量打造。
1M token 上下文
每次請求最多接受 100 萬 token——長文件、多檔案程式碼或影片轉錄都能裝進一次 Gemini 3.1 Flash-Lite API 呼叫,無需分塊。
原生多模態輸入
Gemini 3.1 Flash-Lite API 能理解文字、圖像、音訊、影片和 PDF。在一次請求中傳入混合媒體,跨模態分析、轉錄或推理。
function calling 與 JSON
定義工具並請求 JSON schema;Gemini 3.1 Flash-Lite API 回傳結構化工具呼叫和嚴格有效的 JSON,為可靠的代理和擷取流水線服務。
相容 OpenAI 的端點
Gemini 3.1 Flash-Lite API 使用 OpenAI chat-completions 的傳輸格式。將任何 OpenAI SDK 指向 RouterBase——無需 Google SDK 或單獨憑證。
一把金鑰,200+ 模型
呼叫 Gemini 3.1 Flash-Lite API 的同一把 RouterBase 金鑰,也可路由到 GPT-5、Claude Opus 4.8、Gemini 3.1 Pro 等 200+ 模型——無需逐家管理憑證。

三步開始使用 Gemini 3.1 Flash-Lite API
從註冊到首個回應,不到 5 分鐘。
建立 RouterBase API 金鑰
註冊並產生 API 金鑰——一把金鑰即可存取 Gemini 3.1 Flash-Lite API 以及目錄中的所有其他模型。
傳送你的第一則訊息
將任何相容 OpenAI 的 SDK 指向 routerbase.com/v1,並把模型設為 gemini-3-1-flash-lite。回應遵循標準 chat-completions schema——支援串流和多模態輸入。
查看用量
每個回應都包含詳細的 token 明細——輸入、輸出和快取讀取 token——讓每次呼叫的成本和快取命中率一目了然。
按使用量付費
RouterBase 透傳合作方價格,與模型官方公開 API 價格對比。
團隊用 Gemini 3.1 Flash-Lite API 建構什麼
在 Gemini 3.1 Flash-Lite API 和 RouterBase 模型目錄上執行的真實生產負載。
Gemini 3.1 Flash-Lite API 的原生多模態能直接讀取影片和音訊——一次快速呼叫就能同時轉錄並對內容進行推理。
Gemini 3.1 Flash-Lite API 的結構化 JSON 輸出終結了我們脆弱的正則解析。每次都是嚴格有效的 JSON,零重試。
我們把分類和路由遷移到 Gemini 3.1 Flash-Lite API,延遲下降,品質卻提升了。RouterBase 讓它便宜 5%,並自動繞過故障。
以 Flash-Lite 的價格享有 1M token 上下文,意味著我能廉價地把整份文件丟給它。Gemini 3.1 Flash-Lite API 處理起來又快又輕鬆。
RouterBase 把 Gemini 3.1 Flash-Lite API 和 200+ 其他模型放在一把金鑰之後。我們團隊再也不用為新的供應商帳戶提交申請了。
我們逐請求地對 Gemini 3.1 Flash-Lite API 與 3.1 Pro 做 A/B 測試——同一個 SDK,一個模型欄位。大部分流量留在 Flash-Lite 上,帳單大幅下降。
我們用一個週末就把高吞吐量端點路由到了 Gemini 3.1 Flash-Lite API。唯一的 PR 評論是「等等,就這麼簡單?」。
以每 1M 輸入 $0.2375 再減 5% 的價格,Gemini 3.1 Flash-Lite API 讓我們以可規模化的價格用上最新一代多模態推理。ROI 一算即明。
常見問題
關於 Gemini 3.1 Flash-Lite API 的常見問題。
它是 RouterBase 對 Google Gemini 3.1 Flash-Lite 的透傳——Google 最快、最具性價比的 Gemini 3.1 模型,擁有 1M token 上下文、原生視覺/音訊/影片輸入、function calling 和結構化輸出,透過相容 OpenAI 的 REST 介面提供服務。