chat.gemini_3_1_flash_lite_preview
google/gemini-3-1-flash-lite

Gemini 3.1 Flash-Lite API 是 Google 最快、最具性價比的 Gemini 3.1 模型 —— 100 萬 token 上下文、原生支援文字/影像/音訊/影片/PDF 輸入、function calling、結構化 JSON 輸出,針對低延遲與高吞吐最佳化。Gemini 3.1 Flash-Lite API 相容 OpenAI:現有 SDK 指向 RouterBase、模型設為 gemini-3-1-flash-lite 即可。輸入 $0.2375 / 1M tokens,輸出 $1.425 / 1M tokens,快取讀取 $0.02375 / 1M tokens —— 比官方公布價低 5%,全部透過一個 REST 介面完成。

Input
Gemini 3.1 Flash-Lite
max_tokens4096
temperature1
top_p1
presence_penalty0
frequency_penalty0
Gemini 3.1 Flash-Lite Online
Hi! I'm a helpful AI assistant. What can I do for you?

Gemini 3.1 Flash-Lite API:對話

使用 Gemini 3.1 Flash-Lite API 執行 Google 最快、最便宜的 Gemini 3.1 模型——1M token 上下文、原生多模態輸入與結構化輸出。

Gemini 3.1 Flash-Lite API 是 Google 最快、最具性價比的 Gemini 3.1 模型——擁有 1M token 上下文視窗,原生支援文字、圖像、音訊、影片和 PDF 輸入,支援 function calling 和結構化 JSON 輸出,專為低延遲和高吞吐量調校。透過 RouterBase 路由,Gemini 3.1 Flash-Lite API 完全相容 OpenAI:將任何現有 SDK 指向 RouterBase 的 base URL,把模型設為 gemini-3-1-flash-lite,首次呼叫即刻通過。

定價為每 1M 輸入 token $0.2375、每 1M 輸出 token $1.425、每 1M 快取輸入讀取 $0.02375——比官方公布價低 5%。一把 RouterBase 金鑰——無需 Google 憑證。

為何選擇此模型

團隊選擇 Gemini 3.1 Flash-Lite API 上線的六大理由

從最新一代的速度到立減 5% 的定價——看 Gemini 3.1 Flash-Lite API 何以脫穎而出。

最快、最便宜的 Gemini 3.1

Gemini 3.1 Flash-Lite API 是 Google 最新的輕量級模型——在 Gemini 3.1 家族中專為最低成本和最高吞吐量打造。

1M token 上下文

每次請求最多接受 100 萬 token——長文件、多檔案程式碼或影片轉錄都能裝進一次 Gemini 3.1 Flash-Lite API 呼叫,無需分塊。

原生多模態輸入

Gemini 3.1 Flash-Lite API 能理解文字、圖像、音訊、影片和 PDF。在一次請求中傳入混合媒體,跨模態分析、轉錄或推理。

function calling 與 JSON

定義工具並請求 JSON schema;Gemini 3.1 Flash-Lite API 回傳結構化工具呼叫和嚴格有效的 JSON,為可靠的代理和擷取流水線服務。

相容 OpenAI 的端點

Gemini 3.1 Flash-Lite API 使用 OpenAI chat-completions 的傳輸格式。將任何 OpenAI SDK 指向 RouterBase——無需 Google SDK 或單獨憑證。

一把金鑰,200+ 模型

呼叫 Gemini 3.1 Flash-Lite API 的同一把 RouterBase 金鑰,也可路由到 GPT-5、Claude Opus 4.8、Gemini 3.1 Pro 等 200+ 模型——無需逐家管理憑證。

RouterBase dashboard preview
快速上手

三步開始使用 Gemini 3.1 Flash-Lite API

從註冊到首個回應,不到 5 分鐘。

  1. 建立 RouterBase API 金鑰

    註冊並產生 API 金鑰——一把金鑰即可存取 Gemini 3.1 Flash-Lite API 以及目錄中的所有其他模型。

  2. 傳送你的第一則訊息

    將任何相容 OpenAI 的 SDK 指向 routerbase.com/v1,並把模型設為 gemini-3-1-flash-lite。回應遵循標準 chat-completions schema——支援串流和多模態輸入。

  3. 查看用量

    每個回應都包含詳細的 token 明細——輸入、輸出和快取讀取 token——讓每次呼叫的成本和快取命中率一目了然。

定價

按使用量付費

RouterBase 透傳合作方價格,與模型官方公開 API 價格對比。

客戶故事

團隊用 Gemini 3.1 Flash-Lite API 建構什麼

在 Gemini 3.1 Flash-Lite API 和 RouterBase 模型目錄上執行的真實生產負載。

Marcus Reyes
Marcus ReyesCTO, Paradigm AI

Gemini 3.1 Flash-Lite API 是我們高吞吐量的預設選擇——最新一代品質,快速,而且便宜到大多數呼叫都無需動用旗艦模型。RouterBase 的 5% 折扣純屬利潤。

Priya Lakshmi
Priya LakshmiFounder, Quillo

Gemini 3.1 Flash-Lite API 的原生多模態能直接讀取影片和音訊——一次快速呼叫就能同時轉錄並對內容進行推理。

Thomas Beck
Thomas BeckStaff Engineer, Northbeam

Gemini 3.1 Flash-Lite API 的結構化 JSON 輸出終結了我們脆弱的正則解析。每次都是嚴格有效的 JSON,零重試。

Aoi Tanaka
Aoi TanakaML Lead, Daybreak Robotics

我們把分類和路由遷移到 Gemini 3.1 Flash-Lite API,延遲下降,品質卻提升了。RouterBase 讓它便宜 5%,並自動繞過故障。

Jonas Keller
Jonas KellerIndie Developer

以 Flash-Lite 的價格享有 1M token 上下文,意味著我能廉價地把整份文件丟給它。Gemini 3.1 Flash-Lite API 處理起來又快又輕鬆。

Ethan Nguyen
Ethan NguyenHead of Engineering, Compound Studio

RouterBase 把 Gemini 3.1 Flash-Lite API 和 200+ 其他模型放在一把金鑰之後。我們團隊再也不用為新的供應商帳戶提交申請了。

Sophia Martín
Sophia MartínCTO, Relay

我們逐請求地對 Gemini 3.1 Flash-Lite API 與 3.1 Pro 做 A/B 測試——同一個 SDK,一個模型欄位。大部分流量留在 Flash-Lite 上,帳單大幅下降。

Lucas Fernandes
Lucas FernandesEngineering Manager, Light

我們用一個週末就把高吞吐量端點路由到了 Gemini 3.1 Flash-Lite API。唯一的 PR 評論是「等等,就這麼簡單?」。

David Okonkwo
David OkonkwoCo-founder, Figment

以每 1M 輸入 $0.2375 再減 5% 的價格,Gemini 3.1 Flash-Lite API 讓我們以可規模化的價格用上最新一代多模態推理。ROI 一算即明。

常見問題

關於 Gemini 3.1 Flash-Lite API 的常見問題。

它是 RouterBase 對 Google Gemini 3.1 Flash-Lite 的透傳——Google 最快、最具性價比的 Gemini 3.1 模型,擁有 1M token 上下文、原生視覺/音訊/影片輸入、function calling 和結構化輸出,透過相容 OpenAI 的 REST 介面提供服務。