chat.gemini_2_5_flash_lite
google/gemini-2-5-flash-lite

Gemini 2.5 Flash Lite API 是 Google 速度最快、性价比最高的 Gemini 2.5 模型 —— 100 万 token 上下文、原生支持文本/图像/音频/视频/PDF 输入、function calling、结构化 JSON 输出,针对低延迟与高吞吐优化。Gemini 2.5 Flash Lite API 兼容 OpenAI:现有 SDK 指向 RouterBase、模型设为 gemini-2-5-flash-lite 即可。输入 $0.095 / 1M tokens,输出 $0.34 / 1M tokens,缓存读取 $0.0095 / 1M tokens —— 比官方公布价低 5%,全部通过一个 REST 接口完成。

Input
Gemini 2.5 Flash-Lite
max_tokens4096
temperature1
top_p1
presence_penalty0
frequency_penalty0
Gemini 2.5 Flash-Lite Online
Hi! I'm a helpful AI assistant. What can I do for you?

Gemini 2.5 Flash Lite API:对话

使用 Gemini 2.5 Flash Lite API 运行 Google 速度最快、性价比最高的 Gemini 2.5 模型,配备 1M token 上下文窗口与多模态输入。

Gemini 2.5 Flash Lite API 是 Google 体积最小、性价比最高的 Gemini 2.5 模型——拥有 1M token 上下文窗口,原生支持文本、图像、音频、视频和 PDF 输入,支持 function calling 和结构化 JSON 输出,专为在规模化场景下实现最低延迟与最高吞吐量而调优。通过 RouterBase 接入,Gemini 2.5 Flash Lite API 完全兼容 OpenAI:将任意现有 SDK 指向 RouterBase 的基础 URL,把模型设为 gemini-2-5-flash-lite,首次调用即可立即生效。

定价为输入 $0.095 / 1M token、输出 $0.34 / 1M token、缓存输入读取 $0.0095 / 1M token——比官方公布价低 5%。一把 RouterBase 密钥——无需 Google 凭证。

为何选择此模型

团队选择 Gemini 2.5 Flash Lite API 上线的六大理由

从 1M token 上下文到立减 5% 的定价——看看 Gemini 2.5 Flash Lite API 出众之处。

1M token 上下文

每次请求最多接受 100 万 token——长文档、多文件代码或视频转录稿都能在一次 Gemini 2.5 Flash Lite API 调用中完整处理,无需分块。

最快、最便宜的 2.5 档位

专为大批量工作负载打造:Gemini 2.5 Flash Lite API 是成本最低的 Gemini 2.5 模型,输入仅 $0.095 / 1M token——非常适合规模化的分类、摘要、抽取和路由任务。

原生多模态输入

Gemini 2.5 Flash Lite API 能理解文本、图像、音频、视频和 PDF。在一次请求中传入混合媒体,即可跨模态分析、转录或推理。

Function calling 与 JSON

定义工具并请求 JSON schema;Gemini 2.5 Flash Lite API 会返回结构化的工具调用和严格有效的 JSON,为可靠的智能体与抽取流水线服务。

兼容 OpenAI 的端点

Gemini 2.5 Flash Lite API 采用 OpenAI chat-completions 通信格式。将任意 OpenAI SDK 指向 RouterBase——无需 Google SDK 或单独凭证。

一把密钥畅用 200+ 模型

调用 Gemini 2.5 Flash Lite API 的同一把 RouterBase 密钥也能路由到 GPT-5、Claude Opus 4.8、Gemini 2.5 Pro 及 200+ 其他模型——无需逐个管理服务商凭证。

RouterBase dashboard preview
快速开始

3 步上手 Gemini 2.5 Flash Lite API

从注册到收到首个响应,不到 5 分钟。

  1. 创建 RouterBase API 密钥

    注册并生成 API 密钥——一把密钥即可访问 Gemini 2.5 Flash Lite API 及目录中的所有其他模型。

  2. 发送第一条消息

    将任意兼容 OpenAI 的 SDK 指向 routerbase.com/v1,并把模型设为 gemini-2-5-flash-lite。响应遵循标准的 chat-completions schema——支持流式与多模态输入。

  3. 查看用量

    每个响应都包含详细的 token 明细——输入、输出和缓存读取 token——让每次调用的成本与缓存命中率一目了然。

定价

按使用量付费

RouterBase 透传合作方价格,与模型官方公开 API 价格对比。

客户故事

团队用 Gemini 2.5 Flash Lite API 构建什么

运行在 Gemini 2.5 Flash Lite API 与 RouterBase 模型目录上的真实生产负载。

Marcus Reyes
Marcus ReyesCTO, Paradigm AI

我们把 90% 的流量都通过 Gemini 2.5 Flash Lite API 路由——分类和抽取的成本只是零头。RouterBase 立减 5% 是纯利润。

Priya Lakshmi
Priya LakshmiFounder, Quillo

Gemini 2.5 Flash Lite API 上的原生多模态可直接读取图像和音频——一次又快又便宜的调用就能同时生成字幕和转录。

Thomas Beck
Thomas BeckStaff Engineer, Northbeam

Gemini 2.5 Flash Lite API 的结构化 JSON 输出干掉了我们时灵时不灵的正则解析。每次都是严格有效的 JSON,零重试。

Aoi Tanaka
Aoi TanakaML Lead, Daybreak Robotics

以我们的量级,Flash-Lite 是唯一算得过账的 Gemini 2.5 模型。RouterBase 还让它再便宜 5%。

Jonas Keller
Jonas KellerIndie Developer

Gemini 2.5 Flash Lite API 撑起了我那个大批量摘要循环。便宜到我都懒得数 token 了。

Ethan Nguyen
Ethan NguyenHead of Engineering, Compound Studio

RouterBase 把 Gemini 2.5 Flash Lite API 和 200+ 其他模型放到一把密钥后面。我们团队再也不用申请新的服务商账号了。

Sophia Martín
Sophia MartínCTO, Relay

我们按请求把 Gemini 2.5 Flash Lite API 和 Gemini 2.5 Pro 做 A/B——同一 SDK,只换一个 model 字段。大部分流量留在 Flash-Lite 上,账单降了 70%。

Lucas Fernandes
Lucas FernandesEngineering Manager, Light

我们一个周末就把 42 个服务迁到了 Gemini 2.5 Flash Lite API。唯一的 PR 评论是“等等,就这?”。

David Okonkwo
David OkonkwoCo-founder, Figment

在 $0.095 / 1M 输入再减 5% 的价格下,Gemini 2.5 Flash Lite API 让我们的大批量功能真正实现了盈利。ROI 一目了然。

常见问题

关于 Gemini 2.5 Flash Lite API 的常见问题。

它是 RouterBase 对 Google Gemini 2.5 Flash-Lite 的直通接口——速度最快、最便宜的 Gemini 2.5 对话端点,拥有 1M token 上下文、原生视觉/音频/视频输入、function calling 和结构化输出,通过兼容 OpenAI 的 REST 接口提供。