我们把 90% 的流量都通过 Gemini 2.5 Flash Lite API 路由——分类和抽取的成本只是零头。RouterBase 立减 5% 是纯利润。
Gemini 2.5 Flash Lite API 是 Google 速度最快、性价比最高的 Gemini 2.5 模型 —— 100 万 token 上下文、原生支持文本/图像/音频/视频/PDF 输入、function calling、结构化 JSON 输出,针对低延迟与高吞吐优化。Gemini 2.5 Flash Lite API 兼容 OpenAI:现有 SDK 指向 RouterBase、模型设为 gemini-2-5-flash-lite 即可。输入 $0.095 / 1M tokens,输出 $0.34 / 1M tokens,缓存读取 $0.0095 / 1M tokens —— 比官方公布价低 5%,全部通过一个 REST 接口完成。
Gemini 2.5 Flash Lite API:对话
使用 Gemini 2.5 Flash Lite API 运行 Google 速度最快、性价比最高的 Gemini 2.5 模型,配备 1M token 上下文窗口与多模态输入。
Gemini 2.5 Flash Lite API 是 Google 体积最小、性价比最高的 Gemini 2.5 模型——拥有 1M token 上下文窗口,原生支持文本、图像、音频、视频和 PDF 输入,支持 function calling 和结构化 JSON 输出,专为在规模化场景下实现最低延迟与最高吞吐量而调优。通过 RouterBase 接入,Gemini 2.5 Flash Lite API 完全兼容 OpenAI:将任意现有 SDK 指向 RouterBase 的基础 URL,把模型设为 gemini-2-5-flash-lite,首次调用即可立即生效。
定价为输入 $0.095 / 1M token、输出 $0.34 / 1M token、缓存输入读取 $0.0095 / 1M token——比官方公布价低 5%。一把 RouterBase 密钥——无需 Google 凭证。
团队选择 Gemini 2.5 Flash Lite API 上线的六大理由
从 1M token 上下文到立减 5% 的定价——看看 Gemini 2.5 Flash Lite API 出众之处。
1M token 上下文
每次请求最多接受 100 万 token——长文档、多文件代码或视频转录稿都能在一次 Gemini 2.5 Flash Lite API 调用中完整处理,无需分块。
最快、最便宜的 2.5 档位
专为大批量工作负载打造:Gemini 2.5 Flash Lite API 是成本最低的 Gemini 2.5 模型,输入仅 $0.095 / 1M token——非常适合规模化的分类、摘要、抽取和路由任务。
原生多模态输入
Gemini 2.5 Flash Lite API 能理解文本、图像、音频、视频和 PDF。在一次请求中传入混合媒体,即可跨模态分析、转录或推理。
Function calling 与 JSON
定义工具并请求 JSON schema;Gemini 2.5 Flash Lite API 会返回结构化的工具调用和严格有效的 JSON,为可靠的智能体与抽取流水线服务。
兼容 OpenAI 的端点
Gemini 2.5 Flash Lite API 采用 OpenAI chat-completions 通信格式。将任意 OpenAI SDK 指向 RouterBase——无需 Google SDK 或单独凭证。
一把密钥畅用 200+ 模型
调用 Gemini 2.5 Flash Lite API 的同一把 RouterBase 密钥也能路由到 GPT-5、Claude Opus 4.8、Gemini 2.5 Pro 及 200+ 其他模型——无需逐个管理服务商凭证。

3 步上手 Gemini 2.5 Flash Lite API
从注册到收到首个响应,不到 5 分钟。
创建 RouterBase API 密钥
注册并生成 API 密钥——一把密钥即可访问 Gemini 2.5 Flash Lite API 及目录中的所有其他模型。
发送第一条消息
将任意兼容 OpenAI 的 SDK 指向 routerbase.com/v1,并把模型设为 gemini-2-5-flash-lite。响应遵循标准的 chat-completions schema——支持流式与多模态输入。
查看用量
每个响应都包含详细的 token 明细——输入、输出和缓存读取 token——让每次调用的成本与缓存命中率一目了然。
按使用量付费
RouterBase 透传合作方价格,与模型官方公开 API 价格对比。
团队用 Gemini 2.5 Flash Lite API 构建什么
运行在 Gemini 2.5 Flash Lite API 与 RouterBase 模型目录上的真实生产负载。
Gemini 2.5 Flash Lite API 上的原生多模态可直接读取图像和音频——一次又快又便宜的调用就能同时生成字幕和转录。
Gemini 2.5 Flash Lite API 的结构化 JSON 输出干掉了我们时灵时不灵的正则解析。每次都是严格有效的 JSON,零重试。
以我们的量级,Flash-Lite 是唯一算得过账的 Gemini 2.5 模型。RouterBase 还让它再便宜 5%。
Gemini 2.5 Flash Lite API 撑起了我那个大批量摘要循环。便宜到我都懒得数 token 了。
RouterBase 把 Gemini 2.5 Flash Lite API 和 200+ 其他模型放到一把密钥后面。我们团队再也不用申请新的服务商账号了。
我们按请求把 Gemini 2.5 Flash Lite API 和 Gemini 2.5 Pro 做 A/B——同一 SDK,只换一个 model 字段。大部分流量留在 Flash-Lite 上,账单降了 70%。
我们一个周末就把 42 个服务迁到了 Gemini 2.5 Flash Lite API。唯一的 PR 评论是“等等,就这?”。
在 $0.095 / 1M 输入再减 5% 的价格下,Gemini 2.5 Flash Lite API 让我们的大批量功能真正实现了盈利。ROI 一目了然。
常见问题
关于 Gemini 2.5 Flash Lite API 的常见问题。
它是 RouterBase 对 Google Gemini 2.5 Flash-Lite 的直通接口——速度最快、最便宜的 Gemini 2.5 对话端点,拥有 1M token 上下文、原生视觉/音频/视频输入、function calling 和结构化输出,通过兼容 OpenAI 的 REST 接口提供。