我们通过 Gemini 3.5 Flash API 路由大流量对话——大规模的快速多模态响应,而 RouterBase 5% 的折扣纯属利润。
Gemini 3.5 Flash API 是 Google 快速、高效的多模态模型 —— 100 万 token 上下文、原生支持文本/图像/音频/视频/PDF 输入、function calling、结构化 JSON 输出,针对低延迟与高吞吐优化。Gemini 3.5 Flash API 兼容 OpenAI:现有 SDK 指向 RouterBase、模型设为 gemini-3-5-flash 即可。输入 $1.05 / 1M tokens,输出 $6.30 / 1M tokens,缓存读取 $0.105 / 1M tokens —— 比标准价低 5%,全部通过一个 REST 接口完成。
Gemini 3.5 Flash API:对话
使用 Gemini 3.5 Flash API 运行 Google 快速、高效的多模态模型,支持 1M token 上下文窗口。
Gemini 3.5 Flash API 是 Google 速度优化的多模态模型——拥有 1M token 上下文窗口,原生支持文本、图像、音频、视频和 PDF 输入,支持 function calling 和结构化 JSON 输出,专为低延迟、高吞吐量调优。通过 RouterBase 路由后,它完全兼容 OpenAI:将任何现有 SDK 指向 RouterBase 的基础 URL,将模型设为 gemini-3-5-flash,首次调用即刻生效。
定价为输入 token $1.05 / 1M、输出 token $6.30 / 1M、缓存输入读取 $0.105 / 1M——比标准费率低 5%。一个 RouterBase 密钥——无需 Google 凭证。
团队基于 Gemini 3.5 Flash API 上线的六大理由
从快速多模态推理到 5% 折扣定价——Gemini 3.5 Flash 脱颖而出的原因。
1M token 上下文
每次请求最多接受 100 万 token——长文档、多文件代码或视频转录都能装进一次 Gemini 3.5 Flash API 调用。
原生多模态输入
Gemini 3.5 Flash API 能理解文本、图像、音频、视频和 PDF。在一次请求中传入混合媒体,即可跨模态分析、转录或推理。
快速且高吞吐
专为低延迟、大流量调优:Gemini 3.5 Flash API 以 Flash 级速度大规模支撑对话、分类、抽取和路由。
function calling 与 JSON
定义工具并请求 JSON schema;Gemini 3.5 Flash API 返回结构化的工具调用和严格有效的 JSON,为可靠的智能体和抽取流水线服务。
兼容 OpenAI 的端点
Gemini 3.5 Flash API 使用 OpenAI 对话补全协议格式。将任何 OpenAI SDK 指向 RouterBase——无需 Google SDK 或单独凭证。
一个密钥畅通 200+ 模型
调用 Gemini 3.5 Flash API 的同一个 RouterBase 密钥,也能路由到 GPT-5、Claude Opus 4.8、GPT-4o mini 及 200+ 其他模型——无需逐个管理各家凭证。

三步开始使用 Gemini 3.5 Flash API
从注册到首个响应,不到 5 分钟。
创建 RouterBase API 密钥
注册并生成 API 密钥——一个密钥即可触达 Gemini 3.5 Flash API 以及目录中的每一个模型。
发送你的第一条消息
将任何兼容 OpenAI 的 SDK 指向 routerbase.com/v1,将模型设为 gemini-3-5-flash。响应遵循标准的对话补全 schema——支持流式传输和多模态输入。
查看用量
每个响应都包含详细的 token 明细——输入、输出和缓存读取 token——让每次调用的成本与缓存命中率一目了然。
按使用量付费
RouterBase 透传合作方价格,与模型官方公开 API 价格对比。
团队用 Gemini 3.5 Flash API 构建了什么
真实的生产负载,运行在 Gemini 3.5 Flash API 和 RouterBase 模型目录之上。
Gemini 3.5 Flash API 上的原生视觉替换了一整套 OCR 流水线——一次快速调用就把文本和图像一起配文并抽取。
Gemini 3.5 Flash API 的结构化 JSON 输出终结了我们不稳定的解析——每次都是严格有效的 JSON,即便是多模态输入也不例外。
Gemini 3.5 Flash API 的 Flash 级延迟让我们把分类搬到了在线处理。RouterBase 还让它再便宜 5%。
Gemini 3.5 Flash API 的 1M 上下文意味着我能把整份文档丢给它,仍然得到快速回答。不用写分块胶水代码。
RouterBase 把 Gemini 3.5 Flash API 和 200+ 其他模型统一在一个密钥背后。我们团队不用再为新的供应商账号提工单了。
我们按请求对 Gemini 3.5 Flash API 与 Pro 做 A/B 测试——同一个 SDK,只改一个模型字段。大部分流量留在 Flash 上,延迟也下降了。
我们一个周末就把 42 个服务迁移到了 Gemini 3.5 Flash API。唯一一条 PR 评论是「等等,就这么简单?」。
Gemini 3.5 Flash API 上 $0.105 / 1M 的缓存读取让我们的长上下文功能变得划算。ROI 的账一算就清楚了。
常见问题
关于 Gemini 3.5 Flash API 的常见问题。
它是 RouterBase 对 Google Gemini 3.5 Flash 的透传——一个快速、高效的多模态对话端点,具备 1M token 上下文、原生视觉/音频/视频输入、function calling 和结构化输出,通过兼容 OpenAI 的 REST 接口提供。