chat.gemini_3_5_flash
google/gemini-3-5-flash

Gemini 3.5 Flash API 是 Google 快速、高效的多模态模型 —— 100 万 token 上下文、原生支持文本/图像/音频/视频/PDF 输入、function calling、结构化 JSON 输出,针对低延迟与高吞吐优化。Gemini 3.5 Flash API 兼容 OpenAI:现有 SDK 指向 RouterBase、模型设为 gemini-3-5-flash 即可。输入 $1.05 / 1M tokens,输出 $6.30 / 1M tokens,缓存读取 $0.105 / 1M tokens —— 比标准价低 5%,全部通过一个 REST 接口完成。

Input
Gemini 3.5 Flash
max_tokens4096
temperature1
top_p1
presence_penalty0
frequency_penalty0
Gemini 3.5 Flash Online
Hi! I'm a helpful AI assistant. What can I do for you?

Gemini 3.5 Flash API:对话

使用 Gemini 3.5 Flash API 运行 Google 快速、高效的多模态模型,支持 1M token 上下文窗口。

Gemini 3.5 Flash API 是 Google 速度优化的多模态模型——拥有 1M token 上下文窗口,原生支持文本、图像、音频、视频和 PDF 输入,支持 function calling 和结构化 JSON 输出,专为低延迟、高吞吐量调优。通过 RouterBase 路由后,它完全兼容 OpenAI:将任何现有 SDK 指向 RouterBase 的基础 URL,将模型设为 gemini-3-5-flash,首次调用即刻生效。

定价为输入 token $1.05 / 1M、输出 token $6.30 / 1M、缓存输入读取 $0.105 / 1M——比标准费率低 5%。一个 RouterBase 密钥——无需 Google 凭证。

为何选择此模型

团队基于 Gemini 3.5 Flash API 上线的六大理由

从快速多模态推理到 5% 折扣定价——Gemini 3.5 Flash 脱颖而出的原因。

1M token 上下文

每次请求最多接受 100 万 token——长文档、多文件代码或视频转录都能装进一次 Gemini 3.5 Flash API 调用。

原生多模态输入

Gemini 3.5 Flash API 能理解文本、图像、音频、视频和 PDF。在一次请求中传入混合媒体,即可跨模态分析、转录或推理。

快速且高吞吐

专为低延迟、大流量调优:Gemini 3.5 Flash API 以 Flash 级速度大规模支撑对话、分类、抽取和路由。

function calling 与 JSON

定义工具并请求 JSON schema;Gemini 3.5 Flash API 返回结构化的工具调用和严格有效的 JSON,为可靠的智能体和抽取流水线服务。

兼容 OpenAI 的端点

Gemini 3.5 Flash API 使用 OpenAI 对话补全协议格式。将任何 OpenAI SDK 指向 RouterBase——无需 Google SDK 或单独凭证。

一个密钥畅通 200+ 模型

调用 Gemini 3.5 Flash API 的同一个 RouterBase 密钥,也能路由到 GPT-5、Claude Opus 4.8、GPT-4o mini 及 200+ 其他模型——无需逐个管理各家凭证。

RouterBase dashboard preview
快速上手

三步开始使用 Gemini 3.5 Flash API

从注册到首个响应,不到 5 分钟。

  1. 创建 RouterBase API 密钥

    注册并生成 API 密钥——一个密钥即可触达 Gemini 3.5 Flash API 以及目录中的每一个模型。

  2. 发送你的第一条消息

    将任何兼容 OpenAI 的 SDK 指向 routerbase.com/v1,将模型设为 gemini-3-5-flash。响应遵循标准的对话补全 schema——支持流式传输和多模态输入。

  3. 查看用量

    每个响应都包含详细的 token 明细——输入、输出和缓存读取 token——让每次调用的成本与缓存命中率一目了然。

定价

按使用量付费

RouterBase 透传合作方价格,与模型官方公开 API 价格对比。

客户故事

团队用 Gemini 3.5 Flash API 构建了什么

真实的生产负载,运行在 Gemini 3.5 Flash API 和 RouterBase 模型目录之上。

Marcus Reyes
Marcus ReyesCTO, Paradigm AI

我们通过 Gemini 3.5 Flash API 路由大流量对话——大规模的快速多模态响应,而 RouterBase 5% 的折扣纯属利润。

Priya Lakshmi
Priya LakshmiFounder, Quillo

Gemini 3.5 Flash API 上的原生视觉替换了一整套 OCR 流水线——一次快速调用就把文本和图像一起配文并抽取。

Thomas Beck
Thomas BeckStaff Engineer, Northbeam

Gemini 3.5 Flash API 的结构化 JSON 输出终结了我们不稳定的解析——每次都是严格有效的 JSON,即便是多模态输入也不例外。

Aoi Tanaka
Aoi TanakaML Lead, Daybreak Robotics

Gemini 3.5 Flash API 的 Flash 级延迟让我们把分类搬到了在线处理。RouterBase 还让它再便宜 5%。

Jonas Keller
Jonas KellerIndie Developer

Gemini 3.5 Flash API 的 1M 上下文意味着我能把整份文档丢给它,仍然得到快速回答。不用写分块胶水代码。

Ethan Nguyen
Ethan NguyenHead of Engineering, Compound Studio

RouterBase 把 Gemini 3.5 Flash API 和 200+ 其他模型统一在一个密钥背后。我们团队不用再为新的供应商账号提工单了。

Sophia Martín
Sophia MartínCTO, Relay

我们按请求对 Gemini 3.5 Flash API 与 Pro 做 A/B 测试——同一个 SDK,只改一个模型字段。大部分流量留在 Flash 上,延迟也下降了。

Lucas Fernandes
Lucas FernandesEngineering Manager, Light

我们一个周末就把 42 个服务迁移到了 Gemini 3.5 Flash API。唯一一条 PR 评论是「等等,就这么简单?」。

David Okonkwo
David OkonkwoCo-founder, Figment

Gemini 3.5 Flash API 上 $0.105 / 1M 的缓存读取让我们的长上下文功能变得划算。ROI 的账一算就清楚了。

常见问题

关于 Gemini 3.5 Flash API 的常见问题。

它是 RouterBase 对 Google Gemini 3.5 Flash 的透传——一个快速、高效的多模态对话端点,具备 1M token 上下文、原生视觉/音频/视频输入、function calling 和结构化输出,通过兼容 OpenAI 的 REST 接口提供。