Gemini 3 Flash Preview API 是我们的日常默认选择——最新一代品质,快速,而且便宜到大多数调用都无需动用旗舰模型。RouterBase 的 5% 折扣纯属利润。
Gemini 3 Flash(预览)API 是 Google 快速、低成本的多模态模型 —— 100 万 token 上下文、原生支持文本/图像/音频/视频/PDF 输入、推理、function calling、结构化 JSON 输出。Gemini 3 Flash Preview API 兼容 OpenAI:现有 SDK 指向 RouterBase、模型设为 gemini-3-flash-preview 即可。输入 $0.475 / 1M tokens,输出 $2.85 / 1M tokens,缓存读取 $0.0475 / 1M tokens —— 全部通过一个 REST 接口完成。
Gemini 3 Flash Preview API:对话
使用 Gemini 3 Flash Preview API 运行 Google 快速、低成本的 Gemini 3 多模态模型——1M token 上下文、原生视觉/音频/视频输入与结构化输出。
Gemini 3 Flash Preview API 是 Google 快速、高性价比的 Gemini 3 多模态模型——拥有 1M token 上下文窗口,原生支持文本、图像、音频、视频和 PDF 输入,支持 function calling 和结构化 JSON 输出,专为低延迟和高吞吐量调优。通过 RouterBase 路由,Gemini 3 Flash Preview API 完全兼容 OpenAI:将任何现有 SDK 指向 RouterBase 的 base URL,把模型设为 gemini-3-flash-preview,首次 Gemini 3 Flash Preview API 调用即刻通过。
Gemini 3 Flash Preview API 的定价为每 1M 输入 token $0.475、每 1M 输出 token $2.85、每 1M 缓存输入读取 $0.0475——比官方公布价低 5%。一把 RouterBase 密钥——无需 Google 凭据。
团队选择 Gemini 3 Flash Preview API 上线的六大理由
从最新一代的速度到立减 5% 的定价——看 Gemini 3 Flash Preview API 何以脱颖而出。
快速、均衡的 Gemini 3
Gemini 3 Flash Preview API 是 Google 最新一代的主力模型——在 Gemini 3 家族中兼顾速度、质量与成本的最佳平衡。
1M token 上下文
每次请求最多接受 100 万 token——长文档、多文件代码或视频转录都能装进一次 Gemini 3 Flash Preview API 调用,无需分块。
原生多模态输入
Gemini 3 Flash Preview API 能理解文本、图像、音频、视频和 PDF。在一次请求中传入混合媒体,跨模态分析、转录或推理。
function calling 与 JSON
定义工具并请求 JSON schema;Gemini 3 Flash Preview API 返回结构化工具调用和严格有效的 JSON,为可靠的智能体和提取流水线服务。
兼容 OpenAI 的端点
Gemini 3 Flash Preview API 使用 OpenAI chat-completions 传输格式。将任何 OpenAI SDK 指向 RouterBase——无需 Google SDK 或单独凭据。
一把密钥,200+ 模型
调用 Gemini 3 Flash Preview API 的同一把 RouterBase 密钥,也可路由到 GPT-5、Claude Opus 4.8、Gemini 3 Pro 等 200+ 模型——无需逐家管理凭据。

三步开始使用 Gemini 3 Flash Preview API
从注册到首个响应,不到 5 分钟。
创建 RouterBase API 密钥
注册并生成 API 密钥——一把密钥即可访问 Gemini 3 Flash Preview API 以及目录中的所有其他模型。
发送你的第一条消息
将任何兼容 OpenAI 的 SDK 指向 routerbase.com/v1,并把模型设为 gemini-3-flash-preview。Gemini 3 Flash Preview API 的响应遵循标准 chat-completions schema——支持流式传输和多模态输入。
查看用量
每个 Gemini 3 Flash Preview API 响应都包含详细的 token 明细——输入、输出和缓存读取 token——让每次调用的成本和缓存命中率一目了然。
按使用量付费
RouterBase 透传合作方价格,与模型官方公开 API 价格对比。
团队用 Gemini 3 Flash Preview API 构建什么
在 Gemini 3 Flash Preview API 和 RouterBase 模型目录上运行的真实生产负载。
Gemini 3 Flash Preview API 的原生多模态能直接读取视频和音频——一次快速调用就能同时转录并对内容进行推理。
Gemini 3 Flash Preview API 的结构化 JSON 输出终结了我们脆弱的正则解析。每次都是严格有效的 JSON,零重试。
我们把分类和路由迁移到 Gemini 3 Flash Preview API,延迟下降,质量却提升了。RouterBase 让它便宜 5%,并自动绕过故障。
以 Flash 的价格享有 1M token 上下文,意味着我能廉价地把整份文档丢给它。Gemini 3 Flash Preview API 处理起来又快又轻松。
RouterBase 把 Gemini 3 Flash Preview API 和 200+ 其他模型放在一把密钥之后。我们团队不再为新的供应商账号提交申请。
我们按请求把 Gemini 3 Flash Preview API 与 3 Pro 做 A/B——同一 SDK,一个模型字段。大部分流量留在 Flash,账单大幅下降。
我们用一个周末就把高吞吐量端点路由到 Gemini 3 Flash Preview API。PR 上唯一的评论是『等等,就这么简单?』。
以每 1M 输入 $0.475 再减 5%,Gemini 3 Flash Preview API 让我们以可规模化的价格获得最新一代多模态推理。ROI 一算即明。
常见问题
关于 Gemini 3 Flash Preview API 的常见问题。
它是 RouterBase 对 Google Gemini 3 Flash (Preview) 的透传——Google 快速、高性价比的 Gemini 3 模型,拥有 1M token 上下文、原生视觉/音频/视频输入、function calling 和结构化输出,通过兼容 OpenAI 的 REST 接口提供服务。