chat.gemini_3_flash_preview
google/gemini-3-flash-preview

Gemini 3 Flash(预览)API 是 Google 快速、低成本的多模态模型 —— 100 万 token 上下文、原生支持文本/图像/音频/视频/PDF 输入、推理、function calling、结构化 JSON 输出。Gemini 3 Flash Preview API 兼容 OpenAI:现有 SDK 指向 RouterBase、模型设为 gemini-3-flash-preview 即可。输入 $0.475 / 1M tokens,输出 $2.85 / 1M tokens,缓存读取 $0.0475 / 1M tokens —— 全部通过一个 REST 接口完成。

Input
Gemini 3 Flash (Preview)
max_tokens4096
temperature1
top_p1
presence_penalty0
frequency_penalty0
Gemini 3 Flash (Preview) Online
Hi! I'm a helpful AI assistant. What can I do for you?

Gemini 3 Flash Preview API:对话

使用 Gemini 3 Flash Preview API 运行 Google 快速、低成本的 Gemini 3 多模态模型——1M token 上下文、原生视觉/音频/视频输入与结构化输出。

Gemini 3 Flash Preview API 是 Google 快速、高性价比的 Gemini 3 多模态模型——拥有 1M token 上下文窗口,原生支持文本、图像、音频、视频和 PDF 输入,支持 function calling 和结构化 JSON 输出,专为低延迟和高吞吐量调优。通过 RouterBase 路由,Gemini 3 Flash Preview API 完全兼容 OpenAI:将任何现有 SDK 指向 RouterBase 的 base URL,把模型设为 gemini-3-flash-preview,首次 Gemini 3 Flash Preview API 调用即刻通过。

Gemini 3 Flash Preview API 的定价为每 1M 输入 token $0.475、每 1M 输出 token $2.85、每 1M 缓存输入读取 $0.0475——比官方公布价低 5%。一把 RouterBase 密钥——无需 Google 凭据。

为何选择此模型

团队选择 Gemini 3 Flash Preview API 上线的六大理由

从最新一代的速度到立减 5% 的定价——看 Gemini 3 Flash Preview API 何以脱颖而出。

快速、均衡的 Gemini 3

Gemini 3 Flash Preview API 是 Google 最新一代的主力模型——在 Gemini 3 家族中兼顾速度、质量与成本的最佳平衡。

1M token 上下文

每次请求最多接受 100 万 token——长文档、多文件代码或视频转录都能装进一次 Gemini 3 Flash Preview API 调用,无需分块。

原生多模态输入

Gemini 3 Flash Preview API 能理解文本、图像、音频、视频和 PDF。在一次请求中传入混合媒体,跨模态分析、转录或推理。

function calling 与 JSON

定义工具并请求 JSON schema;Gemini 3 Flash Preview API 返回结构化工具调用和严格有效的 JSON,为可靠的智能体和提取流水线服务。

兼容 OpenAI 的端点

Gemini 3 Flash Preview API 使用 OpenAI chat-completions 传输格式。将任何 OpenAI SDK 指向 RouterBase——无需 Google SDK 或单独凭据。

一把密钥,200+ 模型

调用 Gemini 3 Flash Preview API 的同一把 RouterBase 密钥,也可路由到 GPT-5、Claude Opus 4.8、Gemini 3 Pro 等 200+ 模型——无需逐家管理凭据。

RouterBase dashboard preview
快速上手

三步开始使用 Gemini 3 Flash Preview API

从注册到首个响应,不到 5 分钟。

  1. 创建 RouterBase API 密钥

    注册并生成 API 密钥——一把密钥即可访问 Gemini 3 Flash Preview API 以及目录中的所有其他模型。

  2. 发送你的第一条消息

    将任何兼容 OpenAI 的 SDK 指向 routerbase.com/v1,并把模型设为 gemini-3-flash-preview。Gemini 3 Flash Preview API 的响应遵循标准 chat-completions schema——支持流式传输和多模态输入。

  3. 查看用量

    每个 Gemini 3 Flash Preview API 响应都包含详细的 token 明细——输入、输出和缓存读取 token——让每次调用的成本和缓存命中率一目了然。

定价

按使用量付费

RouterBase 透传合作方价格,与模型官方公开 API 价格对比。

客户故事

团队用 Gemini 3 Flash Preview API 构建什么

在 Gemini 3 Flash Preview API 和 RouterBase 模型目录上运行的真实生产负载。

Marcus Reyes
Marcus ReyesCTO, Paradigm AI

Gemini 3 Flash Preview API 是我们的日常默认选择——最新一代品质,快速,而且便宜到大多数调用都无需动用旗舰模型。RouterBase 的 5% 折扣纯属利润。

Priya Lakshmi
Priya LakshmiFounder, Quillo

Gemini 3 Flash Preview API 的原生多模态能直接读取视频和音频——一次快速调用就能同时转录并对内容进行推理。

Thomas Beck
Thomas BeckStaff Engineer, Northbeam

Gemini 3 Flash Preview API 的结构化 JSON 输出终结了我们脆弱的正则解析。每次都是严格有效的 JSON,零重试。

Aoi Tanaka
Aoi TanakaML Lead, Daybreak Robotics

我们把分类和路由迁移到 Gemini 3 Flash Preview API,延迟下降,质量却提升了。RouterBase 让它便宜 5%,并自动绕过故障。

Jonas Keller
Jonas KellerIndie Developer

以 Flash 的价格享有 1M token 上下文,意味着我能廉价地把整份文档丢给它。Gemini 3 Flash Preview API 处理起来又快又轻松。

Ethan Nguyen
Ethan NguyenHead of Engineering, Compound Studio

RouterBase 把 Gemini 3 Flash Preview API 和 200+ 其他模型放在一把密钥之后。我们团队不再为新的供应商账号提交申请。

Sophia Martín
Sophia MartínCTO, Relay

我们按请求把 Gemini 3 Flash Preview API 与 3 Pro 做 A/B——同一 SDK,一个模型字段。大部分流量留在 Flash,账单大幅下降。

Lucas Fernandes
Lucas FernandesEngineering Manager, Light

我们用一个周末就把高吞吐量端点路由到 Gemini 3 Flash Preview API。PR 上唯一的评论是『等等,就这么简单?』。

David Okonkwo
David OkonkwoCo-founder, Figment

以每 1M 输入 $0.475 再减 5%,Gemini 3 Flash Preview API 让我们以可规模化的价格获得最新一代多模态推理。ROI 一算即明。

常见问题

关于 Gemini 3 Flash Preview API 的常见问题。

它是 RouterBase 对 Google Gemini 3 Flash (Preview) 的透传——Google 快速、高性价比的 Gemini 3 模型,拥有 1M token 上下文、原生视觉/音频/视频输入、function calling 和结构化输出,通过兼容 OpenAI 的 REST 接口提供服务。