
OpenAI
GPT-5.4
起 $1.00 每 1M tokens
Gemini 3.6 Flash 是 Google 最新的 Stable 版 Gemini 3 模型,定位是在速度与智能之间取得平衡,覆盖 agent 与多模态任务。Gemini 3.6 Flash 可将文本、图片、视频、音频和 PDF 一并读入 1,048,576 token 的上下文窗口,单次最多输出 65,536 token,并支持思考、函数调用与 Google 搜索接地。在 reAPI 上,Gemini 3.6 Flash 的输入与输出单价都比 Google 公布的 Standard 费率低 20%。
可以用这个模型构建并上线的真实工作流与生产级用例。

PDF 是 Gemini 3.6 Flash 的一等输入,而不是你要自己维护的预处理步骤。配合 1,048,576 token 的上下文窗口,一整套合同、一批研究资料或一年的报告可以一次送入并交叉比对返回。Gemini 3.6 Flash 同一条消息里还能带图片、视频和音频,所以文档评审可以连同附带的截图与录音一起做。实际收益是:那些只为绕开小上下文而存在的检索层,可以删掉了。
阅读 API 文档
Gemini 3.6 Flash 支持函数调用、代码执行与文件检索,Google 另将 computer use 标注为预览版支持。搜索接地与 Google 地图接地都在支持列表内,因此 Gemini 3.6 Flash 可以依据当前来源回答而不是只靠训练数据,URL context 还允许你直接指定要读的页面。思考能力同样支持,这正是多步计划能在工具调用之间延续下来的原因。这套组合让 Gemini 3.6 Flash 可以充当 agent 的推理核心,而不只是一个文本生成器。

多数生成式负载的成本由输出 token 主导,而思考 token 计入输出。Gemini 3.6 Flash 在输入单价相同的情况下,公布的输出单价低于 Gemini 3.5 Flash;在 reAPI 上两个维度都比 Google 公布的 Standard 费率低 20%。对于成天在跑的摘要集群、分类管线和 agent 循环,这就是真正影响月度账单的数字。而 Gemini 3.6 Flash 在此期间仍保有同样的百万 token 窗口——便宜不等于变小。
积分计费 — 1 积分 = 0.001 美元,仅为成功生成付费。
| 类别 | 单位 | 价格 |
|---|---|---|
| Token 计价 | ||
| 输入 | 1M tokens | $1.2 |
| 输出 | 1M tokens | $6 |
Google 为 Gemini 3.6 Flash 公布了 Standard 的输入与输出费率。在 reAPI 上,Gemini 3.6 Flash 按其中的 80% 计费——输入和输出各让 20%,底下没有订阅,也没有最低消费承诺。按量以美元从网关余额扣减。
Gemini 3.6 Flash 由 OpenAI 兼容的 `/v1/chat/completions` 端点提供。如果你的代码已经在讲这套形状,接入 Gemini 3.6 Flash 就是换一个 base URL、一个 key 和一个 model 字符串。若你更习惯 Google 自己的请求格式,网关同时为该模型提供原生 Gemini 端点类型。
调用 Gemini 3.6 Flash 的那把 api.reapi.ai key,同样能调用 GPT 与 Claude 系列。换模型做质量对比,或在某家供应商状态不好时切换,都只是改一个 model 字符串,而不是再做一套集成、再对一份账单、再管一套凭证。
这组对比的诚实版本很短:在 Google 公布的每一个维度上,Gemini 3.6 Flash 与 Gemini 3.5 Flash 的表面完全一致——上限一致、输入一致、能力清单一致、消费选项一致。Gemini 3.6 Flash 是价格与定位的变化,不是能力升级。所以如果你在两者之间选择,真正的决策输入是输出费率和版本新旧。
对比依据撰写时 Google 自有模型页与定价页上记录的行为。费率以相对关系而非具体金额表述;Gemini 3.6 Flash 的实时数字见上方定价表。
到 api.reapi.ai 注册,打开控制台生成 API key。这一把 key 就能触达 Gemini 3.6 Flash 以及网关上的其他模型,从同一份余额扣费。
打开把 base URL 设为 api.reapi.ai,key 换成刚创建的那把。任何已经支持 OpenAI Chat Completions 的客户端都无需改动——接 Gemini 3.6 Flash 不用换 SDK。
打开把 model 字段设为 `gemini-3.6-flash` 再发送 messages。交互式场景开启流式;想让 Gemini 3.6 Flash 用满 65,536 token 的输出上限时,把 max tokens 调高。
打开关于此模型的常见疑问。