RH
RouterHub AI API 中转站导航与平台推荐
博客

Gemini 3.7 Flash API 已上线:模型名、价格期限与中转渠道核验清单

Gemini 3.7 Flash 已进入 Gemini API 的稳定模型列表。本文从准确模型 ID、官方价格、上下文与工具能力,以及中转渠道的可用性核验出发,整理一套适合开发者和 AI 编程代理用户的选择方法。

muchacha 2026-08-25 02:33:41

正文

如果你最近在给 AI 编程代理、代码审查任务或多步工作流换模型,可能已经看到 Gemini 3.7 Flash 的名字。真正需要确认的不是“它是不是新模型”,而是三个更实际的问题:API 里应该填什么模型名?现在看到的低价能持续多久?某个中转渠道展示了这个名字,是否真的支持相同的能力和参数?

截至 2026 年 8 月 25 日,Google 的 Gemini API 文档已经把 Gemini 3.7 Flash 列为稳定模型,模型 ID 为 gemini-3.7-flash。官方描述把它定位在复杂编码、Agent 工作流和多步执行场景;Gemini 3.6 Flash 则被列为上一代 Flash 模型。对需要调用 API 的用户来说,这次更新的重点不是简单地“旧模型换新模型”,而是模型目录、价格有效期和渠道能力都需要重新核对。

先确认:模型名不是宣传名

调用 Gemini API 时,优先以 API 文档中的 endpoint 映射为准,而不是以中转站首页的营销名称为准。官方模型列表当前给出的对应关系是:

展示名称 API 模型 ID 官方定位
Gemini 3.7 Flash gemini-3.7-flash 面向复杂编码、Agent 工作流和多步执行的最新 Flash 模型
Gemini 3.6 Flash gemini-3.6-flash 上一代 Flash,覆盖速度、多模态和日常 Agent 任务
Gemini 3.5 Flash gemini-3.5-flash 旧版 Flash,适合基础和高吞吐任务

这张表的实际用途是排查最常见的三类问题:

  1. 模型不存在:渠道仍展示旧的别名,API 实际只接受 gemini-3.7-flash。
  2. 能力不一致:渠道把 3.7 Flash 映射到其他版本,能返回文本不代表支持官方的工具调用、思考或多模态能力。
  3. 配置被静默替换:请求成功,但服务端把模型降级到 3.6 或其他 Flash 版本,导致代码任务表现、上下文限制和扣费都无法按预期判断。

因此,第一次接入新模型时,建议保存一次实际请求的模型字段、响应中的模型标识(如果服务端返回)和错误信息。仅凭“能返回 200”不足以证明渠道提供的是同一个模型。

官方价格:重点看有效期和输出 token

Google AI Developers 的价格页给出的 Gemini 3.7 Flash 付费价是按每 100 万 token 计算:

项目 2026 年 12 月 31 日前 2027 年 1 月 1 日起
输入 $0.75 / 1M tokens $1.50 / 1M tokens
输出(含 thinking tokens) $3.75 / 1M tokens $7.50 / 1M tokens
Context caching 读取 $0.075 / 1M tokens $0.15 / 1M tokens
Context caching 存储 $0.50 / 1M tokens·小时 $1.00 / 1M tokens·小时

这组数字至少说明两件事。

第一,不能只拿输入价比较“哪个渠道便宜”。Agent 和代码任务往往会产生较多输出,官方价格页明确把 thinking tokens 计入输出价格;如果渠道只展示输入倍率,最终账单可能与预估相差很大。

第二,2026 年的低价有明确时间边界。到 2027 年 1 月 1 日,表中的输入、输出和缓存价格都会上调。中转站如果在介绍中写“长期低价”,用户应继续追问:这是官方上游价格、渠道自己的价格、某个分组倍率,还是限时活动?这四者不能混为一谈。

可以用下面的简化公式先做预算:

预计成本 = 输入 token ÷ 1,000,000 × 输入单价
         + 输出 token ÷ 1,000,000 × 输出单价
         + 缓存读取/存储费用
         + 搜索 grounding、批处理或渠道附加费用

如果使用中转渠道,还要再核对它的分组倍率、最低充值、余额扣费规则、限额和活动有效期。官方 API 价格只是上游参考,不等于用户在某个渠道上的最终成本。

为什么 AI 编程代理要单独测试

Gemini 3.7 Flash 的官方定位明显偏向复杂编码和 Agent 工作流,但这不等于“所有编程代理配置都能直接使用”。代码代理通常不只发送一轮文本请求,还可能依赖:

  • function calling 或工具调用;
  • 多轮上下文和较长输入;
  • thinking 配置与思考 token;
  • 结构化输出;
  • 多模态输入;
  • 流式响应、重试和取消请求。

所以,接入中转渠道时,建议分三步做最小验证:

1. 基础文本请求

用固定、短输入确认 API Key、Base URL、模型 ID 和基础扣费都正常。把请求时间、HTTP 状态码、响应模型字段和实际扣费记录下来。

2. 工具调用请求

发送一个不会产生真实副作用的函数调用,例如读取一个虚拟文件或计算一个固定数值。重点检查工具 schema 是否被保留、参数是否被截断,以及服务端是否把 tool call 当成普通文本返回。

3. 长上下文与失败恢复

用脱敏后的长文本测试上下文限制,再故意触发一次超时或限流,观察错误码、重试建议和余额扣费。一次成功请求只能说明链路在当时可用,不能代表长期稳定性。

如果某渠道只支持基础文本,却把页面写成“完整支持 Gemini 3.7 Flash”,更准确的结论应是“可尝试基础调用,工具和 Agent 能力待验证”,而不是直接把它归类为完整支持。

选择中转渠道时,按证据而不是名称排序

面对同一个模型名,可以按以下顺序筛选:

检查项 需要看到的证据 不能直接推断的结论
模型可用性 实际模型列表、API 返回、最近验证时间 不能只因首页有模型卡片就认定可调用
价格 输入/输出/缓存分别标价,倍率和活动规则清楚 不能把官方价当成渠道最终价
能力覆盖 工具调用、思考、上下文、流式等测试结果 文本请求成功不等于 Agent 能力完整
稳定性 多次、不同时间段的成功与错误记录 一次成功或群聊反馈不等于长期稳定
退出成本 余额规则、最低充值、退款和 Key 管理说明 低倍率不等于总成本最低

RouterHub 上的模型与渠道目录适合用来缩小候选范围,但最终选择仍应回到自己的模型、任务和预算。尤其是新模型刚上线时,目录中的“支持”更适合作为发现线索;接入前还要查看渠道最近更新时间并做一次可重复的 smoke test。

给不同使用场景的建议

  • 个人测试或短期体验:优先选择能清楚展示模型 ID、输入/输出价格和最低充值的渠道,先用小额请求验证扣费。
  • AI 编程代理:把工具调用、思考 token、长上下文和错误恢复列为必测项,不要只测一句代码补全。
  • 多模型应用:把 gemini-3.7-flash 与旧版 Flash 分开登记,分别记录价格、能力和回退条件,避免服务端静默替换后无法定位问题。
  • 对成本敏感的批处理:先核对缓存、Batch 或其他离线能力是否在所用 API 和中转渠道中真实开放,再计算有效单价。

结论:先验证“这是不是你需要的 3.7 Flash”

Gemini 3.7 Flash 的更新值得关注,但它对 API 用户的影响不止是多了一个模型名。准确的模型 ID、thinking token 的计费、2027 年价格变化、工具调用能力和中转渠道的实际映射,都会影响最终体验和成本。

最稳妥的做法是:先用官方文档确认模型和价格,再在候选渠道做基础请求、工具调用和失败恢复三组测试,最后把验证时间和条件写进自己的渠道记录。这样即使后续模型版本、倍率或活动发生变化,也能快速判断是上游更新、渠道映射变化,还是配置本身出了问题。

参考来源

  1. Google AI for Developers,Gemini API 模型列表:https://ai.google.dev/gemini-api/docs/models
  2. Google AI for Developers,Gemini Developer API pricing:https://ai.google.dev/gemini-api/docs/pricing
  3. Google Cloud,Gemini 模型参考与 API 文档:https://cloud.google.com/vertex-ai/generative-ai/docs/model-reference/gemini
  4. Decrypt,Gemini 3.7 Flash 实测与发布信息:https://decrypt.co/375730/gemini-3-7-flash-review-google-cheap-model
  5. Google 官方模型与研究博客(Gemini 模型发布信息入口):https://blog.google/innovation-and-ai/models-and-research/

动态信息核验时间:2026 年 8 月 25 日。官方价格、模型列表和渠道可用性可能继续变化;本文不把任何单次请求结果视为长期稳定性证明。

相关阅读