RH
RouterHub AI API 中转站导航与平台推荐
博客

Gemini Omni Flash Preview 9月30日进入停用窗口:中转 API 迁移要核对什么

Gemini Omni Flash 的 Preview 与 GA 使用不同模型 ID,旧 Preview 计划于 2026 年 9 月 30 日停用。本文梳理请求迁移、视频能力、计价方式和中转渠道核验步骤,避免只改模型名却漏掉异步文件流程。

muchacha 2026-09-27 02:17:53

正文

Gemini Omni Flash Preview 9月30日进入停用窗口:中转 API 迁移要核对什么

如果你在 2026 年 6 月接入了 Gemini Omni Flash Preview,最近需要检查的不是“模型有没有更新”,而是你的请求是否还指向旧模型 ID。Google 的 Gemini API 更新记录显示,GA 版本已于 8 月 27 日发布,名称为 gemini-omni-1.1-flash;旧版 gemini-omni-flash-preview 计划于 9 月 30 日进入停用时间点。官方弃用表同时说明,表中日期是最早可能停用日期,具体时间以 Google 发出的通知为准。

这对使用 API 中转的开发者有两层影响:上游模型标识要切换;而中转渠道是否同步支持 GA 模型及其视频任务,则需要单独验证。文本模型能正常返回,不代表视频生成、编辑、文件轮询和结果下载也都可用。

核对时间:2026 年 9 月 27 日。下文上游模型、迁移日期与 Google 标价按当日公开的 Gemini API 文档核实;中转站的模型覆盖与最终价格会变化,需在实际使用的站点单独确认。本文没有对任何中转站进行实测。

先分清两个模型 ID

API 阶段 模型 ID 当前应如何理解
Preview gemini-omni-flash-preview 已列入弃用计划;官方列出的最早停用日期为 2026-09-30
GA gemini-omni-1.1-flash 稳定版模型 ID;是官方为 Preview 指定的替代项

两者不是可以混写的别名。调用里若仍写着 Preview ID,仅更新 SDK 或账户余额并不会自动迁移到 GA。建议先在代码、环境变量、部署配置和任务队列中搜索完整旧 ID,避免只改了主服务,却有后台 worker 或定时任务继续发旧请求。

Google 的模型页将 GA ID 标为 Stable,将 Preview ID 单独标为 Preview。迁移时应以接口实际接受的模型字符串为准,不要根据产品展示名自行拼接 1.1 或其他后缀。

API 调用不只是替换一行模型名

Google 当前的示例通过 Interactions API 发起视频生成请求,基本结构如下:

const interaction = await ai.interactions.create({
  model: 'gemini-omni-1.1-flash',
  input: '一段产品短片的文字描述',
});

如果应用会生成较大的视频结果,官方指南还提供 URI 交付方式:请求结果返回托管 URI,客户端需要继续查询文件状态,待文件变为 ACTIVE 后再下载。迁移测试应覆盖完整链路,而不只是收到 interaction 响应:

  1. 创建任务是否接受新的 GA 模型 ID;
  2. 文本、图片、视频输入和编辑任务是否按预期工作;
  3. 长耗时任务的轮询、超时和重试是否正常;
  4. URI 交付时,文件状态查询和下载地址是否可达;
  5. 连续编辑依赖的 previous_interaction_id 是否被中转完整保留;
  6. 失败响应中是否能区分模型不支持、参数错误、额度或上游错误。

这些都是需要对实际渠道验证的兼容点,不是对中转 API 能力的预设。尤其 Interactions API 与常见的纯文本聊天接口并非同一调用形态;即使某个站点提供 OpenAI 兼容的文本接口,也不能据此推断它支持 Gemini 的视频 API。

GA 版本增加了什么,哪些工作流要回归

GA 更新加入了场景延长、首尾帧插值和分辨率控制。官方说明中,场景延长可以分段继续生成,累计视频长度最高可到 40 秒;可设置首帧和末帧来生成过渡;分辨率选项包括 360p、720p、1080p 和 4K,其中高分辨率输出采用上采样。

所以升级不宜只跑一个“生成成功”的冒烟请求。若产品依赖 720p 固定输出,需要确认此前写死的分辨率参数是否与新接口兼容;如果新增了 4K 输出,更要检查应用的文件大小、存储、带宽和下载超时。编辑、延长、插帧属于不同任务路径,建议分别留一条小样本回归用例。

官方模型卡也提醒,连续编辑的一致性、复杂运动以及准确渲染文字仍有局限。GA 不等于所有生成结果都适合直接进入生产;对品牌素材、字幕和关键动作,仍应保留人工验收。

成本怎么核对:官方标价不等于中转账单

截至 2026 年 9 月 27 日,Google Gemini API 定价页列出的 Omni Flash Standard 付费档输入为每百万 Token 1.50 美元,文本输出为每百万 Token 9 美元,视频输出为每百万 Token 17.50 美元。Google 按 720p 视频每秒 5,792 个输出 Token 计费,折算约为每秒 0.10 美元。官方页面对 Preview 与 GA 列出的单价目前相同,但这不代表中转站的售价或计费规则也相同。

通过中转渠道使用时,至少分开记录三项:

  • 上游参考价:Google 文档中的公开价格及计费单位;
  • 渠道报价:站点页面显示的模型价格、倍率、服务费或套餐规则;
  • 实际账单:真实任务产生的视频秒数、输入输出 Token、失败重试和渠道扣费记录。

上线前可用 3 秒、10 秒等短任务做小额核账,确认视频输出是按生成 Token 还是按其他规则折算;同时检查失败任务是否计费、重试是否重复扣费。不要把“官方约 0.10 美元/秒”直接当成任一中转站的最终价格,也不要仅凭文本请求余额变化判断视频账单正确。

迁移前的五步检查

  1. 盘点旧 ID:搜索 gemini-omni-flash-preview,覆盖代码、配置中心、队列和运维脚本。
  2. 核对渠道支持:向渠道确认 gemini-omni-1.1-flash 是否可用,以及是否支持 Interactions API 的视频任务;网页模型列表不等于已验证全部能力。
  3. 用新 ID 发最小请求:先在低风险环境跑文本提示生成,再分别测试编辑、延长、首尾帧与不同分辨率。
  4. 验证异步链路和账单:检查长任务、文件轮询、URI 下载、超时重试及账单单位。
  5. 保留回滚与观察:记录请求 ID、模型 ID、错误码和扣费结果;在 Google 确认的停用时刻前完成切换,并监控旧 ID 是否仍有流量。

比较不同 API 渠道时,建议把“模型名可见”“基础请求成功”和“视频任务全链路通过”分成不同证据等级。只有在自己的账户、模型 ID、接口形态和测试时间下验证通过,才能说明当前配置可用;不能由目录收录或一次成功请求推出长期稳定性。

参考来源