Gemini Omni Flash Preview 9月30日进入停用窗口:中转 API 迁移要核对什么
Gemini Omni Flash 的 Preview 与 GA 使用不同模型 ID,旧 Preview 计划于 2026 年 9 月 30 日停用。本文梳理请求迁移、视频能力、计价方式和中转渠道核验步骤,避免只改模型名却漏掉异步文件流程。
正文
Gemini Omni Flash Preview 9月30日进入停用窗口:中转 API 迁移要核对什么
如果你在 2026 年 6 月接入了 Gemini Omni Flash Preview,最近需要检查的不是“模型有没有更新”,而是你的请求是否还指向旧模型 ID。Google 的 Gemini API 更新记录显示,GA 版本已于 8 月 27 日发布,名称为 gemini-omni-1.1-flash;旧版 gemini-omni-flash-preview 计划于 9 月 30 日进入停用时间点。官方弃用表同时说明,表中日期是最早可能停用日期,具体时间以 Google 发出的通知为准。
这对使用 API 中转的开发者有两层影响:上游模型标识要切换;而中转渠道是否同步支持 GA 模型及其视频任务,则需要单独验证。文本模型能正常返回,不代表视频生成、编辑、文件轮询和结果下载也都可用。
核对时间:2026 年 9 月 27 日。下文上游模型、迁移日期与 Google 标价按当日公开的 Gemini API 文档核实;中转站的模型覆盖与最终价格会变化,需在实际使用的站点单独确认。本文没有对任何中转站进行实测。
先分清两个模型 ID
| API 阶段 | 模型 ID | 当前应如何理解 |
|---|---|---|
| Preview | gemini-omni-flash-preview |
已列入弃用计划;官方列出的最早停用日期为 2026-09-30 |
| GA | gemini-omni-1.1-flash |
稳定版模型 ID;是官方为 Preview 指定的替代项 |
两者不是可以混写的别名。调用里若仍写着 Preview ID,仅更新 SDK 或账户余额并不会自动迁移到 GA。建议先在代码、环境变量、部署配置和任务队列中搜索完整旧 ID,避免只改了主服务,却有后台 worker 或定时任务继续发旧请求。
Google 的模型页将 GA ID 标为 Stable,将 Preview ID 单独标为 Preview。迁移时应以接口实际接受的模型字符串为准,不要根据产品展示名自行拼接 1.1 或其他后缀。
API 调用不只是替换一行模型名
Google 当前的示例通过 Interactions API 发起视频生成请求,基本结构如下:
const interaction = await ai.interactions.create({
model: 'gemini-omni-1.1-flash',
input: '一段产品短片的文字描述',
});
如果应用会生成较大的视频结果,官方指南还提供 URI 交付方式:请求结果返回托管 URI,客户端需要继续查询文件状态,待文件变为 ACTIVE 后再下载。迁移测试应覆盖完整链路,而不只是收到 interaction 响应:
- 创建任务是否接受新的 GA 模型 ID;
- 文本、图片、视频输入和编辑任务是否按预期工作;
- 长耗时任务的轮询、超时和重试是否正常;
- URI 交付时,文件状态查询和下载地址是否可达;
- 连续编辑依赖的
previous_interaction_id是否被中转完整保留; - 失败响应中是否能区分模型不支持、参数错误、额度或上游错误。
这些都是需要对实际渠道验证的兼容点,不是对中转 API 能力的预设。尤其 Interactions API 与常见的纯文本聊天接口并非同一调用形态;即使某个站点提供 OpenAI 兼容的文本接口,也不能据此推断它支持 Gemini 的视频 API。
GA 版本增加了什么,哪些工作流要回归
GA 更新加入了场景延长、首尾帧插值和分辨率控制。官方说明中,场景延长可以分段继续生成,累计视频长度最高可到 40 秒;可设置首帧和末帧来生成过渡;分辨率选项包括 360p、720p、1080p 和 4K,其中高分辨率输出采用上采样。
所以升级不宜只跑一个“生成成功”的冒烟请求。若产品依赖 720p 固定输出,需要确认此前写死的分辨率参数是否与新接口兼容;如果新增了 4K 输出,更要检查应用的文件大小、存储、带宽和下载超时。编辑、延长、插帧属于不同任务路径,建议分别留一条小样本回归用例。
官方模型卡也提醒,连续编辑的一致性、复杂运动以及准确渲染文字仍有局限。GA 不等于所有生成结果都适合直接进入生产;对品牌素材、字幕和关键动作,仍应保留人工验收。
成本怎么核对:官方标价不等于中转账单
截至 2026 年 9 月 27 日,Google Gemini API 定价页列出的 Omni Flash Standard 付费档输入为每百万 Token 1.50 美元,文本输出为每百万 Token 9 美元,视频输出为每百万 Token 17.50 美元。Google 按 720p 视频每秒 5,792 个输出 Token 计费,折算约为每秒 0.10 美元。官方页面对 Preview 与 GA 列出的单价目前相同,但这不代表中转站的售价或计费规则也相同。
通过中转渠道使用时,至少分开记录三项:
- 上游参考价:Google 文档中的公开价格及计费单位;
- 渠道报价:站点页面显示的模型价格、倍率、服务费或套餐规则;
- 实际账单:真实任务产生的视频秒数、输入输出 Token、失败重试和渠道扣费记录。
上线前可用 3 秒、10 秒等短任务做小额核账,确认视频输出是按生成 Token 还是按其他规则折算;同时检查失败任务是否计费、重试是否重复扣费。不要把“官方约 0.10 美元/秒”直接当成任一中转站的最终价格,也不要仅凭文本请求余额变化判断视频账单正确。
迁移前的五步检查
- 盘点旧 ID:搜索
gemini-omni-flash-preview,覆盖代码、配置中心、队列和运维脚本。 - 核对渠道支持:向渠道确认
gemini-omni-1.1-flash是否可用,以及是否支持 Interactions API 的视频任务;网页模型列表不等于已验证全部能力。 - 用新 ID 发最小请求:先在低风险环境跑文本提示生成,再分别测试编辑、延长、首尾帧与不同分辨率。
- 验证异步链路和账单:检查长任务、文件轮询、URI 下载、超时重试及账单单位。
- 保留回滚与观察:记录请求 ID、模型 ID、错误码和扣费结果;在 Google 确认的停用时刻前完成切换,并监控旧 ID 是否仍有流量。
比较不同 API 渠道时,建议把“模型名可见”“基础请求成功”和“视频任务全链路通过”分成不同证据等级。只有在自己的账户、模型 ID、接口形态和测试时间下验证通过,才能说明当前配置可用;不能由目录收录或一次成功请求推出长期稳定性。
参考来源
- Google Gemini API 更新记录(GA 发布及 Preview 停用安排):https://ai.google.dev/gemini-api/docs/changelog
- Gemini API 模型弃用表(模型替代关系及日期说明):https://ai.google.dev/gemini-api/docs/deprecations
- Gemini Omni Flash API 指南(Interactions API、URI 文件交付示例):https://ai.google.dev/gemini-api/docs/omni
- Gemini API 定价页(当前模型标价与计费折算):https://ai.google.dev/gemini-api/docs/pricing
- Google DeepMind Gemini Omni Flash 模型卡(已知限制):https://deepmind.google/models/model-cards/gemini-omni-flash/
- Google 官方发布说明(GA 功能变化):https://blog.google/innovation-and-ai/technology/developers-tools/build-with-gemini-omni-1-1-flash/