← 返回首页
Gemini Omni 1.1视频模型
AI 产品2026年8月31日(周一)
谷歌发布视频生成模型 Gemini Omni 1.1 Flash,核心能力是「场景扩展」:可读取最多 10 秒前序视频续接生成,单次扩展 10 秒、累计最长 40 秒。新增首尾帧控制与最长 3 秒的视频参考输入,用于维持角色与画面上下文一致性。360p 草稿模式吞吐较 720p 提升约六成、成本约三分之一,成片支持 4K 输出,已通过 Gemini API 与 AI Studio 开放。
关键要点
- 续写式生成:读取 10 秒前序视频,单次扩展 10 秒,累计最长 40 秒
- 首尾帧控制 + 最长 3 秒视频参考输入,保障角色与场景一致性
- 360p 草稿吞吐较 720p 提升约 60%,成本约 1/3,成片支持 4K
- 通过 Gemini API 与 Google AI Studio 面向开发者开放