Daily Technical Tracking

每日科技追踪

2026年8月31日(周一)

每日追踪
← 返回首页

Gemini Omni 1.1视频模型

谷歌发布视频生成模型 Gemini Omni 1.1 Flash,核心能力是「场景扩展」:可读取最多 10 秒前序视频续接生成,单次扩展 10 秒、累计最长 40 秒。新增首尾帧控制与最长 3 秒的视频参考输入,用于维持角色与画面上下文一致性。360p 草稿模式吞吐较 720p 提升约六成、成本约三分之一,成片支持 4K 输出,已通过 Gemini API 与 AI Studio 开放。

关键要点

  • 续写式生成:读取 10 秒前序视频,单次扩展 10 秒,累计最长 40 秒
  • 首尾帧控制 + 最长 3 秒视频参考输入,保障角色与场景一致性
  • 360p 草稿吞吐较 720p 提升约 60%,成本约 1/3,成片支持 4K
  • 通过 Gemini API 与 Google AI Studio 面向开发者开放