知识卡片:谷歌发布Gemini Omni 1.1,视频可延展至40秒
一句话结论
谷歌发布视频模型Gemini Omni 1.1 Flash,支持读取最多10秒前序视频进行续接生成,单次扩展10秒、累计长度最高40秒,并已面向开发者及消费端用户开放。
事件概述
根据腾讯研究院AI速递(2026-08-31),谷歌发布视频模型Gemini Omni 1.1 Flash,主打视频续接与长度扩展能力。该模型可读取最多10秒的前序视频,单次生成扩展10秒,最多续接至40秒总长度。同时新增首尾帧控制和最长3秒的视频参考输入。模型已通过Gemini API与Google AI Studio向开发者开放,消费端覆盖全球AI Plus、Pro与Ultra用户。
方法/产品要点
- 模型名称:Gemini Omni 1.1 Flash,属于谷歌Gemini Omni系列。
- 核心能力:读取最多10秒前序视频,续接生成新片段;单次扩展10秒,累计长度最高40秒。
- 新增控制:支持首尾帧控制;支持最长3秒视频参考输入。
- 效率设计:360p草稿模式吞吐较720p提升约60%,成本约为720p的三分之一;成片支持4K输出。
- 开放渠道:通过Gemini API与Google AI Studio面向开发者开放;消费端覆盖全球AI Plus、Pro与Ultra用户。
主要结果或产业意义
- 将视频生成的可控长度提升到累计40秒,为短视频、动态故事板等场景提供更长的续接能力。
- 新增首尾帧与参考视频输入,增强用户对生成内容的控制力。
- 草稿模式提供更高吞吐、更低成本的预览方案,同时保留4K成片输出,兼顾效率与质量。
为什么重要
- 本条是对已有卡片“谷歌Gemini Omni 1.1 Flash登顶AI视频生成榜单”的延续与补充:在该模型登顶榜单之后,进一步披露了其具体能力(累计40秒、首尾帧控制、3秒参考输入)、成本优化(360p草稿模式)以及开放范围。
- 视频生成竞争加剧,谷歌通过“续接扩展”方案给出了区别于单次生成长视频的技术路线。
局限与不确定性
- 40秒为累计长度上限,单次仅扩展10秒;具体生成质量、实际推理速度和价格详情在材料中未明确。
- 消费端“AI Plus、Pro与Ultra”的具体订阅层级、可用地区及限制待核实。
- 模型的更多技术细节、训练方法、与竞品对比等待核实。
可用于图书/PPT/简报的角度
- 视频生成产品功能拆解:从“单次生成”到“续接扩展”的能力演进。
- 成本与效率的平衡:360p草稿模式如何降低预览成本、提升吞吐量,适合作为AI产品设计案例。
- 谷歌在AI视频生成领域的布局:以Gemini Omni为切入点,与OpenAI、Anthropic等竞争。
原始材料
- 来源:腾讯研究院AI速递 20260831(搜狐号)
- URL: https://m.sohu.com/a/1069745836_455313?scm=10001.325_13-325_13.0.0-0-0-0-0.5_1334&digest_item=5
- 英文标题(参考译名):Google Releases Gemini Omni 1.1, Extending Video to 40 Seconds
- 英文关键词:Gemini Omni 1.1 Flash; Video Generation; Google; AI