谷歌Gemini Omni 1.1 Flash发布:视频生成能力实现质变

谷歌正式推出Gemini Omni 1.1 Flash版本,作为5月亮相、6月底开启API公测的旗舰模型新迭代。该版本在保持单次生成10秒视频上限的基础上,首次在Omni API中集成视频续写功能,使用户可在一段视频生成后持续扩展内容。

支持连续延展,最长可达40秒完整序列

每次续写可新增10秒内容,系统将基于前10秒画面信息进行上下文理解,确保人物动作、场景变化和剧情逻辑连贯自然,从而实现多段拼接的流畅长视频输出。

首尾帧精准控制,智能补全运动轨迹

新版本引入首尾帧约束机制,用户仅需提供起始与终止图像,如指定角色从远处走至镜头前,模型即可自动生成中间完整的运动过程,大幅增强创作自由度与视觉一致性。

低预算草稿模式上线,吞吐量提升60%

新增360p草稿生成选项,系统处理效率最高提升60%,单位成本约为720p分辨率下的三分之一。生成后的视频可进一步放大至1080p或4K输出,但该高分辨率属后期提升,非原生高精度生成。