谷歌推出Gemini Omni 1.1 Flash视频生成模型

IT时代网8月28日消息,当地时间 8 月 27 日,谷歌宣布推出 Gemini Omni 1.1 Flash 视频生成 AI 模型,最高可生成 4K 视频。

新模型主打几个能力。场景扩展允许用户基于已有视频从结尾处无缝衔接、继续生成后续画面,按每次 10 秒的步长逐步扩展,单条视频累计最长可达 40 秒;指定首尾帧则只需给定镜头的起始帧与结束帧,就能实现平滑自然的转场与运镜。

生成 360p 预览时,相比 Omni 1.1 的标准 720p 分辨率,生成速度最高可提升 60%,成本仅需原有的三分之一,适合快速原型验证、分镜脚本迭代和高速渲染。最高 4K 分辨率则能直接输出画质细腻的 1080p 或 4K 最终成片。

视频参考功能允许引入最长 3 秒的参考视频片段,据此精准维持画面的上下文背景与角色一致性。价格方面,生成 360p 视频每秒 0.03 美元,720p 每秒 0.1 美元,1080p 每秒 0.15 美元,4K 每秒 0.3 美元。

注:本文综合自IT之家等,文中包含AI辅助创作的内容。

THE END