行业资讯

谷歌发布Omni 1.1 Flash视频生成模型

Heooo 08月28日15时00分 6 阅读

「谷歌推出Gemini Omni 1.1 Flash视频生成AI模型,支持从已有视频末尾无缝扩展、指定首尾帧、生成360p预览及最高4K分辨率成片,并可参考3秒视频片段保持角色一致性。该模型按分辨率阶梯定价,最低每秒0.03美元,面向快速原型验证和高清成片等多元化创作需求。」

谷歌近日宣布推出Gemini Omni 1.1 Flash视频生成AI模型,这是一款面向视频创作与内容生产场景的新一代生成式模型。该模型在生成分辨率、工作流程灵活性和成本控制方面均展现出显著特性,进一步丰富了视频生成工具的能力边界。

在核心功能层面,Gemini Omni 1.1 Flash支持场景扩展操作。用户可以直接基于已有视频内容,从结尾处无缝衔接并继续生成后续画面,实现叙事链条的连续延伸。具体而言,该模型允许按每次10秒的步长逐步扩展视频,单条视频的累计最长时长可达40秒。这一设计为长镜头叙事、短视频续集和内容补全提供了高效的技术路径。

针对镜头控制需求,新模型支持指定首尾帧。只需设定镜头的起始帧与结束帧,模型即可自动生成平滑自然的转场效果与运镜过程,降低了复杂镜头设计的技术门槛。这种帧级控制能力有助于创作者精准表达画面意图,尤其适用于分镜设计和动态预览等场景。

在性能与成本平衡方面,Gemini Omni 1.1 Flash特别提供了360p分辨率预览模式。相较于标准的720p分辨率,生成速度最高可提升60%,成本仅需原有的三分之一。这一模式特别适合快速原型验证、分镜脚本迭代以及高速渲染等对时效和经济性要求较高的环节,让创作者能够在低成本条件下快速测试创意方向,再决定是否投入更高规格的渲染。

同时,该模型支持最高4K分辨率的直接输出,可生成画质细腻、细节完善的1080p或4K最终成片。高分辨率能力使其不仅适用于初稿和预览,也能满足对画面质量有严格要求的商业级视频制作需求。

为了保证生成内容的一致性与连贯性,Gemini Omni 1.1 Flash引入了视频参考功能。在构建视频场景时,用户可引入最长3秒的参考视频片段,模型将依据参考内容精准维持画面的上下文背景与角色一致性。这对于系列化内容创作、角色IP视频生成等应用场景具有重要意义,有助于保持不同片段间的视觉风格统一。

定价方面,Gemini Omni 1.1 Flash采用按输出分辨率与时长计费的模式。生成360p视频每秒费用为0.03美元,720p视频每秒0.1美元,1080p视频每秒0.15美元,4K视频每秒0.3美元。不同档位的价格梯度为各类预算和项目需求提供了灵活选择,既顾及了高频率低成本的测试场景,也覆盖了追求极致画质的成片需求。

整体来看,Gemini Omni 1.1 Flash的发布体现了视频生成模型在精细化控制、效率优化和高画质输出上的综合演进方向。场景扩展、首尾帧指定、360p快速预览、4K输出以及参考视频辅助等功能相互配合,为创作者提供了从创意雏形到成片交付的完整工具链。

# 谷歌 # Gemini # 视频生成 # AI模型

来源:Heooo AI工具导航