阿里云Wan3.0支持单条30秒视频直出 封面图
技术进展

阿里云Wan3.0支持单条30秒视频直出

Heooo 09月17日17时02分 29 阅读

「阿里云展示全新升级的 Wan3.0 视频大模型,实现单条 30 秒长镜头直出,并推出支持导演级控制的全能多视频参考机制,可同时引入最多五条视频作为参考素材。相关能力已通过 Model Studio 与 Qwen Cloud 面向开发者和企业用户开放 API 接口,助力影视制作工作流提效。」

阿里云正式对外展示了全新升级的 Wan3.0 视频大模型。相比此前的版本,这一次升级最引人关注的变化在于生成时长与参考能力的双重跃升:模型可以单条直出 30 秒长镜头,并支持同时引入多达五条视频作为参考素材。这意味着 AI 视频生成正在从零散短片段拼接的思路,转向真正适配影视行业生产流程的连贯长镜头输出。

回顾视频生成技术的发展路径,行业在过去很长一段时间里主要围绕 5 秒左右的短片段进行打磨,随后逐步延伸至 15 秒。时长的每一次拉长,背后都是对画面一致性、运动稳定性与语义连贯性的严峻考验。Wan3.0 直接把单条生成时长推到 30 秒,让制作团队不必再费力拼接成百上千个零散片段,而是可以先生成连贯长镜头,再依据剧本与故事走向进行后期剪辑,创作效率因此大幅提升。

阿里云Wan3.0支持单条30秒视频直出

在核心功能层面,Wan3.0 带来两项显著的技术亮点。其一是突破性的单条 30 秒视频直出能力,能够在长时间跨度内保持画面质量与叙事连贯性,缓解以往长视频生成中常见的画面漂移与主体形态不稳定问题。其二是全能多视频参考机制,支持同时引入多达五条视频作为参考,而不再局限于静态图片参考。这一机制让创作者可以在人物形象、镜头语言、色调风格等多个维度上进行对齐,实现导演级别的精细控制,使 AI 视频生成在复杂叙事与风格统一上达到了全新的高度。

从只支持图片参考到支持多视频参考,这一变化的实质是控制信号维度的升级。静态图片只能提供构图、人物外貌等单帧信息,而视频参考能够把运镜节奏、动作走向、光影变化等随时间演进的要素一并传递给模型。对于需要多镜头衔接、角色跨场景保持一致的影视项目来说,这种参考能力往往比单纯的时长提升更为关键,它直接决定了生成结果能否被纳入成片流程而非停留在演示阶段。

目前,Wan3.0 的相关能力已经通过官方渠道面向开发者和企业用户开放。开发者和制作团队可以通过 Model Studio 以及 Qwen Cloud 访问其 API 接口,将这一前沿的视频生成能力接入到实际的影视制作工作流中,在真实项目里验证其可用性与稳定性。

对视频生成赛道而言,30 秒直出与多视频参考的组合,意味着模型不再只是灵感层面的试验工具,而开始承担分镜预演、素材生成、风格统一等更贴近工业流程的任务。随着 API 的开放,围绕长镜头生成与多参考控制的工具链与应用形态,预计会较快出现在开发者生态之中,视频生成的竞争焦点也将从单帧画质比拼,转向长时序一致性与可控性的工程化能力。

# 阿里云 # Wan3.0 # 视频生成

来源:Heooo AI工具导航