行业资讯

字节跳动或将推出实时生成虚拟世界AI模型

Heooo 09月08日12时34分 26 阅读

「字节跳动正开发一款基于Seedance的实时空间视频生成AI模型,最快有望于10月发布,由张一鸣亲自督导推进。该模型面向直播、短剧和游戏等场景生成交互式虚拟世界,可响应Pico头显用户的语音与动作指令,并将空间内容生成转移至云端,从而降低VR设备的算力与硬件要求。」

据彭博社报道,字节跳动正在开发一款能够实时生成空间视频的AI模型,最快有望于下月正式发布。这一项目由字节跳动创始人张一鸣亲自督导,近期他持续协调公司各业务部门,集中调用AI资源和算力推进模型研发。不过,具体的发布时间目前尚未最终敲定,仍存在调整的可能。

该模型基于字节跳动现有的电影级视频生成AI模型Seedance构建,但其目标并不局限于平面视频内容的生成,而是面向直播、短剧与游戏等场景,打造可实时交互的虚拟世界。这一能力与谷歌Genie的思路有相似之处,两者均尝试将用户置于高度沉浸的三维虚拟环境之中。区别在于,字节跳动希望借此串联起自身自研的AI模型、云计算资源、内容平台以及XR业务Pico的硬件终端,形成一个覆盖从软件到终端的完整生态闭环。

在张一鸣的规划中,这一模型被定位为驱动整个生态的“飞轮”。如果模型能够生成足够丰富的实时虚拟空间,直播、短剧和游戏便能成为用户进入虚拟世界的流量入口;反过来,用户在实际体验中产生的交互数据与需求,又会持续反哺模型的迭代升级,并影响硬件产品的定义方向。

值得关注的是,该模型还被设计为能够理解和响应Pico头显用户的语音或动作指令。这意味着用户未来可以更自然地与虚拟环境中的内容进行互动,而不必依赖传统手柄或笨重的操作界面。针对VR设备长期面临的算力与功耗瓶颈,字节跳动的方案是将空间内容生成这类高算力任务转移到云端完成,以云端推理与渲染来降低对设备端算力的依赖。这不仅有助于降低VR一体机的硬件配置门槛,也为更轻量化、更低成本的终端设备形态提供了可能。

若这一模式成功落地,VR行业的竞争重心或将发生深层转变。过去厂商的竞争焦点主要集中在屏幕分辨率、芯片算力、设备重量等硬件参数上,而未来AI模型能力、云计算基础设施与内容分发体系将成为更重要的竞争维度。对字节跳动而言,如果能够将Pico硬件终端、Seedance模型与抖音等内容平台的场景优势充分结合,便有望在空间计算与虚拟世界入口的竞争中占据更加有利的位置。

# 字节跳动 # AI模型 # 虚拟世界 # Seedance # VR

来源:Heooo AI工具导航