据知情人士透露,TikTok所有者ByteDance正准备开发一款用于实时生成空间视频的人工智能模型,最早可能于下月发布。彭博社报道称,该报道于周一发布,并援引了知情人士的话。

报道说,创始人张一鸣正在亲自监督该项目,协调不同业务部门,并将AI资源和计算能力投入其开发。发布时间仍不确定,也可能发生变化。

该模型基于ByteDance现有的AI视频生成技术Seedance构建。据称,该模型旨在为直播、短剧和游戏创建互动虚拟世界。

空间视频模型也称为世界模型,能够创建虚拟环境,并根据用户或AI代理的行为进行变化。它们最终可能应用于机器人、游戏和自动驾驶汽车领域。

ByteDance的模型旨在生成能够响应使用该公司Pico头显的人们的声音和动作的虚拟环境。据彭博社报道,该模型可以按需生成视频,延迟约为0.05秒,帧率为每秒20帧。

进军世界模型领域

ByteDance将进入一个不断发展的领域,该领域已经有Google、Meta和多家AI初创公司参与。

Google于今年早些时候向美国AI Ultra订阅用户开放了Project Genie。这款实验性工具允许用户通过文本提示和图像创建并探索虚拟世界。它基于Google DeepMind的Genie 3,后者能够实时创建互动环境。

Meta的Video Joint Embedding Predictive Architecture 2(V-JEPA 2)则采取了不同的方法。该模型旨在理解物理世界,预测接下来可能发生的事情,并帮助机器人决定采取何种行动。

如果取得成功,ByteDance还可能与Meta的Quest头显和Apple的Vision Pro展开更直接的竞争。这两家公司都在虚拟现实和混合现实领域投入了大量资金,但这些设备尚未得到广泛使用。

Seedance已成为ByteDance的主要AI产品之一。它支持该公司的多款产品,包括视频编辑平台CapCut和中国最受欢迎的AI聊天机器人豆包,同时也被创作者、电影制片厂和AI初创公司使用。

ByteDance在中国仍面临来自Alibaba、DeepSeek和Moonshot AI的激烈AI竞争。

该公司还在AI模型、芯片和数据中心上投入巨资。彭博社上周报道称,ByteDance获得了300亿美元贷款,以扩大其AI项目。