编译/VR陀螺
字节跳动正在推进一款实时空间视频生成AI模型的研发,正式入局世界模型赛道,未来将与Meta、Alphabet在机器人技术、自动驾驶等应用领域展开竞争。
据知情人士透露,公司创始人张一鸣正亲自统筹该项目,协调跨部门资源,倾斜AI研发力量与算力投入,模型预计最快下月正式面世。不过也有相关人士表示,具体发布时间尚未最终敲定,项目计划仍存在调整可能。字节跳动发言人暂未回应相关置评请求。
这款新模型基于字节跳动现有的电影级视频生成AI模型Seedance开发,核心能力是生成可交互的虚拟世界,可应用于直播、短剧制作以及游戏开发等场景。张一鸣希望依托字节在视频技术领域的积累,借助这款产品将TikTok创作者生态接入快速发展的世界模型领域。
该项目是字节跳动内部战略调整的重要一环。这家总部位于北京的公司正逐步将大量ToB业务资源转向视频制作与生成赛道。在内部定位中,这款可打造沉浸式三维世界的空间视频模型,定位类似谷歌此前推出的Genie,将作为业务飞轮,打通字节的AI技术、云计算资源,联动内容平台生态以及旗下XR品牌Pico的硬件布局。
字节跳动与谷歌的相关产品同属以视频为核心的世界模型技术路线,目标都是构建能够为AI智能体模拟真实物理环境的模型。谷歌今年早些时候推出的Genie,已支持用户与实时渲染的虚拟世界进行交互。这类空间模型也被普遍视作机器人、自动驾驶等领域的关键底层技术,张一鸣也将借此入局,和李飞飞、杨立昆等业内研究者一同探索视觉AI的技术路径。
如果该模型落地顺利,字节跳动将在XR硬件之外,和Meta、苹果开辟新的竞争战线。目前Meta正围绕Quest系列头显搭建大众级XR生态,苹果则以Vision Pro布局高端空间计算市场,两者在向主流渗透的过程中均面临挑战,而空间AI模型有望成为行业下一个核心竞争点。
来源:bloomberg