众力资讯网

突发!彭博社刚刚爆料,字节跳动正筹备推出一款主打实时空间视频生成的 AI 模型,将切入机器人与自主系统的关键应用领域。 据知情人士透露,字节跳动创始人张一鸣正亲自督战该模型的研发,最快有望于下月面世。张一鸣一直在统筹全公司各业务线的资源,向该项目集中倾斜 AI 技术力量与算力储备。 该模 ​

突发!彭博社刚刚爆料,字节跳动正筹备推出一款主打实时空间视频生成的 AI 模型,将切入机器人与自主系统的关键应用领域。

据知情人士透露,字节跳动创始人张一鸣正亲自督战该模型的研发,最快有望于下月面世。张一鸣一直在统筹全公司各业务线的资源,向该项目集中倾斜 AI 技术力量与算力储备。

该模型脱胎于字节现有的视频生成模型 Seedance。借助这一新模型,用户将能够为直播、短剧和游戏打造高交互性的虚拟世界。

张一鸣希望借这款新模型,杀入正炙手可热的“世界模型”战场。而这条路径正是打通机器人、游戏与自动驾驶的关键基石。

知情人士补充称,此举是字节内部新一轮战略转向的一环:他们正将大批企业服务业务调转航向,扑向视频制作与生成。

在张一鸣看来,空间视频模型正是串联全盘的飞轮:它不仅能像谷歌的 Genie 那样将用户置入三维虚拟空间,还能将字节底层的 AI 模型、云计算算力,与前端的内容平台及 Pico 头显硬件真正咬合在一起。

字节跳动与谷歌正处在同一赛道:双方都在押注以视频为核心的技术路径,试图通过模型为 AI Agent 模拟真实的物理环境。今年早些时候,谷歌推出了 Genie,率先实现了让用户在实时渲染的世界中进行交互。

知情人士透露,字节这款新模型的目标,是实时响应 Pico 头显用户的语音或肢体动作,生成可交互的虚拟空间。

该模型支持在 20 帧/秒的规格下实现约 0.05 秒的超低延迟按需渲染,并充当空间计算的运行环境与交互界面。

这款模型通过将生成空间内容的高负载算力转移至云端,从而压低 VR 设备的准入门槛。此举将大幅减轻头显对本地硬件算力的依赖,为更廉价、结构更轻便的设备铺平道路。

而即时内容生成能力的突破,同样可能将用户争夺战的主战场,从死磕终端硬件规格,转向比拼底层的 AI 模型、算力基础设施与内容分发能力。