【资料图】
IT之家 9 月 7 日消息,据彭博社报道,字节跳动正准备推出一款实时空间视频生成 AI 模型。创始人张一鸣正亲自督导这款新模型的研发工作,该模型计划最早于下月发布。
知情人士透露,张一鸣近期一直在协调公司各业务部门的协作,并调动 AI 资源及算力全力推进该项目。其中一位知情人士指出,发布时间尚未最终确定,计划仍可能发生变动。
据介绍,该模型基于字节跳动现有的电影级视频生成 AI 模型 Seedance 构建,将允许用户面向直播、短剧和游戏创建交互式虚拟世界。字节跳动发言人未回应置评请求。
知情人士称,张一鸣将空间视频模型定位为驱动整个生态的“飞轮(Flywheel)”—— 该模型能够将用户置于高度沉浸的三维虚拟环境中,功能与谷歌的 Genie 类似。字节跳动得以将其自研 AI 模型、云计算底层资源,与旗下的内容平台以及 XR 业务分支 Pico 的硬件终端深度串联、协同发力。
字节跳动最新的模型旨在生成能够响应 Pico 头显用户语音或动作的虚拟世界。知情人士透露,该模型可在每秒 20 帧的帧率下,以约 0.05 秒(50 毫秒)的极低延迟按需生成视频流,并支持空间计算环境及人机交互界面。
IT之家获悉,该模型致力于将生成空间内容这一计算密集型任务完全转移至云端,从而显著降低 VR 技术的初始使用成本。这一架构能够大幅减少头显设备本身的算力要求,为推出造价更低、配置更简化的硬件终端铺平道路。
同时,高速的内容生成能力还将推动行业竞争重心发生转移 —— 争夺用户的战线有望从比拼硬件参数规格,转向大型 AI 模型、算力基础设施以及内容分发平台。



