据彭博社报道,字节跳动正准备推出一款实时空间视频生成AI模型。
这款新模型的研发工作得到了创始人张一鸣本人的亲自督导。张一鸣将该空间视频模型定位为驱动整个生态的“飞轮(Flywheel)”,显示出公司对该技术战略重要性的高度重视。
关于发布时间,据报道,字节跳动实时空间视频生成AI模型计划最早于下个月发布。这构成了一个明确的时间节点预期。
在技术基础方面,该模型并非凭空出现,而是基于字节跳动现有的电影级视频生成AI模型Seedance构建的。这意味着新一代的空间视频能力是在现有成熟技术栈上进行迭代和升级的。
从功能目标来看,该模型旨在生成能够响应Pico头显用户语音或动作的虚拟世界。这明确了其应用场景指向沉浸式、交互式的空间计算领域。
在性能指标方面,资料指出该模型具备极高的实时性要求,它能够在每秒20帧的帧率下,以约0.05秒(即50毫秒)的极低延迟按需生成视频流。这种低延迟特性是支撑沉浸式交互体验的关键技术门槛。
此外,该模型在计算架构上做出了重要设计决策,致力于将生成空间内容这一原本计算密集型的任务完全转移至云端执行。这有助于减轻终端设备的负担,并保证大规模、高并发场景下的稳定运行能力。
从时间线和背景来看,字节跳动此举的战略意义在于构建一个完整的“飞轮”效应:通过低延迟、云端的空间视频生成能力,赋能Pico头显等硬件生态,从而驱动整个内容和应用层面的增长。这标志着字节跳动在AIGC领域从静态内容生成向实时交互空间内容的深度拓展。
读者需要关注的是,虽然有关于“最快下个月发布”的报道,但该信息来源于彭博社的报道,且目前仅是消息层面,后续的实际产品演示和更详细的技术规格仍需等待官方正式确认。我们应将此视为一个重要的行业信号点,而非最终定论。
综上所述,字节跳动正在通过整合Seedance等现有技术,聚焦于实时、低延迟的云端空间视频生成能力,并由张一鸣亲自推动其成为生态核心驱动力,预计在下个月实现初步发布。
信息来源
本文基于上述公开资料整理,未使用来源页面的图片、视频或嵌入媒体。