彭博援引知情人士称,字节跳动正在开发一款实时空间视频模型,最快可能于 10 月发布,由创始人张一鸣亲自督导。
报道称,这一模型建立在 Seedance 之上,目标是在生成内容的同时响应用户的声音和动作,实时形成可交互的虚拟世界。这套模型计划与 Pico 头显结合。
知情人士称,该模型可在云端以约 20 帧/秒生成内容,延迟约 0.05 秒。把主要计算放到云端,也能降低头显本身的算力要求。
除了 VR,字节还准备将这套模型用于直播、短剧和游戏。
报道还提到,字节并非近期才转向世界模型。36 氪今年 6 月曾披露,世界模型被列为字节 2026 年 AI 四大重点之一,目标是在年底前至少发布一版,对标 Google Genie 3。后者已经能够以 20–24 帧/秒生成 720p 可交互世界,并连续运行数分钟。
本文最初由 Bit.Fan 发布。 欲了解更多加密货币新闻与市场洞察,请访问 www.bit.fan.

