世界模型公司 Odyssey 正式发布 Odyssey-3,并开放 Flash 版免费试玩。该模型可以根据文字实时生成可探索的世界,用户在场景中走动或转动镜头时,画面会随之变化。
同一模型用于机器人、汽车和游戏角色
团队展示称,Odyssey-3 也被用于机械臂、人形机器人、汽车和游戏角色等实验。模型先从互联网视频、游戏操作录像和物理模拟中学习物体运动以及动作带来的结果。
在机器人或汽车场景中,预训练主模型参数保持不变。团队只需额外训练小型控制模块,把模型学到的知识转化为操作指令。不同机器仍然需要单独适配,但不需要重新训练整套模型。
驾驶、人形机器人和游戏实验结果
Odyssey 表示,仅用 20 小时模拟驾驶数据训练专用控制模块,就让汽车在印度真实公路上行驶。测试中,使用模拟数据训练的方案,在两次安全员接管之间的行驶距离约为真实驾驶录像训练方案的 77%。
与 Flexion 合作的人形机器人,在使用数十小时遥控示范数据训练后,能够在光照变化的情况下继续执行任务。
在游戏实验中,控制模块学习了约 2 小时《GTA V》操作录像,之后无需额外训练,就能在《荒野大镖客 2》中让角色骑马移动。
物理评测超过 FLUX 3
在 Physics-IQ Verified 物理视频预测测试中,Odyssey-3 Pro 获得 66.1 分,超过 FLUX 3 [large] 的 64.35 分,两者均为 8 次择优成绩。
Odyssey 还公布了 WorldMark 评测结果,模型在四类交互场景中取得三项第一。
本文最初由 Bit.Fan 发布。 欲了解更多加密货币新闻与市场洞察,请访问 www.bit.fan.

