AI 引擎日报
AI 引擎日报|2026-10-10
今天的增量集中在“多人共享同一生成世界”:一边已有代码可复现,一边仍停留在论文或厂商预览。
Odyssey-3开放了研究预览。 用户可用提示创建环境,以第一或第三人称导航、移动独立镜头,并在生成途中加入事件;这比静态视频更接近可玩的生成式运行时。厂商称 Flash 版可实时响应,也公布物理评测和机器人实验,但未看到模型、权重或完整技术报告,性能数字也未独立复测;目前能直接试网页,开发接入仍需申请。公告(2026-10-08) · 预览 · 官方X(2026-10-08)
WorldCast把多人世界拆成分布式客户端。 每名玩家各跑视频生成器和状态模型,只交换位置与场景记忆;作者在《CS2》实验中称,玩家渲染率较联合多视角方案提高一个数量级以上。代码、四步生成器、状态模型、权重、训练与评测流程已公开,能跑三客户端示例;但每客户端需要独立GPU,数据准备和可部署推理仍在待办,尚不是开箱即用的多人引擎。论文(2026-10-08) · 仓库(2026-10-09更新) · 权重
ME-World研究更细的多主体互动。 它把多人的第一人称视频一起生成,让每个视角同时看到所有人的身体动作,并共用环境记忆,使拿取、递交等动作造成的状态变化能跨视角延续。这可用于协作任务和具身智能原型;作者展示双人训练、三人扩展与221帧连续生成,但目前只有论文和项目演示,推理代码、训练代码与权重都未开放。论文(2026-10-08) · 仓库(2026-10-09更新) · 项目页
我的判断:多人生成世界正从“同屏一致”转向显式交换玩家状态与环境记忆;可复现性差异很大,WorldCast已能拆件实验,其余两项更适合验证方向。
覆盖:国际官网/开源已查;国内团队与中文平台已查,WorldCast含深港、清深、滴滴与中科大作者,中文平台未确认同级新增;论文已查;X仅覆盖公开搜索索引,官方帖已回溯公告,未读取完整时间线。