世界模型迎来「中国引领时刻」,昆仑万维 Matrix-Game 3.5 要迈向真实世界
世界模型迎来「中国引领时刻」,昆仑万维 Matrix-Game 3.5 要迈向真实世界世界模型牌桌上,昆仑万维已连出五张牌,一张比一张大。
搜索
世界模型牌桌上,昆仑万维已连出五张牌,一张比一张大。
凌晨两点,城市睡着了,前置仓还醒着。
如果你走进2026 WAIC的现场,最直观的感受可能只有一个“卷”字。
极佳视界把一套完整的「通用世界模型」产品矩阵摆到了现场:从面向内容创作的一粟 YiSu,到面向自动驾驶数据与仿真的 DriveDreamer;从面向具身智能的 GigaWorld,到负责把世界理解转化为行动的 GigaBrain 与 GigaWorld-Policy;再到进入家庭场景的拾光 S1,以及面向智能制造的 Maker H01。
WAIC期间,中数睿智发布了“AI for Reasoning”因果智能体系,针对的就是这些痛点。比如油气钻井的井控场景,井下压力和流量突然不对劲,系统不只是输出一句“存在风险”,而是能沿因果链定位病因,并推演多条干预路径:不处置会怎样?立即关井会怎样?延迟处置能撑多久、代价是什么?辅助企业在事故发生前做出最优决策。
阿里巴巴达摩院的最新工作RynnWorld-Teleop对此给出的方案是:用生成式世界模型替代真实机器人。操作员的手势驱动一个实时视频生成器,由“数字世界中的机器人”完成全部视觉演示,同时自动获得关节级的动作标签。该方案被称为数字遥操作(Digital Teleoperation)。
世界模型圈一大难题是定义模糊,起码三四个流派各研究各的,都做了个产品就说自己是真正的世界模型,谁也没法说谁的不是。蚂蚁旗下的灵波科技疑似把这问题给解决了,因为哥们直接把几乎现有所有方向都做了一遍。
近两年,视频生成模型在具身智能领域受到持续关注。从 UniPi、SuSIE 到各类 action-conditioned video generation 变体,其核心思路一致:先由模型生成一段未来视频,再从中提取动作信号供机器人执行。
WorldArena 1.0 的核心意义,在于将世界模型评测从 “好不好看” 推进到 “是否真的有用”。它不再只关注视频观感,而是把物理一致性、可控性、3D 准确性和具身任务功能性纳入统一评测框架,使许多看似流畅的生成结果第一次在机器人具身任务中接受检验。
近期,字节跳动商业化GenAI中国区负责人、原AI Lab技术负责人袁泽寰确认离职,创业方向锚定世界模型赛道,聚焦Physical AI领域的基础模型研发。