拓展JEPA至受控世界模型,清华团队揭示物理状态与动作转移的可辨识条件
拓展JEPA至受控世界模型,清华团队揭示物理状态与动作转移的可辨识条件世界模型是物理原生智能(Physics-native Intelligence,Phi)重要的组成环节。
搜索
世界模型是物理原生智能(Physics-native Intelligence,Phi)重要的组成环节。
在同一时期,另一支有中国大模型公司经历的团队也在做相似的事情。 这家公司叫Copula Lab,由两名前MiniMax核心成员创办,已经获得第一轮一线机构投资支持,目前对应千万美元级估值
当海外NeoLab还忙于靠叙事拿下数亿美元融资时,一家中国团队用连续三篇论文,交出了自进化AI领域第一份全栈答案。它就是EverMind,由盛大集团孵化,延袭当年创新院研究基因。
2026 年 1 月,Floatboat 客户端把文件管理器、编辑器和浏览器直接做成 Agent 的运行环境,开创了 Agent 桌面工作台这一形态;4 月,FloatIM 把人与 Agent、Agent 与 Agent 接成一张办公网络,任务可以跨人、跨 Agent 交接而上下文不断;5 月,FloatSchedule 让 Agent 不必等人下指令,按日程自己开工。
近日来自南京大学模式识别实验室(PRLab)的梁嘉骏、廖宇程,在司晨阳教授的指导下,联合新加坡南洋理工大学、英国帝国理工学院,提出连续扩散语言模型 AURORA-LM(Autoencoding Unified Representation for Continuous-Latent Diffusion Language Modeling),对连续空间下的语言建模作出了更多的思考和发现。
在模型层之外,2026 年上半年在硅谷增长最快的赛道之一是数据:Mercor 的 run rate 从去年下半年的 5 亿美元涨到今年年中的 20 亿美元;Handshake 转型 human data 后,run rate 在年初三个月内从 5.5 亿美元冲到 10 亿美元;RL 环境公司 Fleet 则在半年内从百万美元级别做到 6000 万美元 run rate,
时隔近两年,李飞飞终于再做客a16z,畅谈空间智能和World Labs在机器人赛道上的全盘布局。
上一篇我用 Doubao-Seed-Evolving,把复杂 PRD 拆成可执行工程,做成了 AI 教学视频平台。那次重点是“知识驱动出片”:学科知识点 → 教学分镜 → 配音 → 动画 → 1080p 成片。
浙江大学、清华大学智能产业研究院、影溯 InSpatio、RoboParty Lab 等团队提出的 INTACT(INtent-To-ACTion),一种基于端到端 JEPA 的无搜索世界模型控制方法,试图改变这一范式:直接利用离线轨迹中已有的状态、动作与未来结果,将运动意图转化为动作模型可以读取的语义接口,使模型无需搜索候选动作序列,就能直接生成动作计划
今天,AI 创业圈格外热闹 —— 贾扬清、吴恩达以及 Sonia Joseph( Meta FAIR JEPA 团队核心研究员)在同一天官宣创业。