T-RO综述重构Foundation Model时代机器人操作知识版图
T-RO综述重构Foundation Model时代机器人操作知识版图过去几年,机器人操作领域几乎被一批新概念重新 “刷屏”。 LLM Planner、VLA、Diffusion Policy、Flow Matching、Latent Action、World Mode
搜索
过去几年,机器人操作领域几乎被一批新概念重新 “刷屏”。 LLM Planner、VLA、Diffusion Policy、Flow Matching、Latent Action、World Mode
图片不只被编码,还直接参与 Attention、MoE 与 Agent 推理。
Full Attention 层尚未开始计算,它前一层的激活值已提前「冲上峰值」—— 这就像演唱会主角尚未登台,观众席已提前沸腾。来自 StartLux、清华大学等机构的研究者以 Massive Activations 为探针,首次系统刻画了少数 Full Attention 层在混合线性注意力大模型中留下的「跨层痕迹」,并识别出「注意力前尖峰」(PAS)与「尖峰间平台」(ISP)两种核心形态。
寒序科技正式公布uHBM®与uLPU™推理计算架构,首次完整亮相其基于Persistent MRAM的权重驻留片内计算方案。
老黄刚砸60亿,要造一个地表最强开源模型。
近日,新加坡国立大学 Minghui Guo 与牛津大学 Shengqiong Wu、Hao Fei 在论文《V-RAE: Rethinking Video Latent Spaces for Generation》中提出视频表征自编码器 V-RAE。该方法以冻结的视觉基础模型为编码器,通过轻量级时间池化压缩视频特征,并将具有丰富语义和时间连续性的表征直接用于视频重建、生成与未来预测。
中国机器人的AstraTennis时刻,来了。8月22日,第二届世界人形机器人运动会开幕,中央广播电视总台面向全球直播。当镜头扫过赛场,全场的呼吸仿佛都停滞了。球网两侧,一边是人类网球名将,另一边,是一台人形机器人。
最近,来自厦门大学、上海创智学院、上海交通大学的研究团队提出TennisVAR,希望补上的正是这一块能力:让AI在网球比赛中不只是看见一次击球,而是能够沿着一连串击球,还原背后的战术逻辑,并把支撑判断的具体击球证据找出来。
Z Potentials 独家获悉,具身交互模型企业 CyboPal(江苏细胞壁智能科技有限公司)已完成数亿元融资,由东方富海领投,联想之星、天启资本等机构跟投,心流资本 FlowCapital 担任长期独家财务顾问。
过去几年,大模型推理系统优化的核心目标一直围绕一个问题展开:如何让 GPU 更高效地计算权重、激活、KV Cache 等高维张量?从并行策略、请求调度、显存管理到算子优化,学界业界大量优化技术不断提升模型推理效率。