AI资讯新闻榜单内容搜索-泛化

AITNT-国内领先的一站式人工智能新闻资讯网站
# 热门搜索 #
搜索: 泛化
反击VLA中「L」无用论:用对位置指令泛化能力暴涨20-40%

反击VLA中「L」无用论:用对位置指令泛化能力暴涨20-40%

反击VLA中「L」无用论:用对位置指令泛化能力暴涨20-40%

作为具身智能最主流的路线之一,VLA 快速发展的同时也因为其各种问题被诟病。其中最主要的痛点之一便是指令泛化能力。

来自主题: AI技术研报
9082 点击    2026-08-06 15:40
全球首个云端具身大模型炸场WAIC:一脑控多手、30秒换手,行业首例

全球首个云端具身大模型炸场WAIC:一脑控多手、30秒换手,行业首例

全球首个云端具身大模型炸场WAIC:一脑控多手、30秒换手,行业首例

RoboScience机器科学直接把世博馆展台,变成了 Visics 的压力测试场。换本体、换物品、换任务,多轮挑战轮番上阵,专挑具身大模型最容易掉链子的地方下手。Visics 的泛化能力究竟行不行?现场观众可以直接点题,围观验货。

来自主题: AI资讯
8661 点击    2026-07-18 10:27
ECCV 2026|Google等推出VGGRPO:用4D隐空间奖励实现世界一致的视频生成

ECCV 2026|Google等推出VGGRPO:用4D隐空间奖励实现世界一致的视频生成

ECCV 2026|Google等推出VGGRPO:用4D隐空间奖励实现世界一致的视频生成

最近,来自 Google、哥本哈根大学、牛津大学等机构的研究者提出了 VGGRPO(Visual Geometry GRPO,收录于 ECCV 2026)。这项工作聚焦于一个核心问题:如何在不牺牲预训练模型泛化能力的前提下,高效地提升视频生成的几何一致性,并使其适用于动态场景。其核心思路是,在隐空间(latent space)中利用 4D 几何奖励,进行几何感知的视频后训练。

来自主题: AI技术研报
10230 点击    2026-07-18 10:09
ICML 2026|小模型也能「指挥」大模型RL后训练:清华&腾讯提出GPS,最高减少69% Rollout成本

ICML 2026|小模型也能「指挥」大模型RL后训练:清华&腾讯提出GPS,最高减少69% Rollout成本

ICML 2026|小模型也能「指挥」大模型RL后训练:清华&腾讯提出GPS,最高减少69% Rollout成本

来自清华大学与腾讯的研究者提出了 Generalizable Predictive Prompt Selection(GPS)。GPS 的做法很直接:先训练一个小型、可泛化的 Prompt Predictive Model(PPM),让它预测不同 prompt 在当前模型下的难度;再根据难度和 batch 多样性选择训练样本,从而减少无效 rollout。

来自主题: AI技术研报
8724 点击    2026-07-11 11:16
Zero-Shot、长记忆、抗干扰,DM0.5把VLA带进真实世界

Zero-Shot、长记忆、抗干扰,DM0.5把VLA带进真实世界

Zero-Shot、长记忆、抗干扰,DM0.5把VLA带进真实世界

今天原力灵机正式发布的 DM0.5 往前推进了一步。它不只是继续提高某些固定任务上的表现,而是围绕真实世界里的泛化问题做了一次系统突。 如果深入分析,就会发现 DM0.5 这几个核心提升,都是想解决一个问题:如何让具身模型从可控环境里的能力演示,走向开放环境里的稳定执行。

来自主题: AI技术研报
8156 点击    2026-07-10 10:40
具身智能空间视觉死穴,终于被最新顶会彻底解决!

具身智能空间视觉死穴,终于被最新顶会彻底解决!

具身智能空间视觉死穴,终于被最新顶会彻底解决!

VLA 大模型看似强大,却被一个致命弱点扼住喉咙——相机稍微挪动几毫米,操作成功率就能暴跌一半。招商局先进技术研究院下属实验室提出新的移动数据范式,首次在真实机器人系统上证明:让相机动起来采集数据,就能以极低成本破解 VLA 的空间泛化瓶颈,且效果普适于多种主流架构。被一个致命弱点扼住喉咙——相机稍微挪动几毫米,操作成功率就能暴跌一半。

来自主题: AI技术研报
8962 点击    2026-07-08 09:46
对话2004年生世界模型创业者陈博远:我不是天才|新皮层

对话2004年生世界模型创业者陈博远:我不是天才|新皮层

对话2004年生世界模型创业者陈博远:我不是天才|新皮层

Yann LeCun的JEPA架构很可能不会work,但至少证明了隐空间比像素或文本空间具备更强的泛化能力;

来自主题: AI资讯
9944 点击    2026-07-01 15:39
登顶权威榜单!无界动力发布全球首个「长时序双向物理因果链」隐空间世界模型 MWA™

登顶权威榜单!无界动力发布全球首个「长时序双向物理因果链」隐空间世界模型 MWA™

登顶权威榜单!无界动力发布全球首个「长时序双向物理因果链」隐空间世界模型 MWA™

当前,物理 AI 正面临着关于泛化能力的普遍质疑。当模型缺乏对真实物理规律的深度认知、难以跨越复杂多变的开放场景时,如何让机器人真正理解物理世界并精准规划决策,已成为具身智能破局的关键。

来自主题: AI技术研报
8283 点击    2026-06-30 10:48