AI资讯新闻榜单内容搜索-VLA

AITNT-国内领先的一站式人工智能新闻资讯网站
# 热门搜索 #
搜索: VLA
Zero-Shot、长记忆、抗干扰,DM0.5把VLA带进真实世界

Zero-Shot、长记忆、抗干扰,DM0.5把VLA带进真实世界

Zero-Shot、长记忆、抗干扰,DM0.5把VLA带进真实世界

今天原力灵机正式发布的 DM0.5 往前推进了一步。它不只是继续提高某些固定任务上的表现,而是围绕真实世界里的泛化问题做了一次系统突。 如果深入分析,就会发现 DM0.5 这几个核心提升,都是想解决一个问题:如何让具身模型从可控环境里的能力演示,走向开放环境里的稳定执行。

来自主题: AI技术研报
8155 点击    2026-07-10 10:40
蚂蚁灵波开源具身操作基座模型LingBot-VLA 2.0!5万小时真机数据,撕开行业最大痛点

蚂蚁灵波开源具身操作基座模型LingBot-VLA 2.0!5万小时真机数据,撕开行业最大痛点

蚂蚁灵波开源具身操作基座模型LingBot-VLA 2.0!5万小时真机数据,撕开行业最大痛点

当机器人后空翻刷屏时,代表小脑已经在快速进展。但你是否意识到,让机器人真正干活卡脖子的从来不是小脑,而是大脑?蚂蚁灵波刚刚开源的LingBot-VLA2.0,用同一套模型「驯服」了20种的机器人构型。行业终于有人开始认真算重复适配成本这笔账了。

来自主题: AI资讯
10384 点击    2026-07-08 15:20
具身智能空间视觉死穴,终于被最新顶会彻底解决!

具身智能空间视觉死穴,终于被最新顶会彻底解决!

具身智能空间视觉死穴,终于被最新顶会彻底解决!

VLA 大模型看似强大,却被一个致命弱点扼住喉咙——相机稍微挪动几毫米,操作成功率就能暴跌一半。招商局先进技术研究院下属实验室提出新的移动数据范式,首次在真实机器人系统上证明:让相机动起来采集数据,就能以极低成本破解 VLA 的空间泛化瓶颈,且效果普适于多种主流架构。被一个致命弱点扼住喉咙——相机稍微挪动几毫米,操作成功率就能暴跌一半。

来自主题: AI技术研报
8959 点击    2026-07-08 09:46
所有AI创作工具,都该学学 MVLAND 这个功能

所有AI创作工具,都该学学 MVLAND 这个功能

所有AI创作工具,都该学学 MVLAND 这个功能

最近《在超市后门抽烟的二人》这部剧挺火的,尤其是里面的音乐我很喜欢,所以就想着做一个真人版音乐短片,正好发现美图旗下的 MVLAND 上线了创意画布模式,接入 Seedance2.0、可灵、HappyHorse 等顶尖视频生成模型。

来自主题: AI资讯
11157 点击    2026-07-05 10:16
怎么量化机器人数据价值?ATHENA将影响函数扩展到十亿参数VLA,313×加速筛选高价值数据

怎么量化机器人数据价值?ATHENA将影响函数扩展到十亿参数VLA,313×加速筛选高价值数据

怎么量化机器人数据价值?ATHENA将影响函数扩展到十亿参数VLA,313×加速筛选高价值数据

具身智能正在进入数据 scaling 时代。Vision-Language-Action(VLA)模型让机器人可以从大规模示教数据(demonstrations)中学习更通用的操作策略。但对机器人 VLA 训练来说,数据并不总是越多越好:低质量数据可能会拖累模型性能,而每一条 demonstration 都意味着昂贵的人力采集、机器人运行,以及云端存储和训练成本。

来自主题: AI技术研报
9893 点击    2026-07-03 09:48
不再只是「会走路的双臂平台」:OpenHLM解放人形机器人的全身移动操作能力

不再只是「会走路的双臂平台」:OpenHLM解放人形机器人的全身移动操作能力

不再只是「会走路的双臂平台」:OpenHLM解放人形机器人的全身移动操作能力

人类在日常生活中协调全身来完成移动操作任务:打开垃圾桶时会踩下踏板,从低处拿东西时需要下蹲,推车时需要同步协调手臂抓握和腿部移动。对试图复刻人类能力的人形机器人来说,身体不应只是「手臂 + 移动平台」,而应是一个能协调手、腰、腿、脚共同完成任务的运动整体。

来自主题: AI技术研报
6697 点击    2026-06-29 09:21
腾讯Robotics X开源HyVLA-0.5:基于亚毫米级指套UMI与真机强化,摆脱繁重遥操

腾讯Robotics X开源HyVLA-0.5:基于亚毫米级指套UMI与真机强化,摆脱繁重遥操

腾讯Robotics X开源HyVLA-0.5:基于亚毫米级指套UMI与真机强化,摆脱繁重遥操

6 月 15 日,腾讯 Robotics X、福田实验室与混元团队联合发布面向真实世界机器人操作任务的端到端具身智能模型 Hy-Embodied-0.5-VLA(简称 HyVLA-0.5)。

来自主题: AI技术研报
11568 点击    2026-06-16 10:21
RSS2026 | 强泛化强迁移VLA,上海创智学院×上海交大提出MINT:让VLA从模仿轨迹走向理解意图

RSS2026 | 强泛化强迁移VLA,上海创智学院×上海交大提出MINT:让VLA从模仿轨迹走向理解意图

RSS2026 | 强泛化强迁移VLA,上海创智学院×上海交大提出MINT:让VLA从模仿轨迹走向理解意图

机器人视觉语言动作(Vision-Language-Action, VLA)模型越来越多地开始展示叠衣服、倒茶、做咖啡等复杂操作。但是,今天的大多数 VLA 更像 “展台机器人”。

来自主题: AI技术研报
10358 点击    2026-06-10 14:40