AI资讯新闻榜单内容搜索-VLA

AITNT-国内领先的一站式人工智能新闻资讯网站
# 热门搜索 #
搜索: VLA
T-RO综述重构Foundation Model时代机器人操作知识版图

T-RO综述重构Foundation Model时代机器人操作知识版图

T-RO综述重构Foundation Model时代机器人操作知识版图

过去几年,机器人操作领域几乎被一批新概念重新 “刷屏”。 LLM Planner、VLA、Diffusion Policy、Flow Matching、Latent Action、World Mode

来自主题: AI技术研报
7956 点击    2026-09-04 15:48
今年最难的机器人Demo,“机器人含量”为0

今年最难的机器人Demo,“机器人含量”为0

今年最难的机器人Demo,“机器人含量”为0

今年5月,英伟达机器人负责人Jim Fan在一场公开演讲中宣告:VLA、遥操已死。

来自主题: AI资讯
6109 点击    2026-09-03 09:51
UniSteer用机械臂「拼豆」:让人类指导进入VLA噪声空间强化学习

UniSteer用机械臂「拼豆」:让人类指导进入VLA噪声空间强化学习

UniSteer用机械臂「拼豆」:让人类指导进入VLA噪声空间强化学习

视觉 - 语言 - 动作模型(Vision-Language-Action Model,VLA)正在成为机器人操作的重要基础模型。经过少量示范微调后,VLA 已经能够完成抓取、放置、堆叠等多种任务。然而,一旦任务涉及精密接触、狭小容差或分布外位置,模型的成功率仍会明显下降。

来自主题: AI技术研报
8816 点击    2026-09-02 14:32
北大与微软亚研提出 BCP,让模型自己决定何时重规划

北大与微软亚研提出 BCP,让模型自己决定何时重规划

北大与微软亚研提出 BCP,让模型自己决定何时重规划

在 action chunking 已成为 VLA 标配的今天,「一次执行多少步」几乎被所有工作当作一个固定的超参数。

来自主题: AI技术研报
6345 点击    2026-08-20 14:22
解码提速15.1倍、多任务性能不降:复旦&引望WAM-Diff2打通自动驾驶VLA自回归—扩散转换

解码提速15.1倍、多任务性能不降:复旦&引望WAM-Diff2打通自动驾驶VLA自回归—扩散转换

解码提速15.1倍、多任务性能不降:复旦&引望WAM-Diff2打通自动驾驶VLA自回归—扩散转换

视觉 - 语言 - 动作(VLA)模型已成为端到端自动驾驶的主流技术路线,但基于自回归(AR)解码的现有架构面临双重结构性瓶颈:其一,逐 Token 串行生成导致推理延迟随序列长度线性增长,严重制约实时部署;其二,训练阶段依赖真实前缀的 teacher forcing 机制,使模型在推理时暴露于自身生成的误差之上,引发长时序累积的曝光偏差(exposure bias)。

来自主题: AI技术研报
6927 点击    2026-08-19 14:39
获高瓴等基金数亿元投资,LatentVerse:不想被叫世界模型公司,要做具身原生大脑|首发

获高瓴等基金数亿元投资,LatentVerse:不想被叫世界模型公司,要做具身原生大脑|首发

获高瓴等基金数亿元投资,LatentVerse:不想被叫世界模型公司,要做具身原生大脑|首发

独家获悉,具身智能公司LatentVerse已完成数亿元人民币种子轮融资,第一轮投资方包括高瓴创投、清流资本、智元、星动纪元及英诺天使等基金。LatentVerse选择的是第三条路线:不做VLA也不做如今大热的WAM,而是把VLM和世界模型统一在同一个架构里。

来自主题: AI资讯
8439 点击    2026-08-11 17:52
ECCV 2026|自驾VLA Scaling有戏了,北航清华DriveTeach-VLA:用图像轨迹打通驾驶场景与基模预训练

ECCV 2026|自驾VLA Scaling有戏了,北航清华DriveTeach-VLA:用图像轨迹打通驾驶场景与基模预训练

ECCV 2026|自驾VLA Scaling有戏了,北航清华DriveTeach-VLA:用图像轨迹打通驾驶场景与基模预训练

本文主要介绍来自该团队的最新论文 Teaching Vision-Language-Action Models What to See and Where to Look,目前该论文已经被 ECCV 2026 正式接收,相关代码和模型已全部开源。

来自主题: AI技术研报
8381 点击    2026-08-11 10:22
Physical AI正进入经验工程时代,Ropedia聚焦全链路数据基建,完成数千万美元融资

Physical AI正进入经验工程时代,Ropedia聚焦全链路数据基建,完成数千万美元融资

Physical AI正进入经验工程时代,Ropedia聚焦全链路数据基建,完成数千万美元融资

天使轮由一线美元基金,智能制造与大模型产业方共同领投;数据集 Xperience-10M 位列全平台数据集榜第 2 名,具身赛道第一名,目前已被多款具身基础模型 Qwen-VLA、MolmoMotion 等采用;多模态采集系统 HOMIE 进入规模化量产交付,新一代系统将于 2026 年 8 月发布。

来自主题: AI资讯
10768 点击    2026-08-06 15:42