AI资讯新闻榜单内容搜索-RL

AITNT-国内领先的一站式人工智能新闻资讯网站
# 热门搜索 #
搜索: RL
围观WAIC模型「读心术」!现场火火火火火

围观WAIC模型「读心术」!现场火火火火火

围观WAIC模型「读心术」!现场火火火火火

如果你走进2026 WAIC的现场,最直观的感受可能只有一个“卷”字。

来自主题: AI资讯
6330 点击    2026-07-20 15:01
极佳视界通用世界模型成WAIC焦点:从生成到行动,这才是物理AGI的最佳打开方式

极佳视界通用世界模型成WAIC焦点:从生成到行动,这才是物理AGI的最佳打开方式

极佳视界通用世界模型成WAIC焦点:从生成到行动,这才是物理AGI的最佳打开方式

极佳视界把一套完整的「通用世界模型」产品矩阵摆到了现场:从面向内容创作的一粟 YiSu,到面向自动驾驶数据与仿真的 DriveDreamer;从面向具身智能的 GigaWorld,到负责把世界理解转化为行动的 GigaBrain 与 GigaWorld-Policy;再到进入家庭场景的拾光 S1,以及面向智能制造的 Maker H01。

来自主题: AI资讯
8153 点击    2026-07-19 10:12
星尘智能甩出20+超难家务自主,具身模型圈:不要再卷了

星尘智能甩出20+超难家务自主,具身模型圈:不要再卷了

星尘智能甩出20+超难家务自主,具身模型圈:不要再卷了

WAIC 前夕,星尘智能(Astribot)新模型 Lumo-2,直接在官网甩出 20 + 真机视频 ——这背后,是星尘智能发布的第二代具身基座模型,也是业内首个面向家庭场景的隐式世界 - 动作模型(Latent World-Action Model),同步发的,还智能体 Agent Philia。

来自主题: AI资讯
8637 点击    2026-07-18 10:36
具身数采新方案:数字遥操作,现已开源,达摩院出品

具身数采新方案:数字遥操作,现已开源,达摩院出品

具身数采新方案:数字遥操作,现已开源,达摩院出品

阿里巴巴达摩院的最新工作RynnWorld-Teleop对此给出的方案是:用生成式世界模型替代真实机器人。操作员的手势驱动一个实时视频生成器,由“数字世界中的机器人”完成全部视觉演示,同时自动获得关节级的动作标签。该方案被称为数字遥操作(Digital Teleoperation)。

来自主题: AI技术研报
9353 点击    2026-07-18 10:11
机器人需要「看到三维未来」!RynnWorld-4D重塑4D具身世界模型

机器人需要「看到三维未来」!RynnWorld-4D重塑4D具身世界模型

机器人需要「看到三维未来」!RynnWorld-4D重塑4D具身世界模型

近两年,视频生成模型在具身智能领域受到持续关注。从 UniPi、SuSIE 到各类 action-conditioned video generation 变体,其核心思路一致:先由模型生成一段未来视频,再从中提取动作信号供机器人执行。

来自主题: AI技术研报
9271 点击    2026-07-17 10:12
大模型RL训练为何会「越训越窄」?ACL Outstanding Paper从token-level熵变揭示RLVR训练机制

大模型RL训练为何会「越训越窄」?ACL Outstanding Paper从token-level熵变揭示RLVR训练机制

大模型RL训练为何会「越训越窄」?ACL Outstanding Paper从token-level熵变揭示RLVR训练机制

基于可验证奖励的强化学习(Reinforcement Learning with Verifiable Rewards,RLVR)正在成为大模型后训练的关键技术。数学题能判对错,代码能跑测试,可验证奖励让大模型可以通过强化学习持续提升推理能力。

来自主题: AI技术研报
9942 点击    2026-07-16 10:10
世界模型迎来「真考场」:WorldArena 2.0 Challenge正式启动

世界模型迎来「真考场」:WorldArena 2.0 Challenge正式启动

世界模型迎来「真考场」:WorldArena 2.0 Challenge正式启动

WorldArena 1.0 的核心意义,在于将世界模型评测从 “好不好看” 推进到 “是否真的有用”。它不再只关注视频观感,而是把物理一致性、可控性、3D 准确性和具身任务功能性纳入统一评测框架,使许多看似流畅的生成结果第一次在机器人具身任务中接受检验。

来自主题: AI技术研报
8881 点击    2026-07-16 10:10
AI打工大排行:Claude Fable 5自动赚钱的能力,是GPT-5.5的2.5倍

AI打工大排行:Claude Fable 5自动赚钱的能力,是GPT-5.5的2.5倍

AI打工大排行:Claude Fable 5自动赚钱的能力,是GPT-5.5的2.5倍

Fable 5 在远程劳动力指数(Remote Labor Index,RLI)上拿到了 16.1% 的自动化率,几乎是第二名 Opus 4.8(8.3%)的两倍,更是第三名 GPT-5.5(6.3%)的 2.5 倍。

来自主题: AI资讯
8524 点击    2026-07-12 16:38