AI资讯新闻榜单内容搜索-模型训练

AITNT-国内领先的一站式人工智能新闻资讯网站
# 热门搜索 #
搜索: 模型训练
港科大新发现:MoE路由很脆弱!重复token输入阻塞负载均衡 | ICML'26

港科大新发现:MoE路由很脆弱!重复token输入阻塞负载均衡 | ICML'26

港科大新发现:MoE路由很脆弱!重复token输入阻塞负载均衡 | ICML'26

来自港科大的研究团队提出了RepetitionCurse,这是一种针对MoE大模型服务的黑盒压力测试方法。它不需要模型权重,不需要梯度,也不需要知道后端专家如何部署,只利用高度重复的输入模式,就能诱导专家路由把大量token路由到同一小批专家上。

来自主题: AI技术研报
8793 点击    2026-07-19 10:11
不换模型,效果提升104%!上海AI Lab让Harness也能自进化了

不换模型,效果提升104%!上海AI Lab让Harness也能自进化了

不换模型,效果提升104%!上海AI Lab让Harness也能自进化了

上海人工智能实验室团队提出的Self-Harness,近期被LangChain CEO、联合创始人Harrison Chase转发,也被前OpenAI副总裁Lilian Weng收进自进化Agent相关博客。它盯上的不是换模型,而是Agent外层那套Harness。

来自主题: AI技术研报
8609 点击    2026-07-18 19:10
具身数采新方案:数字遥操作,现已开源,达摩院出品

具身数采新方案:数字遥操作,现已开源,达摩院出品

具身数采新方案:数字遥操作,现已开源,达摩院出品

阿里巴巴达摩院的最新工作RynnWorld-Teleop对此给出的方案是:用生成式世界模型替代真实机器人。操作员的手势驱动一个实时视频生成器,由“数字世界中的机器人”完成全部视觉演示,同时自动获得关节级的动作标签。该方案被称为数字遥操作(Digital Teleoperation)。

来自主题: AI技术研报
9341 点击    2026-07-18 10:11
ECCV 2026|Google等推出VGGRPO:用4D隐空间奖励实现世界一致的视频生成

ECCV 2026|Google等推出VGGRPO:用4D隐空间奖励实现世界一致的视频生成

ECCV 2026|Google等推出VGGRPO:用4D隐空间奖励实现世界一致的视频生成

最近,来自 Google、哥本哈根大学、牛津大学等机构的研究者提出了 VGGRPO(Visual Geometry GRPO,收录于 ECCV 2026)。这项工作聚焦于一个核心问题:如何在不牺牲预训练模型泛化能力的前提下,高效地提升视频生成的几何一致性,并使其适用于动态场景。其核心思路是,在隐空间(latent space)中利用 4D 几何奖励,进行几何感知的视频后训练。

来自主题: AI技术研报
9165 点击    2026-07-18 10:09
FreeStyle来了!从社区LoRA中挖掘风格与内容,让双参考图像生成更可控

FreeStyle来了!从社区LoRA中挖掘风格与内容,让双参考图像生成更可控

FreeStyle来了!从社区LoRA中挖掘风格与内容,让双参考图像生成更可控

最近,一篇名为 FreeStyle: Free Control of Style-Content Dual-Reference Generation from Community LoRA Mining 的工作引起了不少关注。换句话说,FreeStyle 研究的是 style-content dual-reference generation,也就是「内容 - 风格双参考生成」。

来自主题: AI技术研报
7433 点击    2026-07-18 10:09
RoboTwin原班团队再下场,构建具身评测珠峰

RoboTwin原班团队再下场,构建具身评测珠峰

RoboTwin原班团队再下场,构建具身评测珠峰

曾推出 RoboTwin 系列基准的团队发布了 RoboDojo,一套统一覆盖仿真与真实机器人操作的具身智能评测体系。它包含 42 个仿真任务、18 个真实机器人任务,并将 30 个代表性机器人策略放到同一套标准下比较。

来自主题: AI技术研报
8464 点击    2026-07-18 10:08
机器人需要「看到三维未来」!RynnWorld-4D重塑4D具身世界模型

机器人需要「看到三维未来」!RynnWorld-4D重塑4D具身世界模型

机器人需要「看到三维未来」!RynnWorld-4D重塑4D具身世界模型

近两年,视频生成模型在具身智能领域受到持续关注。从 UniPi、SuSIE 到各类 action-conditioned video generation 变体,其核心思路一致:先由模型生成一段未来视频,再从中提取动作信号供机器人执行。

来自主题: AI技术研报
9261 点击    2026-07-17 10:12
ECCV'26| 看起来会动,还要动得合理:从生成模型中主动寻找物理证据

ECCV'26| 看起来会动,还要动得合理:从生成模型中主动寻找物理证据

ECCV'26| 看起来会动,还要动得合理:从生成模型中主动寻找物理证据

PhyMAGIC通过让物体动起来,从视频中提取物理证据,帮助准确推断材料属性。它结合图生视频与视觉语言模型,生成针对性运动探针,并不断修正物理参数,最终构建出可微分的3D动态模型,实现更符合现实的视频生成。

来自主题: AI技术研报
5312 点击    2026-07-17 10:09
让动态投机解码不再局限于DSpark:LightSpec首个开源动态MTP系统实现

让动态投机解码不再局限于DSpark:LightSpec首个开源动态MTP系统实现

让动态投机解码不再局限于DSpark:LightSpec首个开源动态MTP系统实现

随着 DeepSeek 发布 DSpark,动态 MTP(多 Token 预测)成为了对抗高并发、提升 GPU 利用率的绝对焦点。然而,DSpark 高度绑定特定模型且需要额外训练。

来自主题: AI技术研报
8856 点击    2026-07-17 10:08