AI资讯新闻榜单内容搜索-模型训练

AITNT-国内领先的一站式人工智能新闻资讯网站
# 热门搜索 #
搜索: 模型训练
ICML 2026 | 突破极限!港大提出首个适配300+任务的持续学习架构,破解遗忘难题

ICML 2026 | 突破极限!港大提出首个适配300+任务的持续学习架构,破解遗忘难题

ICML 2026 | 突破极限!港大提出首个适配300+任务的持续学习架构,破解遗忘难题

人类可以在一生中持续学习新知识,而不会轻易遗忘已有技能。然而对 AI 模型而言,这恰恰是一道极具挑战性的难题:每当模型学习新任务时,参数更新往往会覆盖历史知识,产生经典的 “灾难性遗忘” 难题。持续学习(Continual Learning)正是为突破这一瓶颈而生的研究方向。

来自主题: AI技术研报
7256 点击    2026-07-13 14:43
Claude Code砸的坑,蚂蚁安全在尝试填上

Claude Code砸的坑,蚂蚁安全在尝试填上

Claude Code砸的坑,蚂蚁安全在尝试填上

2026年,AI安全终于被推到了台前。

来自主题: AI资讯
9046 点击    2026-07-13 09:44
AI学会了像人脑一样遗忘,可编程遗忘机制为边缘AI计算“大减负”

AI学会了像人脑一样遗忘,可编程遗忘机制为边缘AI计算“大减负”

AI学会了像人脑一样遗忘,可编程遗忘机制为边缘AI计算“大减负”

近期,美国俄勒冈州立大学研发出一种新型成像传感器,不仅可在探测光线的同时进行图像存储(近期光照信息),还能实现信息的按需“遗忘”。

来自主题: AI技术研报
6400 点击    2026-07-13 09:42
ECCV 2026 | 实时导演多镜头长视频! 港中文&快手可灵发布ShotStream

ECCV 2026 | 实时导演多镜头长视频! 港中文&快手可灵发布ShotStream

ECCV 2026 | 实时导演多镜头长视频! 港中文&快手可灵发布ShotStream

为了打破多镜头长视频面临的高延迟、零交互困境,香港中文大学与快手可灵团队联合提出了首个实时流式多镜头长视频生成框架 ——ShotStream。该研究打破了传统双向架构的限制,将多镜头合成定义为基于历史上下文的下一镜头生成任务,用户可以通过动态流式提示词在运行时动态指导叙事走向!更令人振奋的是

来自主题: AI技术研报
6363 点击    2026-07-12 10:47
给多智能体LLM装上「图记忆工作流路由器」,搞定调用、协作规划

给多智能体LLM装上「图记忆工作流路由器」,搞定调用、协作规划

给多智能体LLM装上「图记忆工作流路由器」,搞定调用、协作规划

GraphPlanner通过引入图记忆网络,将多智能体LLM的路由过程升级为动态工作流生成。不仅选择调用哪个模型,还决定每个模型应承担的角色,实现任务分解与协作规划。

来自主题: AI技术研报
7389 点击    2026-07-12 10:46
北航、北大和美团联合提出:策略提升强化学习!

北航、北大和美团联合提出:策略提升强化学习!

北航、北大和美团联合提出:策略提升强化学习!

来自北航、北大、美团的研究团队提出了Policy Improvement Reinforcement Learning, PIRL,以及对应的落地算法 PIPO。这项工作关注的是大模型 RL 后训练中一个非常基础、但长期被默认跳过的问题:一次更新在当前数据上看起来优化了学习信号,是否就真的说明模型策略变强了?

来自主题: AI技术研报
7915 点击    2026-07-12 10:44
ICML 2026|小模型也能「指挥」大模型RL后训练:清华&腾讯提出GPS,最高减少69% Rollout成本

ICML 2026|小模型也能「指挥」大模型RL后训练:清华&腾讯提出GPS,最高减少69% Rollout成本

ICML 2026|小模型也能「指挥」大模型RL后训练:清华&腾讯提出GPS,最高减少69% Rollout成本

来自清华大学与腾讯的研究者提出了 Generalizable Predictive Prompt Selection(GPS)。GPS 的做法很直接:先训练一个小型、可泛化的 Prompt Predictive Model(PPM),让它预测不同 prompt 在当前模型下的难度;再根据难度和 batch 多样性选择训练样本,从而减少无效 rollout。

来自主题: AI技术研报
8268 点击    2026-07-11 11:16
ICML 2026 | 图像编辑进入「交互理解」时代,北大提出HOI-Edit基准与SCPE自纠错框架

ICML 2026 | 图像编辑进入「交互理解」时代,北大提出HOI-Edit基准与SCPE自纠错框架

ICML 2026 | 图像编辑进入「交互理解」时代,北大提出HOI-Edit基准与SCPE自纠错框架

本文发现图生视频(I2V)模型天然适合重构动态交互过程,并提出 SCPE(Self-Correcting Process Editing) 多智能体系统自纠错框架:利用视频生成过程暴露失败原因,再通过分析、反思和工具书更新迭代增强提示,使 I2V 模型在复杂 HOI 编辑中显著提升交互准确性与推理能力。

来自主题: AI技术研报
8822 点击    2026-07-11 11:15
跟AI说“出片穿搭”,它真能听懂!淘宝ShopX让大模型直接“卖货”了

跟AI说“出片穿搭”,它真能听懂!淘宝ShopX让大模型直接“卖货”了

跟AI说“出片穿搭”,它真能听懂!淘宝ShopX让大模型直接“卖货”了

团队提出了ShopX:一个面向agentic shopping的电商大模型。它不仅仅是在搜索框外面套一个会“说话”和“调用工具”的LLM,而是赋予模型直接进入商品空间的能力,让大模型成为商品履约的核心,学会在商品空间中规划、检索、排序、组合和生成结果,进而减少接口损耗。

来自主题: AI技术研报
9331 点击    2026-07-11 11:14
ACL 2026 | 用图异常检测抓出多智能体网络中的内鬼!XG-Guard:首个无监督、可解释、细粒度的MAS安全防线

ACL 2026 | 用图异常检测抓出多智能体网络中的内鬼!XG-Guard:首个无监督、可解释、细粒度的MAS安全防线

ACL 2026 | 用图异常检测抓出多智能体网络中的内鬼!XG-Guard:首个无监督、可解释、细粒度的MAS安全防线

研究团队提出了 XG-Guard (eXplainable and fine-Grained safeGuarding framework), 一个基于 GAD 且兼具可解释性和细粒度检测能力的无监督安全防护框架。目前工作已被 ACL 2026 Main Conference 接收。

来自主题: AI技术研报
7791 点击    2026-07-11 11:07