AI资讯新闻榜单内容搜索-CMU

AITNT-国内领先的一站式人工智能新闻资讯网站
# 热门搜索 #
搜索: CMU
33%!Claude、GPT、Gemini 在真实网站上集体翻车,ClawBench 把 AI agent 打回原形

33%!Claude、GPT、Gemini 在真实网站上集体翻车,ClawBench 把 AI agent 打回原形

33%!Claude、GPT、Gemini 在真实网站上集体翻车,ClawBench 把 AI agent 打回原形

如果你觉得 AI agent 离帮你订机票、填报销单、投简历只有一步之遥,那 MMLU-Pro 的作者联合滑铁卢大学 TIGER Lab,UBC NAIL Group 和 UniPat AI,CMU 等机构刚刚放出的这项研究,可能会让你冷静下来。

来自主题: AI技术研报
8078 点击    2026-09-02 14:33
红杉高瓴押注了一名 CMU 博士:AI 文件搜索公司 Clipto 完成 1500 万美元融资

红杉高瓴押注了一名 CMU 博士:AI 文件搜索公司 Clipto 完成 1500 万美元融资

红杉高瓴押注了一名 CMU 博士:AI 文件搜索公司 Clipto 完成 1500 万美元融资

AI 文件搜索公司 Clipto 完成 1500 万美元融资,投后估值 2.5 亿美元,红杉中国、高瓴创投等参投,其创始人、CMU 博士 Henry Kang 带领团队利用 AI 为用户电脑中的视频、音频、图片和文档建立索引,公司年度经常性收入已达 1500 万美元。

来自主题: AI资讯
10041 点击    2026-09-01 12:51
斯坦福、MIT等发布全球最大系统提示词库

斯坦福、MIT等发布全球最大系统提示词库

斯坦福、MIT等发布全球最大系统提示词库

最近来自斯坦福大学、CMU、MIT、UT Austin 等高校和科研机构的研究人员联合发布了全球首个系统提示词库 System Prompt Index(systempromptindex.ai),其中汇集了来自 Claude、ChatGPT 等 400 多款 AI 产品的 1000 余个系统提示词,是目前全球规模最大的 AI 系统提示词库。

来自主题: AI资讯
9575 点击    2026-08-16 00:22
世界模型评测的最大盲区,被新基准MemoBench捅破了

世界模型评测的最大盲区,被新基准MemoBench捅破了

世界模型评测的最大盲区,被新基准MemoBench捅破了

来自哈佛大学、MIT、IBM、波士顿大学、谷歌、JHU、CMU 和 Kempner Institute 的研究者提出了一个新的诊断性基准:MemoBench。这是首个面向动态环境的「消失-重现」世界建模评测基准,并已被计算机视觉顶会 ECCV 2026 接收。其一作 Haoyu Chen 为哈佛大学计算科学与工程专业一年级硕士生,师从哈佛大学计算机科学助理教授 Yilun Du。

来自主题: AI技术研报
8288 点击    2026-07-06 12:24
只用15%数据,多模态指令微调反超全量训练15.8%!

只用15%数据,多模态指令微调反超全量训练15.8%!

只用15%数据,多模态指令微调反超全量训练15.8%!

来自上海交大、马来亚大学、CMU、MBZUAI、KIT和KAUST的团队提出VisNec(Visual Necessity Score,视觉必要性分数),用一个分数衡量每条训练样本里“图像到底起了多大作用”,被ECCV 2026收录。

来自主题: AI技术研报
8349 点击    2026-07-04 10:47
邢波再出手:上次「骂」完世界模型,这次轮到智能体了

邢波再出手:上次「骂」完世界模型,这次轮到智能体了

邢波再出手:上次「骂」完世界模型,这次轮到智能体了

去年夏天,MBZUAI 校长、CMU 教授邢波一篇《世界模型批评》吸引了研究社区广泛关注,他从科幻经典《沙丘》里「完美模拟现实」的想象出发,逐一拆解了当下几大世界模型流派的硬伤,提出了一套新架构,也由此引出了他与 Yann LeCun 之间一场关于「世界模型到底该怎么造」的公开辩论。

来自主题: AI技术研报
7413 点击    2026-07-01 15:43
陈天奇新书上线:面向ML系统的现代GPU编程

陈天奇新书上线:面向ML系统的现代GPU编程

陈天奇新书上线:面向ML系统的现代GPU编程

前些天,CMU 助理教授、TVM/XGBoost/MLC-LLM 的创造者陈天奇发布了一本免费在线书籍《Modern GPU Programming For MLSys(面向机器学习系统的现代 GPU 编程)》。

来自主题: AI资讯
8675 点击    2026-06-27 15:49
「这可能是人类写的最后一篇论文」Stanford、Michigan、CMU 等 37 位学者联手:把论文从 PDF 改写成 AI 能直接执行的研究包

「这可能是人类写的最后一篇论文」Stanford、Michigan、CMU 等 37 位学者联手:把论文从 PDF 改写成 AI 能直接执行的研究包

「这可能是人类写的最后一篇论文」Stanford、Michigan、CMU 等 37 位学者联手:把论文从 PDF 改写成 AI 能直接执行的研究包

我们今天以 PDF 写论文的方式,已经持续了三百多年。然而论文其实是把一段混乱反复、充满试错的真实研究,讲成一个干净利落、足以服人的完美故事。

来自主题: AI技术研报
11388 点击    2026-06-05 09:25
Claude Code和机器人背后的共同机制,UIUC、Meta、Stanford这篇最新综述讲清楚了

Claude Code和机器人背后的共同机制,UIUC、Meta、Stanford这篇最新综述讲清楚了

Claude Code和机器人背后的共同机制,UIUC、Meta、Stanford这篇最新综述讲清楚了

说在前面:这又是一篇讲Harness的Survey,你最近可能已经看过了数篇讲Harness的文章、论文,其中还可能包括我上周解读的《Agent Harness Engineering:Agent的底盘工程综述|CMU、耶鲁、Amazon》。

来自主题: AI技术研报
11930 点击    2026-05-27 08:46
Agent Harness Engineering:Agent的底盘工程综述|CMU、耶鲁、Amazon

Agent Harness Engineering:Agent的底盘工程综述|CMU、耶鲁、Amazon

Agent Harness Engineering:Agent的底盘工程综述|CMU、耶鲁、Amazon

经常切换使用CC、Codex、OpenClaw这类Agent的人会发现:同一个模型,放进不同系统里,表现可能完全不同。

来自主题: AI技术研报
12345 点击    2026-05-19 14:58