AI资讯新闻榜单内容搜索-模型训练

AITNT-国内领先的一站式人工智能新闻资讯网站
# 热门搜索 #
搜索: 模型训练
3.8万小时、狂烧天价token:字节发现Agent的 Scaling Law

3.8万小时、狂烧天价token:字节发现Agent的 Scaling Law

3.8万小时、狂烧天价token:字节发现Agent的 Scaling Law

7月2日,字节 Seed 发布了一个 Agent评测项目 EdgeBench。看起来又是一个 benchmark,但它问了一个其他榜单不问的问题。EdgeBench 的切口就是把盲区里的东西放进评测,解答一个问题:把Agent扔进一个陌生环境,12小时后,你能变强多少?

来自主题: AI技术研报
8659 点击    2026-07-08 15:53
竞赛编程Agent进入全球前十!南大、清华新模型CF rating超3500

竞赛编程Agent进入全球前十!南大、清华新模型CF rating超3500

竞赛编程Agent进入全球前十!南大、清华新模型CF rating超3500

大语言模型在代码生成上的能力不断增强,但在复杂算法题,尤其是竞赛编程场景中,仍然容易因为算法选择错误、边界条件遗漏、复杂度判断失误或隐藏测试覆盖不足而失败。Solvita是一款面向竞赛编程的智能体框架,通过四个角色(Planner、Solver、Oracle、Hacker)形成闭环系统,并利用可训练的图结构知识网络积累经验。

来自主题: AI技术研报
8764 点击    2026-07-08 15:09
提示词压缩竟成大模型新漏洞?港科大提出黑盒攻击框架COMA | ASE 2026

提示词压缩竟成大模型新漏洞?港科大提出黑盒攻击框架COMA | ASE 2026

提示词压缩竟成大模型新漏洞?港科大提出黑盒攻击框架COMA | ASE 2026

现在的 AI Agent 动辄需要处理超长上下文,既要看系统提示词、工具说明,又要翻阅历史对话和检索文档。为了省钱、省算力并降低延迟,很多开发者会给系统加上 “提示词压缩”(Prompt Compression)模块,把冗长的上下文浓缩后再喂给大模型。

来自主题: AI技术研报
8792 点击    2026-07-08 15:03
中国科学院携手全球顶尖机构发布首个十亿参数级的手术视频基础模型SurgMotion!

中国科学院携手全球顶尖机构发布首个十亿参数级的手术视频基础模型SurgMotion!

中国科学院携手全球顶尖机构发布首个十亿参数级的手术视频基础模型SurgMotion!

手术 AI 正在从 “单帧感知” 迈向 “全流程视频理解” 的全新时代!近日,由中国科学院香港创新研究院人工智能与机器人创新中心领衔,发布了全球首个十亿级参数、最大规模数据集练成的手术视频原生基础模型 ——SurgMotion!

来自主题: AI技术研报
8324 点击    2026-07-08 15:03
AI生图免训练提速1000%,办法:最简洁的“三阶段流水线”

AI生图免训练提速1000%,办法:最简洁的“三阶段流水线”

AI生图免训练提速1000%,办法:最简洁的“三阶段流水线”

MrFlow(Multi-Resolution Flow Matching)就用这样的三阶段,在Qwen-Image等模型上把端到端生成时间从49.32s压到4.77s,实际加速10.35x。文章发布当日即登上Hugging Face Daily Papers;发布三天内,GitHub已收获200+stars;目前也已登上Hugging Face Trending Papers。

来自主题: AI技术研报
8372 点击    2026-07-08 15:02
王阳明心学,被Anthropic用来教Claude做人了

王阳明心学,被Anthropic用来教Claude做人了

王阳明心学,被Anthropic用来教Claude做人了

王阳明心学,竟然在AI时代迎来了「最佳赏味期」?老哈,一个研究了十年「知行合一」的哲学教授,正在把这套500年前的心学,用到全球最前沿的AI对齐训练上。不是比喻。是字面意思。

来自主题: AI资讯
8593 点击    2026-07-08 10:08
具身智能空间视觉死穴,终于被最新顶会彻底解决!

具身智能空间视觉死穴,终于被最新顶会彻底解决!

具身智能空间视觉死穴,终于被最新顶会彻底解决!

VLA 大模型看似强大,却被一个致命弱点扼住喉咙——相机稍微挪动几毫米,操作成功率就能暴跌一半。招商局先进技术研究院下属实验室提出新的移动数据范式,首次在真实机器人系统上证明:让相机动起来采集数据,就能以极低成本破解 VLA 的空间泛化瓶颈,且效果普适于多种主流架构。被一个致命弱点扼住喉咙——相机稍微挪动几毫米,操作成功率就能暴跌一半。

来自主题: AI技术研报
8548 点击    2026-07-08 09:46
让Skill“有图可依”:openJiuwen首发多模态Skill范式Skill-Omni

让Skill“有图可依”:openJiuwen首发多模态Skill范式Skill-Omni

让Skill“有图可依”:openJiuwen首发多模态Skill范式Skill-Omni

针对这一问题,openJiuwen社区正式发布Skill-Omni——业界最早工程化落地的多模态Skill范式。 它让Agent的经验从“读得懂”升级为“看得见”,把网页和视频中的视觉知识,沉淀为Agent可复用的多模态Skill。

来自主题: AI技术研报
9410 点击    2026-07-08 09:45
刚刚,翁荔博客又上新:通过Harness工程实现AI自我提升

刚刚,翁荔博客又上新:通过Harness工程实现AI自我提升

刚刚,翁荔博客又上新:通过Harness工程实现AI自我提升

刚刚,翁荔(Lilian Weng)又更新博客了!距离她上一次更新《谨慎对待 Scaling Law》还不到 10 天。这一次,她书写的主题是当前大热的 Harness Engineering,聚焦的正是当下 AI 研究最前沿一个环节:当模型本身的智能已经足够强大时,真正决定它能走多远的,或许是包裹在模型外面的那层「Harness」也就是负责编排模型思考、调用工具、管理上下文、评估结果的那套系统。

来自主题: AI技术研报
9344 点击    2026-07-08 00:04
刚刚,DeepSeek 文档更新,Agent 开发者要注意这个字段

刚刚,DeepSeek 文档更新,Agent 开发者要注意这个字段

刚刚,DeepSeek 文档更新,Agent 开发者要注意这个字段

刚刚,DeepSeek 在官方 API 文档里给出了一个 thinking mode 和 tool call 结合使用的样例。表面上看,这只是一个常规的工具调用演示:用户提出问题,模型判断需要调用工具,工具返回结果后,模型再继续生成答案。

来自主题: AI技术研报
9522 点击    2026-07-07 15:16