在数学上把稀疏注意力做对!腾讯Hy开源HiLS-Attention: 计算更少效果更好, 外推512倍
在数学上把稀疏注意力做对!腾讯Hy开源HiLS-Attention: 计算更少效果更好, 外推512倍让大模型 "读得更长" 一直是 Agent、深度推理和海量资料整合等场景的刚需,但标准全注意力机制的计算量随序列长度呈平方级增长,始终是横亘在长上下文建模面前的三座大山。
搜索
让大模型 "读得更长" 一直是 Agent、深度推理和海量资料整合等场景的刚需,但标准全注意力机制的计算量随序列长度呈平方级增长,始终是横亘在长上下文建模面前的三座大山。
如果你走进2026 WAIC的现场,最直观的感受可能只有一个“卷”字。
在计算历史的绝大部分时间里,编程的本质是一项翻译工作:开发者需要在人类理解的维度上剖析问题,设计抽象方案,随后将其转译为机器能够执行的语法。当前的软件工程领域正在经历自高级编程语言问世以来最为显著的变化。
7月17日至20日,2026世界人工智能大会暨人工智能全球治理高级别会议(WAIC 2026)在上海世博、张江、西岸“三地四馆”同步启幕。
让大模型给一张图片打“质量分”,它其实经常看走眼。
Databricks 表示 正在进行由 Coatue Management 领投的新一轮融资,公司估值为 1880 亿美元,比去年 12 月上次融资后的估值增长 40%,也高于上个月 The Information 报道 公司曾在考虑的 1750 亿美元估值。
7 月 20 日,Meshy 宣布完成近 4 亿美元 B 轮融资,投后估值超过 100 亿元人民币。这是它成立以来第一次对外公布估值,一出手就刷新了 AI 3D 赛道单轮融资规模与估值两项纪录。据公司披露,这也是全球 AI 3D 领域迄今最高的一个估值。
2026 年 Agent 全球火爆,黄仁勋称赞 OpenClaw 是 “当代最重磅的软件” 连代安装都成了赚钱生意。但在国内,这类开源 Agent 由于其数据泄露、权限裸奔等风险在办公场景一度遭遇落地寒冬。
过去一年,Deep Research Agent 被视为大模型落地的下一个突破口,它们会检索、能用工具、可多步推理,在一个个榜单上高歌猛进。但把它们放到真实世界的专业场景里,表现是否也同样亮眼?
市面上已有几十种Agent记忆方案,有的基于向量检索,有的基于知识图谱,有的靠定期总结“压缩”对话,有的则完全依赖模型自身的上下文窗口。它们各有各的说法,但在系统层面,到底哪种方案靠得住?哪种方案在你的工作负载下既不贵又准?