AI资讯新闻榜单内容搜索-上下文

AITNT-国内领先的一站式人工智能新闻资讯网站
# 热门搜索 #
搜索: 上下文
深度|当AI开始构建自己:零犀如何把模型自进化带进真实商业世界

深度|当AI开始构建自己:零犀如何把模型自进化带进真实商业世界

深度|当AI开始构建自己:零犀如何把模型自进化带进真实商业世界

过去很长一段时间里,AI 行业衡量模型进步的方式都相当直观:参数更大、榜单更高、推理更强、上下文更长。每一次模型发布,行业都会盯着数学、代码、知识问答和多模态基准测试,看它是否又向通用智能迈近了一步。

来自主题: AI资讯
7845 点击    2026-06-15 14:21
BudgetMem:给Runtime Agent Memory装上「预算路由器」,让记忆系统学会按需分配运行成本

BudgetMem:给Runtime Agent Memory装上「预算路由器」,让记忆系统学会按需分配运行成本

BudgetMem:给Runtime Agent Memory装上「预算路由器」,让记忆系统学会按需分配运行成本

当 LLM Agent 处理长期对话、多轮交互和复杂文档时,Memory 已经成为不可或缺的核心模块。它帮助智能体保存历史、检索信息、维持个性化上下文,并支撑跨时间的推理能力。

来自主题: AI技术研报
8889 点击    2026-06-15 09:20
速递|致开发者:GLM-5.2全量开放,前沿智能属于所有人

速递|致开发者:GLM-5.2全量开放,前沿智能属于所有人

速递|致开发者:GLM-5.2全量开放,前沿智能属于所有人

GLM-5.2 是智谱迄今能力最强的开源模型,支持真正可用的 1M 上下文,并在长程任务中继续保持领先。它也依旧是我们心中最强的国产 Coding 模型。

来自主题: AI资讯
8309 点击    2026-06-13 20:15
教你一招在Codex里用上Claude Code

教你一招在Codex里用上Claude Code

教你一招在Codex里用上Claude Code

所以,教你一招把Claude code塞进Codex里。所以我现在的工位长这样——左边是 GPT,右边跑着 Claude Code,同一个窗口。Codex负责管规划、把控进度,Claude code负责干活;Fable 拒答降级的时候,直接复制上下文丢给左边的GPT接住,无缝换人。

来自主题: AI资讯
9078 点击    2026-06-13 10:37
Kimi最强编程模型Kimi K2.7 Code来了:Token消耗直降30%,过度思考有救了,附一手实测

Kimi最强编程模型Kimi K2.7 Code来了:Token消耗直降30%,过度思考有救了,附一手实测

Kimi最强编程模型Kimi K2.7 Code来了:Token消耗直降30%,过度思考有救了,附一手实测

今天,月之暗面发布并开源Kimi K2.7 Code编程模型,参数量达1.1万亿,提供256K上下文窗口。这一模型重点提升了长上下文编程场景的指令遵循能力、长程编程任务的性能表现,并且大幅改善了在长程任务中的过度思考倾向,平均token消耗减少30%。

来自主题: AI资讯
10486 点击    2026-06-13 00:31
一篇综述看懂 agent context compression:怎么压、压什么、谁来压

一篇综述看懂 agent context compression:怎么压、压什么、谁来压

一篇综述看懂 agent context compression:怎么压、压什么、谁来压

LLM Agent 做长任务时,真正让人头疼的往往不是模型不会推理,而是上下文开始失控:前几步还很清楚,后面就忘约束、丢状态、重复试错,最后把任务跑成事故现场。

来自主题: AI技术研报
8950 点击    2026-06-11 14:32
一个8×8矩阵,让大模型「记住」长对话:Mind Lab联合NTU、复旦推出δ-mem,参数仅0.12%

一个8×8矩阵,让大模型「记住」长对话:Mind Lab联合NTU、复旦推出δ-mem,参数仅0.12%

一个8×8矩阵,让大模型「记住」长对话:Mind Lab联合NTU、复旦推出δ-mem,参数仅0.12%

不扩上下文窗口、不换骨干架构、不做全参数微调 —— 只需要一个 8×8 的在线状态矩阵,就能让冻结的 Transformer 拥有真正的长期记忆。

来自主题: AI技术研报
10898 点击    2026-06-08 14:50