很久没读过这么通透的Agent的文章了。
很久没读过这么通透的Agent的文章了。Agent 执行任务的时候,会反复踩坑、不断试错,最后积累一些正确的经验。但这些经验通常只能停留在当前会话,或者当前 Agent 的记忆里,很难传给其他 AI。一个 Agent 调用某个 API,花了半个小时查文档、改参数,连续失败好几次,最后终于找到正确方法。
搜索
Agent 执行任务的时候,会反复踩坑、不断试错,最后积累一些正确的经验。但这些经验通常只能停留在当前会话,或者当前 Agent 的记忆里,很难传给其他 AI。一个 Agent 调用某个 API,花了半个小时查文档、改参数,连续失败好几次,最后终于找到正确方法。
多模型Agent系统显然是未来的趋势。cursor 的一篇很不错的文章。他们的最新研究表明,将前沿模型作为规划者和协调者,与一个更廉价的“主力”模型搭配,可以大幅降低项目中总token的成本,从而实现 15 倍的成本改进。
语核科技创始人翟星吉说,AI项目一定是高层驱动的,但真正主导的是业务部门。他的逻辑很值得琢磨:大部分公司买一个Agent产品,本质上不是买软件,是在做生产投资——就像制造业企业投资一条产线,买的是高级人力服务。 所以决策链路变成了:业务部门真的算出ROI,跑去跟老板说"这东西能帮我们提升产值或者降低成本",老板说"赶紧买"。
近日,Meta 首席 AI 官、被称为公司“最高薪员工”的 Alexandr Wang,因一句简单却极具挑衅意味的话引起热议:“gemini who?(Gemini,谁啊?)”这场口水战的背后,其实是一场 AI 巨头之间的公开较量——Meta 最新模型 Muse Spark 1.1 在一份模型排行榜中超过了谷歌刚发布的 Gemini 3.6 Flash
就在刚刚,Anthropic正式发布了Opus 5。这款定位是「深思熟虑且积极主动」的模型,不仅成本只要Fable 5的一半,而且在大多数跑分上直接碾压。在最近的IMO 2026中,它不靠任何外部工具和Agent框架,就拿下了42/42的满分!
腾讯微信在论文 SkillHone 中,将这个问题归结为优化历史丢失,进而提出了面向持续 Skill 进化的开发框架。 SkillHone 把每轮诊断、候选修改、评估证据和最终决定组织成持久决策历史。同时,持续优化的对象也从单一的 SKILL.md 文件扩展到了整个 Skill 文件夹及其修改过程。
2009年,李飞飞团队正式发布ImageNet。
先给你说个画面。上周三凌晨一点,我被手机震醒。不是闹钟,是闲鱼的消息提示。一个买家在问我那台吃灰的旧Xbox 360还在不在,能不能便宜五十。我半睡半醒回了个“在的,最多少二十”,然后翻个身接着睡。第二天早上打开一看,那个人凌晨一点半就把钱付了。就因为我半夜迷迷糊糊回了一句。
流量红利消逝,中国企业出海可以靠 Agent 破局吗?
谷歌的前端功底有多深,不需要任何人来认证。