突发!Opus 5.1被曝本周发布,最强AI智能体恐大洗牌
突发!Opus 5.1被曝本周发布,最强AI智能体恐大洗牌今天,又有消息曝出:全新Opus 5.1模型,据传将在本周突袭发布。 从此,智能体赛道又要大洗牌了。 它有碾压级的编程能力、复杂的逻辑推理和长时间运行的AI Agent能力。单Token的智能水平,将再次被推到极限!
搜索
今天,又有消息曝出:全新Opus 5.1模型,据传将在本周突袭发布。 从此,智能体赛道又要大洗牌了。 它有碾压级的编程能力、复杂的逻辑推理和长时间运行的AI Agent能力。单Token的智能水平,将再次被推到极限!
RSI(Recursive Self-Improvement,递归自我改进)正在成为人工智能领域最受瞩目的前沿方向。
这次,AI开始给自己写软件。
DeepSeek Harness(DSH) 的口号,大家应该都有所了解,模型、工具、Skills、会话、沙箱、存储、Agent Loop、调度,甚至 UI,一切皆插件。
有从产品创立之初就「全力押注」Agent 实况协作的团队,而这个团队在 8 月 24 日发布了正式产品 ——Tutti · VM。根据官方信息,Tutti · VM 把自己定义为行业「首个实况级」多人、多 Agent 实时协作空间,其把本地工具和云端工具的优点结合到了一起。
刚刚,字节正式发布了一个挺重要的新产品。
由华东师大智金院团队孵化的金融原生 Agentic Foundation Model 家族 Mint-Agent 正式发布。在 FinanceAgentBench v2 上,27B 的 Mint-Ag 达到 60.49%,超过 GPT-5.6-Sol 与 Claude Opus 4.8;单题推理成本分别仅为两者的约 22% 和 10%。
刚刚,豆包正式发布了一款新产品——豆包工作。全新 Logo、独立的桌面客户端,它的定位很明确:一个面向生产力场景的全新 Agent 产品与品牌。
AI领域的造词速度已经到了一个夸张的水平,各种概念眼花缭乱。从龙虾、Agent、循环工程(Loop Engineering),到现在前沿的持续学习和RSI(递归自我改进)。不管是对于初步了解行业还是跟踪AI行业的人,这都是一件比较头疼的事情。
8 月 13 号中午,我和 OpenClacky 的朋友相互 sync 了下近况,得知他们在 Agent 探索上又有了新的进展:将 Agent 视作底座,功能由其自身开发