竞赛编程Agent进入全球前十!南大、清华新模型CF rating超3500
竞赛编程Agent进入全球前十!南大、清华新模型CF rating超3500大语言模型在代码生成上的能力不断增强,但在复杂算法题,尤其是竞赛编程场景中,仍然容易因为算法选择错误、边界条件遗漏、复杂度判断失误或隐藏测试覆盖不足而失败。Solvita是一款面向竞赛编程的智能体框架,通过四个角色(Planner、Solver、Oracle、Hacker)形成闭环系统,并利用可训练的图结构知识网络积累经验。
搜索
大语言模型在代码生成上的能力不断增强,但在复杂算法题,尤其是竞赛编程场景中,仍然容易因为算法选择错误、边界条件遗漏、复杂度判断失误或隐藏测试覆盖不足而失败。Solvita是一款面向竞赛编程的智能体框架,通过四个角色(Planner、Solver、Oracle、Hacker)形成闭环系统,并利用可训练的图结构知识网络积累经验。
我现在核心做的项目叫QLab,一个AI出海加速器。用多智能体,搭了一张高效的协作网络,专门帮国内的中小创业者、一人公司和AI团队,把产品推到海外去。 1. AI Agent相关技术产品支持:帮助非技术背景OPC迅速搭建AI产品体系
中共北京市委教育科技人才工作领导小组正式印发《北京市加快推进人工智能赋能科学研究实施方案(2026-2028年)》(简称:《实施方案》),成为国内首个覆盖自主实验室、科研智能体、科学大模型、科学数据中心、高价值应用场景等完整体系的AI for Science(AI4S)中长期实施方案。
Greg Isenberg 最近在他自己的播客 The Startup Ideas Podcast 里讲的一个判断,他说了一句很直白的话,building agents is the new SaaS,做 agent 就是新时代的 SaaS。
上周有个项目,让我觉得很有意思。GitHub上一个叫OpenSquilla的,发布不到一个月,Star涨到了5300多。OpenSquilla 0.4.0,定位Token-Efficient AI Agent,是一个很有效率又很有创意的智能体框架。
来自南京大学 NLP 实验室的 ICML 2026 论文 Recognize Your Orchestrator: An Entropy Dynamics Perspective for LLM Multi-Agent Systems 指出:在当前主流的 Orchestrator-Executor 多智能体架构中,系统失败往往并不首先来自某个执行器不会干活,
乐鑫喵伴 EchoEar EchoEar 喵伴 AI 机器人搭载的 ESP-Brookesia 框架实现全双工语音交互、多模态识别与智能体控制,构建更具沉浸感的人机交互体验。 EchoEar 套件以端
在近日豆包宣布全面下线“智能体”功能之前,其“应用生成”功能已于5月31日率先停止服务。目前,用户此前通过该功能创建的历史应用,仍可在豆包会话中进行查看、复制、下载及分享,但无法再新建或更新。不过,其编程功能依然保留。
这个官方仓库vercel-labs/skills,发布仅五个月,GitHub星标就冲到了2.4万。凭什么这么火?简单到只有一行命令:npx skills add <package>。说白了,它就是AI智能体(AI agent)的包管理器。
Anthropic 工程师人均每个季度产出的代码量,是 2025 年同期的 8 倍。这可不是某个孤立团队的战绩,而是一整条从「稳定」直接拉升到「起飞」的曲线:过去几年几乎持平的产出量,在过去一年里近乎垂直上升。