本周AI项目推荐|智能知识、Copula Lab、UniPat…谁在给中国模型造后训练数据与考场?
本周AI项目推荐|智能知识、Copula Lab、UniPat…谁在给中国模型造后训练数据与考场?随着Agent走向真实工作,后训练和数据正在成为提升智能的关键。
搜索
随着Agent走向真实工作,后训练和数据正在成为提升智能的关键。
请想象这样一种居家场景:当你戴着 AI 眼镜在厨房准备晚饭,用刀切菜时,它会立刻提醒你注意安全;当你连续几天形成举着手机长时间录像的习惯时,它会主动建议你换一种更省力的记录方式。
义父不愧是义父!
Anthropic 的增长速度,又一次超过了自己的预测。据彭博看到的投资者文件,Anthropic 今年第二季度初步营收超过 115 亿美元,较去年同期的 7.87 亿美元增长超过 14 倍;相比今年第一季度的 47.3 亿美元,也增长了一倍以上。
此刻,DeepSeek Harness 的 GitHub 仓库显示 10.50 万个 Star、10033 次 Fork。距离发布仅 45 小时。当然,热度不意味着胜利。值得关注的是开发者具体在拿它做什么。人们开始拿 DSH 做完全相反的事——有人跑实测,有人报 Bug,有人造插件,也有人质疑“为什么还要再做一个 Harness”。
据路透社援引三位知情人士爆料,苹果已和阿里巴巴展开合作,联合训练一款专门面向中国市场的大语言模型。就在8月8日,苹果悄然更新Mac使用手册,新增《在Mac上配合Apple智能使用千问》相关章节,这也是苹果首次对外官方披露国行Apple智能的合作细节,不过该章节后续已被删除。
就在刚刚,智谱发布了其最新一代旗舰模型GLM-5.3,并宣布模型将在两周内开源。这是一个拥有7430亿个参数的模型,和此前的GLM模型一样主打编程。在多项主流基准测试中,GLM-5.3位居所有已开源或即将开源模型中的第一;其在编程与智能体任务上的能力,已逼近Claude Fable 5、GPT-5.6 Sol等海外顶尖模型。
据路透社最新消息,在8月6日举行的Google DeepMind全员会上,管理层宣布:数个非技术团队将被移出DeepMind,转入谷歌的公司汇报体系。会上,哈萨比斯和接班人Koray Kavukcuoglu还在安抚员工,称实验室的日常工作不会发生变化。
这次百花奖时间紧、任务重,好在豆包帮了金启棣大忙。在豆包工作任务模式下,他把舞台数据、观众规模、视觉需求等一并交给豆包。豆包很快就生成了舞美概念和效果图,让原本模糊的创意迅速落地。在此基础上,舞美设计团队继续精修,省下了大量做基础工作的时间。
过去一年,编程 Agent 的能力大幅提升,软件工程师对它们的要求也比以往任何时候都高,但上下文窗口的大小却基本停滞不前——一年前,一百万个 token 大致就是最先进的水平,如今依然如此。随着我们逐渐进入 Agent 日常处理 Monorepo(单体仓库)级任务的世界,将越来越多的信息塞进模型那固定的上下文限制中,这种需求已经变成了一项实实在在的全职工程任务。