刚刚,A社自曝「最坏Claude」!150人紧急转岗,新品开发全停
刚刚,A社自曝「最坏Claude」!150人紧急转岗,新品开发全停就在最近,Anthropic突然爆料了一个被自己故意「训坏」的Opus级模型!挑80个有毛病的训练环境,把模型丢进去,撤掉所有纠偏机制,然后看它长成什么样。
搜索
就在最近,Anthropic突然爆料了一个被自己故意「训坏」的Opus级模型!挑80个有毛病的训练环境,把模型丢进去,撤掉所有纠偏机制,然后看它长成什么样。
Agent 出现这么久了,大伙应该对它们的工作方式也不陌生了吧?
Codex用着用着就要压缩上下文、压着压着可能还“失忆”的痛苦,就要结束了!
在代码领域,我们已经越来越习惯一个词:Vibe Coding。
刚刚过去不久的暑期档,游戏行业发生了不少大事儿。
中国大模型商业化的一次分层。
这两年Agent领域冒出来的Engineering越来越多。
模型竞争的下一站,是让智能体在真实世界里可执行、可验证、可进化。
如果你觉得 AI agent 离帮你订机票、填报销单、投简历只有一步之遥,那 MMLU-Pro 的作者联合滑铁卢大学 TIGER Lab,UBC NAIL Group 和 UniPat AI,CMU 等机构刚刚放出的这项研究,可能会让你冷静下来。
视觉 - 语言 - 动作模型(Vision-Language-Action Model,VLA)正在成为机器人操作的重要基础模型。经过少量示范微调后,VLA 已经能够完成抓取、放置、堆叠等多种任务。然而,一旦任务涉及精密接触、狭小容差或分布外位置,模型的成功率仍会明显下降。