Claude Mythos其实没那么神?AI发现bug其实早已是寻常
Claude Mythos其实没那么神?AI发现bug其实早已是寻常昨天,VIDOC Security Lab 的一篇博客介绍了他们的发现:Claude Mythos 的实力可能被高估了;或者说,之前已有模型达到了同等的能力。正如研究者 Dawid Moczadło 说的那样:「这并非一种新能力。」
昨天,VIDOC Security Lab 的一篇博客介绍了他们的发现:Claude Mythos 的实力可能被高估了;或者说,之前已有模型达到了同等的能力。正如研究者 Dawid Moczadło 说的那样:「这并非一种新能力。」
就在刚刚,奥特曼家被炸了。奥特曼发出家人和孩子的照片,并且发出长文表示,AGI如今已经如同魔戒一般,让人做出疯狂的举动。
近日,上海人工智能实验室联合南京大学、香港中文大学及上海交通大学,将OpenClaw的成功应用于多模态生成领域。他们提出GEMS(Agent-Native Multimodal Generation with Memory and Skills),激发小模型潜力,甚至让6B小模型在部分任务超越了Nano Banana 2。
过去一个月,是今年 AI 产品发布最密集的一个阶段。 如果你留意近期 AI 产品的进展,你会发现,出现了一批真正能主动干活的 Agent 产品。不再是聊天框、问答工具,更像是人类的分身:能自己操控电脑
字节Seed最新研究,让大模型能“原地改参数”了。既不用改模型结构,也不用重新训练,还跑得很快。具体是这么个情况。智能体时代嘛,大家都知道模型们面对的任务开始变得越来越复杂、上下文越来越长。
《终结者》导演詹姆斯·卡梅隆过去的一番论断,迎来了热议:AGI不会来自政府项目,而是由科技巨头打造。这比我在40年前《终结者》中描绘的情景更可怕,因为至少现在它已不再是科幻小说了。
强如Claude,最近的bug也越来越多了。最新热议话题让Hacker News炸开了锅:发帖人G哥(一位软件工程师,在某教育初创公司当CTO)甚至称这是他“迄今为止我在Claude代码中见过的最严重的bug”。
2026 年第一季度,它和另外四种完全不同的 Agent 产品形态在同一个窗口期同时冒了出来。OpenClaw 走个人助理、Cowork 走办公协作、Codex App 走长程工程任务、Perplexity Computer 走统一工作站、腾讯云 ADP 走企业平台。
太震撼了!一位北大文科博士,带着17个Agent,爆肝49天30万行代码,手搓了一个「AI开放世界」Elseland。当技术被AI飞轮碾碎,一人就是一个「超级军团」的时代真的来了。
人工智能和机器人领域,有一个反直觉现象: 往往人类觉得复杂、困难的任务,机器人做起来很容易;而人类不以为意的一些感知与运动技能,让机器复现异常困难。