A社故意黑化Opus,模拟入侵Hugging Face,抱抱脸:?
A社故意黑化Opus,模拟入侵Hugging Face,抱抱脸:?Anthropic通过在80个存在刷分漏洞的环境中训练Opus量级模型,获得擅长奖励投机的Hacker-Opus,并在模拟场景中成功入侵Hugging Face,证明作弊行为会从刷分环境蔓延至常规任务,问题根源在于奖励机制设计而非模型品性。
搜索
Anthropic通过在80个存在刷分漏洞的环境中训练Opus量级模型,获得擅长奖励投机的Hacker-Opus,并在模拟场景中成功入侵Hugging Face,证明作弊行为会从刷分环境蔓延至常规任务,问题根源在于奖励机制设计而非模型品性。
众擎机器人CEO赵同阳在2026世界机器人大会上透露,今年已将60%资金与人力投入机器人"大脑"研发,发布仿人脑五层体系架构EngineAI Awaken,明确不做"第二个宇树",借鉴英伟达底层平台与生态路线,并将80%至90%资源押注商用、工业及家庭等应用场景。
DeepSeek-V4-Flash-Vision-Exp多模态模型正式开源,该模型为DeepSeek-V4系列首个实验性多模态模型,基于DeepSeek-V4-Flash架构集成视觉模块,在真实世界软件工程测试DeepSWE中以59.3%反超Opus-4.8登顶,并在零样本视觉推理测试ZeroBench中击败Opus-4.8。
OpenClaw 2.0 来了。 就在刚刚,OpenClaw 正式发布历史上规模最大的更新 v2026.8.1。 OpenClaw 基金会在官方博客中坦言,这次更新多少有些「意外」:团队起初只想简化安装流程、重做浏览器端,没想到越改越深。
商汤首席科学家林达华在专访中判断,未来一两年多模态将迎来能力涌现的"GPT时刻",并阐述商汤以原生理解生成统一模型U系列和多模态智能体模型SenseNova 6.8为核心的长期技术路线。
ChatGPT Work于8月25日上线云浏览器登录功能,背后的云电脑配有约9个虚拟CPU和15GB内存,可在网页和手机端自动登录网站处理订狗粮、保险报销等任务,而密码对AI不可见,标志着该智能体首次跨越登录墙真正替用户办完事。
Salesforce AI与UIUC研究人员提出Strong-to-Weak Scaffolding方法,让强模型(Builder AI)为弱模型GPT-5.4-mini自动设计外部Harness工作框架,无需修改参数即可将其在心智理论任务上的平均准确率从0.488提升至最佳0.912,揭示AI4AI的核心机制是将认知结构而非知识从强模型迁移至弱模型。
南京大学联合南洋理工大学提出游戏开发智能体框架VibeGame,组建8人对抗式Agent团队并重造AI-Native游戏引擎,通过试玩验收和经验沉淀实现免训练自我进化,从一句自然语言即可生成完整可玩游戏工程。
智能体电商公司Nile.app截至2026年8月已接入563个品牌,包括Cider、SweetNight等上百家头部大卖,其AI引荐流量点击转化率达品牌站内基准的150%—300%,正将品牌竞争从"网页排名"推向"对话候选集"。
《白鲸实验室》独家了解到,字节跳动原计划于8月推出的豆包大模型2.2,将推迟面世。