CC、Codex都没防住:13种攻击全部打穿,连权限审查都能绕过,问题竟出在SubAgent
CC、Codex都没防住:13种攻击全部打穿,连权限审查都能绕过,问题竟出在SubAgent研究发现SubAgent等上下文重建机制会将工具层的恶意指令提权为用户消息或系统指令,导致Claude Code、Codex、Gemini CLI、Qwen Code、Kimi和OpenCode六款AI编码框架在13类攻击上全部沦陷,连自动权限审核(Auto PR)也被绕过。
搜索
研究发现SubAgent等上下文重建机制会将工具层的恶意指令提权为用户消息或系统指令,导致Claude Code、Codex、Gemini CLI、Qwen Code、Kimi和OpenCode六款AI编码框架在13类攻击上全部沦陷,连自动权限审核(Auto PR)也被绕过。
Astra还没发,外媒把OpenAI的王牌技术曝光了。
AI黑客学会的第一件事,竟是插队?
OpenAI 即将发布的模型 Astra,在内部评测中拿到了漏洞利用基准 ExploitBench 的满分,还顺手挖出了两个此前无人知晓的零日漏洞。
DeepSeek Harness 的插件生态因缺乏官方分发、发现与安全管理机制,导致安全权限形同虚设且优质插件难以被用户发现。
OpenAI联合Anthropic、AWS、Google、Microsoft等超过100家科技、安全及金融机构发布网络防御公开信,警告未来数月AI驱动的网络攻击将更加复杂,可能严重威胁医院、水处理设施及互联网基础设施,Sam Altman发文强调这是AI网络防御的关键时刻,行动时间紧迫。
Claude Code内置的安全降级机制严重翻车,开发者在使用AI编程工具Fable 5编写临时文件清理脚本时触发对抗性审查,模型被先后从Fable 5降级至Opus 5再到Opus 4.8,最终因变量复用错误导致Opus 4.8误删开发者Guillemot的整个主目录,700GB数据丢失。
AI安全,时代变了!
OpenAI……又解散了一个安全团队。
Anthropic刚刚发布了一份长达186页的最新Risk Report。如果只是快速扫一眼,这仍然是一份典型的前沿AI安全报告:模型能力评测、生物风险、网络安全、自动化研发、对齐问题,以及各种防护措施。