CC、Codex都没防住:13种攻击全部打穿,连权限审查都能绕过,问题竟出在SubAgent
CC、Codex都没防住:13种攻击全部打穿,连权限审查都能绕过,问题竟出在SubAgent研究发现SubAgent等上下文重建机制会将工具层的恶意指令提权为用户消息或系统指令,导致Claude Code、Codex、Gemini CLI、Qwen Code、Kimi和OpenCode六款AI编码框架在13类攻击上全部沦陷,连自动权限审核(Auto PR)也被绕过。
搜索
研究发现SubAgent等上下文重建机制会将工具层的恶意指令提权为用户消息或系统指令,导致Claude Code、Codex、Gemini CLI、Qwen Code、Kimi和OpenCode六款AI编码框架在13类攻击上全部沦陷,连自动权限审核(Auto PR)也被绕过。
AFAC2026金融智能创新大赛总决赛落幕,全球5027支队伍近2万名选手参赛,主办方联合30余家机构推出四道贴近真实金融场景的赛题,并正式发布覆盖13万条评测样本的"AFAC百万金融智能数据集"实现百亿级金融科技数据开源。
豆包工作新增多Agents并行与Mac电脑GUI操作两大功能,实测可完成Mac mini购机配置调研、自动撰写邮件草稿、调整长辈电脑系统设置及批量定时发送微博等任务。
openJiuwen社区的ScienceDiscovery通过树搜索驱动科研产物RSI,无需训练模型,在积分求解、代码加速和符号回归任务中分别以小时级产出通用积分器、实现平均2.279倍加速,并以低成本在111道方程反推题中正确找出41.4%。
西湖大学AGI实验室发布Code World Model视频世界模型,将世界演化与视觉生成分离,由Coding Agent和代码负责因果规则执行、视频模型负责高保真视觉渲染,并提出Proxy作为可编译视觉条件通道,用约5.6小时游戏视频完成原型验证。
CMAP团队发表于TPAMI 2026的工作提出基于一致性模型的对抗净化方法,将传统像素空间去噪转化为隐空间流形优化,使对抗样本映射回干净数据流形,在多种攻击类型与自适应攻击条件下均有效提升深度神经网络的鲁棒性。
过去几年,机器人操作领域几乎被一批新概念重新 “刷屏”。 LLM Planner、VLA、Diffusion Policy、Flow Matching、Latent Action、World Mode
沙特人工智能公司HUMAIN基于中国MiniMax的开源旗舰模型MiniMax M3推出阿拉伯语大模型HUMAIN M3,使用超过1万亿Token阿拉伯语数据进行后训练,在七项阿拉伯语基准测试中等权平均分达89.37%,标志着中国开源模型正成为全球AI生态的底层技术基础。
新版生图模型GPT Image 2.5虽未正式发布,但已通过ChatGPT弹窗提示向部分用户开放,该模型生成图像极为逼真,已能伪造GPT-6官方发布会和奥特曼全员信等场景,并在生成速度、角色一致性、文字渲染等方面较GPT Image 2有显著提升。
Oriscen由前Google Research科学家崔皓与TikTok原内容生态负责人王率丁等人创办,主张让AI在社交协调与人生经历保存中扮演配角,在完成任务后主动退场,将生活的主角留给人。