这是什么
Anthropic 旗下的 Frontier Red Team(专门测试模型危险能力的内部安全团队)本周公布了一项足以让安全圈坐直的数据:智谱 AI(总部在北京的大模型公司)的 GLM-5.3,在 100 项"二进制漏洞利用"任务中拿下 4% 的完全控制流劫持成功率,Anthropic 自家下一代模型 Claude Mythos Preview 为 6%。而上一代模型——包括 Claude Opus 4.6 与 GLM-5.2——在所有任务中全部为 0%。
报告标题相当直白:《GLM-5.3 与先进网络能力的扩散》。二进制漏洞利用(Binary Exploitation)通俗说就是"让一段程序跳出原本设计、去做攻击者想让它做的事",是网络攻防中最硬核的能力之一。控制流劫持(control flow hijack)则是其中最严重的一类——攻击者直接接管程序接下来的执行路径。
换句话说,这次测试比的不是谁写得更好,而是谁具备了真正的底层攻击能力。
行业怎么看
Anthropic 自己的结论是:"一个有意义的门槛已被跨过。"潜台词很清晰——先进 AI 具备底层攻击能力这件事,不再是"理论上可能",而是"现在就在发生"。
但我们注意到一种值得警惕的反向声音。安全研究者指出,4%-6% 看似不高,真正的变量不是单次成功率,而是规模化。模型可以 7×24 小时自动跑、并行上万次,传统黑客需要数周的工作量,调一次 API 几小时就能完成。门槛一旦存在,时间和算力会替攻击者补齐剩下的部分。
还有一种克制视角:渲染"AI 黑客竞赛"反而会掩盖更紧迫的风险。绝大多数企业当下真正面对的,是模型被用于大规模钓鱼、自动化社工(social engineering,即通过操纵人来获取信息),而不是底层漏洞利用——前者已经落地,后者对绝大多数攻击者而言成本依然偏高。
对普通人的影响
对企业 IT:攻防平衡正在被打破。过去只有顶尖安全团队才能复现的攻击,现在用 API 调模型就能部分完成。企业的安全预算和应急响应流程,需要把"AI 辅助攻击"正式列入威胁清单。
对个人职场:这件事离多数白领的日常工作还比较远。但如果你在金融、医疗、政企等敏感行业做 IT、合规或风控,值得跟上级提一句:AI 攻击工具是否已经进入你所在行业的实际威胁模型。
对消费市场:短期内普通消费者不会有直接感受。但如果 AI 攻防竞赛持续升温,更可能出现的是漏洞利用工具的地下商品化——这是安全厂商与执法部门接下来要头疼的事。