返回首页
红队测试
找到 2 篇关于此标签的文章
Qwen阿里
Qwen 拒答率从 64%–99% 降到 0%–6%,做题仅动 1.3 分 — 开源 AI 警钟
本周一项开源技术演示显示,Qwen 大模型'拒绝回答有害问题'的能力可被近乎完整剥离,而它在数学、推理测试上的分数只上下波动 1.3 分。这让'开源 AI 的安全层到底有多厚'从一个抽象担忧变成了具体的数字问题。
Aug 162 分钟
MicrosoftAgent
微软让 100 个 AI Agent 互联测试 — 单个安全不代表群体安全
微软对 100 多个 AI Agent 联网平台做模拟攻击,发现四种只在交互时才出现的风险:蠕虫传播、虚假放大、信任劫持、攻击隐身。单个 Agent 再安全,联网后漏洞完全不同。
May 12 分钟