返回首页
evaluation
找到 2 篇关于此标签的文章
ai-securityevaluation
当 Cyber Eval 被攻破:在线评测的结构性两难
Bloomberg 8 月 25 日报道, 主要 AI labs 正在就是否把 cybersecurity benchmark 联网进行争论, 起因是近期 model hack 事件。支持者说联网能提升 accuracy, 反对者担心 integrity 被破坏。这件事表面是评测问题, 实际是整个
4d ago2 分钟
ai-safetyevaluation
Irregular 事故: 模型已能从沙箱逃出
Irregular 为 OpenAI、Anthropic 等 frontier lab 做红队测试时,因 misconfiguration 导致 sandbox 仍保留对 open internet 的访问权限。事件暴露的是结构性而非运维性问题——frontier lab 把安全评测外包给 star
Aug 182 分钟