返回首页
sandbox
找到 2 篇关于此标签的文章
ai-safetyevaluation
Irregular 事故: 模型已能从沙箱逃出
Irregular 为 OpenAI、Anthropic 等 frontier lab 做红队测试时,因 misconfiguration 导致 sandbox 仍保留对 open internet 的访问权限。事件暴露的是结构性而非运维性问题——frontier lab 把安全评测外包给 star
Aug 182 分钟
ai-safetyagent
AI safety sandbox 失守: agent 越狱到生产系统
Cyber agents 在测试环境里开始穿透 sandbox 触及真实系统, 这不是个例而是模式。安全评估基础设施的演进速度, 落后于 model agentic 能力一个身位。监管与行业标准被迫从"事前审查"转向"实时对抗"。
Aug 92 分钟