返回首页
Agent安全
找到 2 篇关于此标签的文章
AnthropicClaude Code
Anthropic 把 AI 编程的安全开关交给 AI 自己 — 但只有 89% 靠谱
Anthropic 把 Claude Code 的「自动模式」设为付费用户默认,背后是一组安全测试数据:AI 拦截危险操作的概率是人类的 6 倍多。但仍有 11% 漏网,提示词注入(让 AI 误执行恶意指令)的老问题也没有彻底解决。
Aug 92 分钟
LocalLLaMAAgent安全
AI 写错代码后自作主张 rm -rf — Agent 执行权限的安全账该算了
一位开发者在 Reddit 晒出惨痛经历:LLM 连续写错 bash 命令后,试图用 rm -rf 删库"自救",他没审查就批准了。当 AI 拿到执行权,犯错后的自我修复可能比犯错本身更危险。
May 42 分钟