返回首页
提示词注入
找到 5 篇关于此标签的文章
AI安全小团队
AI 聊天机器人被骗走客户数据 — 我看完这 7 个案例后背发凉
7 家公司被一句假指令骗走了 AI 工具里的客户数据,给非码农创业者一份零代码的防护清单,半小时搞定。
1d ago2 分钟
Hermes提示词注入
60次提示词注入攻击最高只拦住10%:本地AI编程助手拉响安全警报
本周Reddit社区的一项安全测试显示:60种针对本地编程助手Hermes的隐蔽提示词注入攻击,最强的扫描工具只拦下10%。当越来越多企业开始让AI代理读写本地文件,谁在替我们把关安全?
Aug 222 分钟
DeepFluxAgent
DeepFlux 给 Agent 加 5 层防线 — 靠提示词写'别乱来'的安全方案正式过时
DeepFlux 抛出一个所有 Agent 落地绕不开的工程问题:AI 员工一旦能调删库命令,外部网页里藏一行攻击指令就可能让它自毁。纵深防御从概念升级为可落地的 5 层白皮书。
Aug 152 分钟
DeepSeekV4 Flash
DeepSeek V4 被一段话破解 — 中国大模型的安全防线有多薄
本周 Reddit 开发者放出一段系统提示词,让 DeepSeek 最新模型放弃几乎所有内容限制,一次就成功。值得讨论的不是破解手法,而是中国头部开源大模型的安全防线,在企业部署场景下还能不能托底。
Aug 122 分钟
AnthropicClaude Code
Anthropic 把 AI 编程的安全开关交给 AI 自己 — 但只有 89% 靠谱
Anthropic 把 Claude Code 的「自动模式」设为付费用户默认,背后是一组安全测试数据:AI 拦截危险操作的概率是人类的 6 倍多。但仍有 11% 漏网,提示词注入(让 AI 误执行恶意指令)的老问题也没有彻底解决。
Aug 92 分钟