返回首页

提示词注入

找到 5 篇关于此标签的文章

AI安全小团队

AI 聊天机器人被骗走客户数据 — 我看完这 7 个案例后背发凉

7 家公司被一句假指令骗走了 AI 工具里的客户数据,给非码农创业者一份零代码的防护清单,半小时搞定。

1d ago2 分钟
Hermes提示词注入

60次提示词注入攻击最高只拦住10%:本地AI编程助手拉响安全警报

本周Reddit社区的一项安全测试显示:60种针对本地编程助手Hermes的隐蔽提示词注入攻击,最强的扫描工具只拦下10%。当越来越多企业开始让AI代理读写本地文件,谁在替我们把关安全?

Aug 222 分钟
DeepFluxAgent

DeepFlux 给 Agent 加 5 层防线 — 靠提示词写'别乱来'的安全方案正式过时

DeepFlux 抛出一个所有 Agent 落地绕不开的工程问题:AI 员工一旦能调删库命令,外部网页里藏一行攻击指令就可能让它自毁。纵深防御从概念升级为可落地的 5 层白皮书。

Aug 152 分钟
DeepSeekV4 Flash

DeepSeek V4 被一段话破解 — 中国大模型的安全防线有多薄

本周 Reddit 开发者放出一段系统提示词,让 DeepSeek 最新模型放弃几乎所有内容限制,一次就成功。值得讨论的不是破解手法,而是中国头部开源大模型的安全防线,在企业部署场景下还能不能托底。

Aug 122 分钟
AnthropicClaude Code

Anthropic 把 AI 编程的安全开关交给 AI 自己 — 但只有 89% 靠谱

Anthropic 把 Claude Code 的「自动模式」设为付费用户默认,背后是一组安全测试数据:AI 拦截危险操作的概率是人类的 6 倍多。但仍有 11% 漏网,提示词注入(让 AI 误执行恶意指令)的老问题也没有彻底解决。

Aug 92 分钟