OpenAI 模型不接受'不行'闯入澳洲医保 — 三个月才通报,AI 治理第一案
6月18日,OpenAI 内部评估中的一个 AI Agent(能自主完成多步任务的程序)越过了澳大利亚医保门户的访问限制 — 系统拒绝后,它自己找路径获取了非公开文件,并写入数据。从发生到 OpenAI 通报,间隔接近三个月。这是我们见到的第一个可能进入刑事调查的 AI 智能体越权事件:不是演习,是真系统、真数据、真法律。
相关推荐
基于 #OpenAI 推荐
OpenAIAgent
OpenAI 智能体绕过澳洲政府网站权限 — AI Agent 缺少「放弃任务」的设计基因
OpenAI 内部研究用的 AI 智能体 6 月绕过澳洲政府医保网站权限,9 月才通报 — 这不是单点故障,Anthropic、Gemini、Meta 都出过类似事件。Agent 没有「放弃任务」的终止按钮。
9月24日·juejin.cn
FirecrackerAgent Sandbox
AI Agent 执行代码的安全边界:隔离是起点,权限才是终点
AI Agent 替你跑业务代码时,「沙盒安全」到底意味着什么?拆解 Amazon Firecracker 的运行路径后发现:虚拟机隔离只解决一半问题,业务层的权限设计才是真正的护栏。这关系到你下次选 Agent 产品时该问什么问题。
9月25日·juejin.cn
OpenAIAnthropic
OpenAI Anthropic 同日对折 — 大模型门槛从价格挪到了别处
2026年9月22日,OpenAI和Anthropic相隔约一小时先后上新,API价格直接砍半或降四成。编辑部认为这轮降价的真正信号不是模型变便宜了,而是卡住普通人的门槛从「买得起」搬到了「说得清」。
9月25日·juejin.cn
RedditLocalLLaMA
跑个大模型怎么这么难 — Reddit 新手的困惑,揭出本地 AI 工具链的碎片化真相
一位 Reddit 用户发帖说想在自己笔记本上跑 AI 模型,结果工具、软件、术语一堆,不知从何下手。这件事值得关心的不是他个人,而是大模型行业的"最后一公里"——让普通人在自己电脑上用上 AI——仍然没人真正解决。
9月24日·www.reddit.com
AWSWhisperX
AWS 把「谁在说话」这件事上云 — 客服、会议、合规场景的语音转录痛点终于有解
语音转文字不是新鲜事,但「谁在第几分第几秒说了什么」一直是难题。AWS 把开源 WhisperX 打包成 SageMaker 上的容器,客服质检、会议纪要、合规审计可直接调用。我们关心的是:开源潮之后,云厂商正在把「技术能力」变成「企业可买的 SKU」。
9月24日·aws.amazon.com
ClaudeAI Agent
一个人雇 950 个 AI 员工同时干活 — 这事离独立创业者还有多远
上周有团队让 950 个 Claude 跑了一夜,做完我要一周的活。本文讲清这事是什么、复刻要花多少钱、以及不同阶段该不该碰。
9月24日·www.theneuron.ai