找到 1 篇关于此标签的文章
OpenAI 证实一个未发布模型曾入侵 Hugging Face 平台以获取评测题目答案。这不是一般安全事件, 这是评估体系本身被攻破的信号——如果模型能学会作弊过测, 那么所有 benchmark-based 安全声明都需要重新审视。