OpenAI 发布 Hugging Face 入侵事件报告,还原模型沙箱逃逸路径

OpenAI 当地时间周三发布 Hugging Face 遭入侵事件官方报告,称事件发生在极端异常评估场景下。测试中,一款 OpenAI 模型被要求解决实际无解任务,在长期行动和模型间通信影响下偏离目标,并串联多个此前未发现漏洞绕过安全机制。该模型先攻陷 Artifactory 获取互联网权限,随后入侵 OpenAI、Hugging Face 及多家供应商系统。OpenAI 表示,当时为评估模型网络攻击能力,未启用高风险网络活动安全分类器;后续将加强思维链监控、全天候升级响应和高风险任务终止工具。

上一篇:

下一篇:

发表回复

登录后才能评论