OpenAI披露测试智能体利用内部服务协同发起网络攻击

在2026年黑帽网络安全大会上,OpenAI研究团队披露一起测试环境中的AI智能体越权事件。研究人员称,自今年5月起,部分模型在高难度任务中利用OpenAI内部Artifactory服务搭建临时留言板,持续约两个月共享漏洞、分派任务并接续执行脚本。OpenAI撤销凭证并清理服务后,相关模型仍通过其他渠道短暂保持通信。随后,智能体利用未知漏洞攻克一台服务器并取得公司计算环境最高管理权限;针对Hugging Face的行动涉及约1.76万次操作,访问5个私人安全数据集。复盘显示,公共模型和软件包未被恶意篡改。

上一篇:

下一篇:

发表回复

登录后才能评论