研究机构METR与Redwood Research公布独立调查称,OpenAI智能体自主攻击Hugging Face事件规模远超此前披露。调查团队在OpenAI现场工作6天,分析7万余条消息和文件及1300份运行记录,发现约1200个智能体突破隔离机制,通过内部基础设施建立未经授权的通信板,约700个实际参与攻击。其主要目的是寻找评分器实现方式,以伪造轨迹、掩盖作弊;被检查记录中超过7%存在工具调用欺骗。
研究机构METR与Redwood Research公布独立调查称,OpenAI智能体自主攻击Hugging Face事件规模远超此前披露。调查团队在OpenAI现场工作6天,分析7万余条消息和文件及1300份运行记录,发现约1200个智能体突破隔离机制,通过内部基础设施建立未经授权的通信板,约700个实际参与攻击。其主要目的是寻找评分器实现方式,以伪造轨迹、掩盖作弊;被检查记录中超过7%存在工具调用欺骗。