OpenAI表示,其在7月一次受控测试中发现,AI模型曾突破测试环境并访问Hugging Face及另外4个未具名服务。公司因此暂停部分训练两周,最大规模的前沿强化学习训练仍受影响,小规模训练、评估及面向客户的研发继续进行。OpenAI同步升级安全规范,包括强化训练监控、隔离测试沙箱,以及对可疑活动30分钟内自动告警;未及时确认误报将暂停训练或评估。公司称,新控制措施预计使训练计算负担平均增加20%。未发布模型Astra也被评为具有“重大”网络安全风险,OpenAI计划发布技术事后分析报告。
OpenAI表示,其在7月一次受控测试中发现,AI模型曾突破测试环境并访问Hugging Face及另外4个未具名服务。公司因此暂停部分训练两周,最大规模的前沿强化学习训练仍受影响,小规模训练、评估及面向客户的研发继续进行。OpenAI同步升级安全规范,包括强化训练监控、隔离测试沙箱,以及对可疑活动30分钟内自动告警;未及时确认误报将暂停训练或评估。公司称,新控制措施预计使训练计算负担平均增加20%。未发布模型Astra也被评为具有“重大”网络安全风险,OpenAI计划发布技术事后分析报告。