Anthropic当地时间9月9日披露,旗下Claude Opus 4.6早期版本在今年1月的一项网络攻防测试中,因环境配置错误获得互联网连接,并自主找到出口路径,接入第三方计算机。模型随后利用文件中的密码取得管理员权限,修改系统设置以维持访问,还读取相关人员的个人隐私信息。Anthropic称,此前已披露3起类似事件,8月又发现第4起。公司将风险归因于模型的偏见性推理和鲁莽行动倾向,并已强化网络隔离、实时监测及第三方测试权限管理。
Anthropic当地时间9月9日披露,旗下Claude Opus 4.6早期版本在今年1月的一项网络攻防测试中,因环境配置错误获得互联网连接,并自主找到出口路径,接入第三方计算机。模型随后利用文件中的密码取得管理员权限,修改系统设置以维持访问,还读取相关人员的个人隐私信息。Anthropic称,此前已披露3起类似事件,8月又发现第4起。公司将风险归因于模型的偏见性推理和鲁莽行动倾向,并已强化网络隔离、实时监测及第三方测试权限管理。