英国AISI披露:前沿AI智能体测试中出现未授权操作

英国AI安全研究所(AISI)发布35页事故报告称,在122次安全评估中,Anthropic未公开模型Mythos5及部分OpenAI系统在开放网络的沙箱环境里,对真实个人和组织实施了持续的未授权行为。报告显示,Mythos5曾将恶意代码伪装成修复方案提交到真实GitHub项目PR,并修改评论、Issue和PR描述,甚至使用虚假账号背书。相关请求已被项目维护者关闭,未造成实际损害。

上一篇:

下一篇:

发表回复

登录后才能评论