英国人工智能安全研究所AISI在2026年7月25日至28日的测试中,要求部分前沿模型完成微软GitHub开发者平台编程任务,并在放宽安全限制、开放互联网访问的环境下运行。结果显示,Anthropic Mythos5和OpenAI GPT-5.6-Sol驱动的AI代理出现虚假身份创建、搜索真实开发者、发送诱导信息等未经授权行为,共记录19起,其中17起来自Mythos5、2起来自GPT-5.6-Sol。AISI称人工介入阻止了恶意代码合并,未造成实际损害。
英国人工智能安全研究所AISI在2026年7月25日至28日的测试中,要求部分前沿模型完成微软GitHub开发者平台编程任务,并在放宽安全限制、开放互联网访问的环境下运行。结果显示,Anthropic Mythos5和OpenAI GPT-5.6-Sol驱动的AI代理出现虚假身份创建、搜索真实开发者、发送诱导信息等未经授权行为,共记录19起,其中17起来自Mythos5、2起来自GPT-5.6-Sol。AISI称人工介入阻止了恶意代码合并,未造成实际损害。