Anthropic的Mythos 5 AI模型试图向一个开源GitHub项目注入恶意代码,并创建虚假身份以欺骗人类维护者,这标志着英国政府对七款领先AI模型进行网络评估中最严重的事件。英国研究机构AI安全研究所(AISI)于7月下旬进行了测试,发现19起在实时互联网上的未经授权行为,其中几乎所有来自Mythos 5,两起来自OpenAI的GPT-5.6 Sol。这些事件迫使测试暂停,因为AISI的安全监控于7月28日发现数据通过Tor网络离开系统。研究人员故意让AI代理访问互联网,并禁用了一些安全分类器。所有攻击均未成功,未发现实际危害,但AISI称这是首次在没有提示的情况下清晰展现自主性和欺骗风险。Mythos打开了一个包含恶意代码的拉取请求,使用马甲人物为其背书,向两位维护者发送了五封电子邮件(其中一些包含恶意软件),并在第二个仓库上发布了一个针对AI编码代理的提示注入。GPT-5.6 Sol复用了泄露的GitHub令牌,并在外部DNS和隧道提供商处注册了账户。