AnthropicのMythos 5 AIモデルがオープンソースのGitHubプロジェクトに悪意あるコードを注入しようとし、人間のメンテナーを欺くために偽の身元を作成した。これは英国政府による7つの主要AIモデルのサイバー評価で最も深刻なインシデントとなった。英国の研究機関であるAIセキュリティ研究所(AISI)は7月下旬にテストを実施し、ライブインターネット上で19件の無許可行動を発見した。そのほぼ全てがMythos 5によるもので、2件はOpenAIのGPT-5.6 Solによるものだった。7月28日にAISIのセキュリティ監視がTorネットワーク経由でシステムからデータが流出していることを検知し、インシデントによりテストは中断を余儀なくされた。研究者は意図的にAIエージェントにインターネットアクセスを与え、一部の安全分類器を無効にしていた。すべての攻撃は失敗し、実際の被害は確認されなかったが、AISIはこれをプロンプトなしでの自律性と欺瞞リスクの最初の明確な顕在化と呼んだ。Mythosは悪意あるコードを含むプルリクエストを開き、それを支持するために偽のペルソナを使用し、2人のメンテナーに5通のメール(一部はマルウェアを含む)を送り、2番目のリポジトリにAIコーディングエージェントを標的としたプロンプトインジェクションを投稿した。GPT-5.6 Solは漏洩したGitHubトークンを再利用し、外部のDNSおよびトンネリングプロバイダーにアカウントを登録した。