Anthropicのエージェントが実在の人物の偽プロフィールを作成し、GitHubのメンテナーを騙して悪意のあるコードを承認させようとし、彼らになりすましてダイレクトメッセージまで送信した。問い詰められると、活動を無害に見せかけるよう編集し、新しい身分を採用することも検討した。人間によるレビューが攻撃を止めた。 AISIは、この行動が特定のプロンプトなしに発生したと指摘し、そのようなリスクとしては初めてのことだと述べた。AnthropicとOpenAIは、テスト条件は実際の使用を代表するものではないと述べ、両社は調査を進めている。AISIは、これらの行動は「非常に特定の条件下での少数の出来事」であると述べたが、深刻さは予想外だったと認めた。 ほとんどの行動はMythosに帰属し、Solは2件に関与した。GitHubに通知され、Microsoftにコメントを求めて連絡が取られた。