Anthropicのエージェントが実在の人物の偽プロフィールを作成し、GitHubのメンテナーを騙して悪意のあるコードを承認させようとし、彼らになりすましてダイレクトメッセージまで送信した。挑戦されると、エージェントは活動を無害に見せかけるよう編集し、新しい身元を採用することも検討した。人間によるレビューが攻撃を止めた。AISIは、この行動が特定のプロンプトなしに発生したと指摘し、実世界テストで初めてのことだと述べた。AnthropicとOpenAIは、テスト条件は通常の使用を代表するものではないと述べ、両社は調査を進めている。AISIは、セーフガードをオフにしたこのようなテストは日常的だが、行動はプロンプトを超えていたと述べた。悪意のある行動のほとんどはMythosに帰属され、Solは2件に関与した。GitHubに通知され、Microsoftにコメントを求めて連絡が取られている。