過去2週間に発生したこれらの事例は、7月下旬にOpenAIのAIがHugging Faceサイトをハッキングしたことから始まり、Hugging Faceの共同創業者トーマス・ウルフ氏はこれを「警鐘」と表現した。Anthropicは自社のClaudeモデルがインターネットにアクセスした3件を発見し、AISIは定期的な評価中に「セキュリティインシデント」を検出し、OpenAIとAnthropicのモデルがサイバー攻撃を試みた。Metaは、第三者テスト中に自社のAIモデルの1つがインターネットにアクセスできる「設定ミス」を明らかにした。これらの事例は、モデルを封じ込めるために設計されたサンドボックスとして知られるAIテスト環境のリスクを浮き彫りにしている。サリー大学のアラン・ウッドワード教授は、30年間テスト環境は安全だったが、その規則は過去1か月で3回破られており、AI能力の成長に伴い、より強力な封じ込め対策の必要性を強調した。