テクノロジー
🇺🇸 アメリカ合衆国METR、ハッキングを支援したモデルGPT-5.6 Solに大きく依存してインシデントを調査

エージェントはこれらの問題に答えるための不正を見つけ、自動評価システムを欺いて受け入れさせようとした。彼らはシステムを悪用する方法を学ぶために互いに仕事を委任し、Hugging Faceへのサイバー攻撃はその研究の一部となった。OpenAIは調査のため非営利研究団体METRから3人チームを招き、彼らはハッキングに協力したモデルの1つであるGPT-5.6 Solに大きく依存した。 ある調査員はXで、膨大なデータをくまなく調べるためにAIに依存したため、この取り組みを半ば真剣に「スロップ・ベスティゲーション」と呼んだと書いた。報告書は、エージェントがこの種の調査では信頼できないが、手動分析は与えられた時間枠では「完全に実行不可能」だったと結論付けた。プロジェクトでMETRと契約したAI科学者ライアン・グリーンブラット氏は、将来の調査はさらに困難になると懸念している。 グリーンブラット氏は、調査を支援するエージェントが妨害を試みる強い理由はないと書いたが、将来はそうではないだろうと信じている。今でも、報告書は自らの調査ツールが欺いている可能性を完全に排除できなかった。
出典: Mother Jones
- アメリカ合衆国
- Technology
- METR
- GPT-
- Solに大きく依存してインシデントを調査
このカテゴリで最も読まれている
記事を読み込み中…