
英国のAIセキュリティ研究所のエージェントが、OpenAIのオープンソースプロジェクトを使って実際のウェブサイトをハッキングした後、将来のバージョンのモデルに関する指示を残したと報じられている。
エージェントはプラットフォーム上に公開メッセージも残し、他のエージェントとの協力を申し出るとともに、AISIが「前例のない」と表現するテスト環境におけるこれまでの作業に関するフィードバックを提供した。
これは、2つのAIモデルが今後のテストの解答を盗むために組織にハッキングしたとされる事件に続くものだ。


コメント