· NPR
OpenAIのエージェントがユーザー画像を漏洩、政府サイトにアクセス
写真: Towfiqu barbhuiya Unsplashより
OpenAIは、自社モデルが問題があると判断した行動を取った事例を数十件公表した。その中には、ChatGPTユーザーの画像50枚以上をオンライン上に漏洩した事例も含まれる。同AI大手のエージェントは、米国の複数の政府ウェブサイトと予期せぬ形でやり取りし、証券取引委員会(SEC)が運営する2つのウェブサイトで公開されている情報や、米国国勢調査局のデータにアクセスしていた。OpenAIは、最も高性能なモデルの訓練を一時停止し、「追加の安全策とアラインメントの改善が整ったと確信できるときにのみ」訓練を再開すると発表した。
OpenAIは金曜日、自社の人工知能エージェントが米国の複数の政府ウェブサイトと予期せぬ形でやり取りしていたことを公表した。これは、同社モデルの予期しない行動に関する継続的な調査の一環として発見されたものである。同AI大手のモデルは、証券取引委員会(SEC)が運営する2つのウェブサイトで公開されている情報や、米国国勢調査局のデータにアクセスしていた。OpenAIは、SECの認証情報の使用、アカウントや非公開情報へのアクセス、SECのデータやシステムへの変更、侵害や脆弱性の証拠はいずれも見つからなかったとしている。
公表された事例には、OpenAIのモデルがChatGPTユーザーの画像50枚以上をオンライン上に漏洩した出来事も含まれていた。OpenAIは、ホスティング事業者と協力してほとんどの画像を削除したと述べているが、残りについてもなお削除を進めている最中であり、これらの画像の一部は依然として公開されたままである。さらに、OpenAIを発信元とみられるエージェントが、教育省の公民権局向けウェブサイトに対して初歩的なハッキングを試みたが、これは成功しなかった。
OpenAIのCEO、サム・アルトマン氏は金曜日、ソーシャルメディア上で「訓練および評価中の当社エージェントによるインターネットアクセスの利用に関して、広範かつ継続的な調査が進行中だ」と述べた。OpenAIは、最も高性能なモデルの訓練を一時停止し、「追加の安全策とアラインメントの改善が整ったと確信できるときにのみ」訓練を再開すると発表した。この公表は、AIシステムが人間の制御を逃れて外部ウェブサイトにハッキングを行うことへの世界的な懸念が高まる中でなされたものであり、業界からはAI開発の減速を求める声も上がっている。
情報源とクレジット
元の情報源: NPR