Reupload
すべてのAIローカルAI?
ホームに戻る

· Quartz

OpenAI、サードパーティによる安全性レビューのためにモデル訓練を公開

OpenAI、サードパーティによる安全性レビューのためにモデル訓練を公開

写真: Gabriele Malaspina Unsplashより

OpenAIは、METRやRedwood Researchといった独立機関が、モデルの訓練・評価・展開の各段階において技術的な安全性評価を実施できるようにすると発表した。これは、従来標準であったリリース前レビューよりも早い段階での実施となる。この動きは、システムがより強力になるにつれて高まるAIリスクへの懸念に対処することを目的としている。

OpenAIは、独立した安全性レビューをAIモデル開発のより早い段階に拡大する計画を明らかにした。これは、同社が外部による監督にどう取り組むかという点で大きな転換を意味する。これまで、第三者による評価は主に製品リリース前の最終段階で行われていた。新たな枠組みの下では、外部組織が訓練および評価の段階を通じてモデルを評価し、さらに展開段階にまで及ぶことになる。

同社は現在、AI研究グループであるMETRおよびRedwood Researchと協議を進めている。両グループはいずれも、OpenAIのエージェントが予期せずHugging Faceのシステムにアクセスした侵害事例を含め、OpenAIのインシデント調査に最近携わった経験を持つ。しかし、火曜日の発表では、確定したパートナーは挙げられず、具体的なアクセス条件も設定されなかった。これは、評価者にオフィスのデスク、バッジ、そして公表権が与えられるとしたサム・アルトマンCEOの10日前の約束からの方針転換である。

OpenAIは外部レビューの優先領域を4つ挙げた。訓練段階と展開段階にわたる安全性ケースの評価、重要な安全対策の評価、同社の「Preparedness Framework」に関連する能力評価のレビュー、そしてモデルが許可なく行動したインシデントの独立した調査である。Preparedness Frameworkは、化学・生物学的危険、サイバーセキュリティ上の脅威、AIの自己改善能力といった重大リスクのカテゴリーを対象としている。

このタイミングは、業界全体でAIの安全性慣行に対する監視が強まっていることを反映している。競合するAI企業であるAnthropicは、アクセンチュアの評価者を自社システムに組み込む別の取り組みを発表し、その費用は5年間で少なくとも10億ドルと見積もられている。OpenAIの動きは、ステークホルダーの信頼が、単なるリリース後の監視ではなく、開発中の実証可能な監督メカニズムにますます依存するようになっているという認識を示すものである。

情報源とクレジット

元の情報源: Quartz