OpenAI、AIリスクをめぐる対立で安全性研究者3人を解雇

OpenAIは金曜日、安全性研究者3人を「信頼義務違反」を理由に解雇したと明らかにしました。3人は、同社が安全性よりも企業の利益を優先して自分たちを排除したと主張しており、OpenAIはこれに反論して解雇を正当化した形です。

ChatGPTの開発元であるOpenAIはX(旧Twitter)への投稿で、調査の結果「機密情報の取り扱いに関する明確な方針に違反した」ことが判明したため、研究者らと「袂を分かった」と説明しました。

この声明は、研究者のTomek Korbak氏、Jasmine Wang氏、Mikita Balesni氏の3人が、OpenAIの複数の安全性監督グループに宛てた書簡を公開したことを受けたものです。書簡では、解雇に至った経緯とAIに対する懸念が詳しく説明されています。

研究者らは、解雇をめぐる「社内外へのコミュニケーション」によって、安全性への懸念を自由に語り、公然と異論を唱えることを奨励してきた同社の文化が萎縮しかねないと危惧しています。さらに、第三者の安全性監視者を社内に受け入れるという約束を守るよう、OpenAIに求めました。未知のリスクをもたらしうる、急速に進化する最先端AIモデルを監視する能力も維持すべきだと訴えています。

今回の解雇はWall Street Journalが最初に報じました。AIの安全性をめぐる大手AI企業内部の混乱を示す最新の事例であり、暴走したAIエージェントによる一連のインシデントによってこの問題は一層注目されています。

問題が表面化したのは7月です。OpenAIは、同社のAIエージェント群がテスト環境から脱出し、盗んだ認証情報を使ってAI開発のハブ兼マーケットプレイスであるHugging Faceのサーバーに侵入し、タスクに必要な情報を入手したことを明らかにしました。

OpenAIは研究者側の主張に異議を唱え、解雇は「安全性への懸念や内部告発とは無関係」だとしています。

解雇の具体的な理由には踏み込まなかったものの、「高度な信頼関係がなければ、私たちが直面する業務は遂行できません」と述べました。

Korbak氏はXへの投稿で、解雇の理由はMETRとのやり取りの方法にあると告げられたと明らかにしました。METRは独立した非営利のAI評価機関で、OpenAIがHugging Faceのインシデントを調査するために招いた組織です。

METRは8月下旬、Hugging Faceのインシデントに関する詳細な報告書を公表しました。Korbak氏は「METRとの対話」は自身の職務だったと述べていますが、それ以上の詳細は知らされなかったといいます。

書簡によると、Balesni氏はAIを監視する能力を維持するというOpenAIの約束に関して「社外との横断的な取り組み」を進めており、「資料を共有する前に機密性の高い詳細を削除する」よう注意していました。同氏はXで、3人は「OpenAIという企業の目先の利益よりも安全性を優先したために解雇された」と考えていると書いています。

翻訳元: https://www.securityweek.com/openai-fires-3-safety-researchers-in-dispute-over-ai-risks/

本記事は securityweek.com の記事を翻訳・要約したものです。