ホワイトハウスは、AI大手6社から自主的な安全確保の約束を取り付けました。各社は、フロンティアモデルに対して社内統制、独立監査、取締役会レベルの監督を導入することで合意しています。
ドナルド・トランプ大統領と各社の経営幹部は9月29日、「スーパーインテリジェンスに関するホワイトハウス協定(White House Accord on Super Intelligence)」に署名しました。
署名したのは、GoogleのCEOであるサンダー・ピチャイ氏、AnthropicのCEOであるダリオ・アモデイ氏、MetaのCEOであるマーク・ザッカーバーグ氏、OpenAI社長のグレッグ・ブロックマン氏、xAIのイーロン・マスク氏、NVIDIAのCEOであるジェンスン・フアン氏です。トランプ氏は、署名ページを含む2ページの協定文書をTruth Socialで公開しました。
この協定には、トランプ氏がAIの呼称として採用した新しい用語が使われています。同氏は同じ日、連邦政府機関に対し、「人工知能(artificial intelligence)」の代わりに「スーパーインテリジェンス(super intelligence)」を使うよう指示する大統領令にも署名しました。
AIの安全対策、4層の統制
協定は、フロンティアモデルを訓練・展開する企業に対し、4層の統制と監査を整備するよう求めています。
第1の層は、訓練時と展開時にモデルの能力とアライメントを監視する社内統制です。対象には、サイバーセキュリティ、バイオセキュリティ、化学的脅威に関するリスクが含まれます。企業はさらに、モデルが意図しない方法で技術システムをハッキングしたりアクセスしたりしないよう徹底する必要があります。
第2の層では、社内チームが、統制・監視・検知が意図どおりに機能しているか、また特定された問題が是正されているかを確認します。第3の層では、独立した外部の監査人または評価者が、これらの統制が有効に機能しているかどうかを評価します。
第4の層では、取締役会の独立委員会が、統制を運用するチームや社内外の監査人から報告を受けて監督し、特定された問題が確実に是正されるようにします。
AIモデルのインシデントに関する関連記事:MetaもOpenAI、Anthropicに続き、AIによるエクスプロイト事案を報告
高まるフロンティアAI統制への関心
モデルが意図しない方法でシステムをハッキングしたりアクセスしたりする事態に触れた文言は、署名した3社が相次いで公表した事案を受けたものです。
Anthropicは、Claudeモデルが評価環境からインターネットに到達した後、許可なく第三者のシステムにアクセスした事例を4件報告しています。MetaとOpenAI(OpenAI)も、モデルがテスト環境の外に到達したテスト中のインシデントを公表しています。
各社はまた、AIの安全性に関する標準やベストプラクティスを確立するため、定期的に会合を開くことでも合意しました。協定には、これらの措置をいずれ法律や規制に盛り込むことが妥当になる可能性があると記されています。ただし署名各社は、法制化の有無にかかわらず、措置を実行すると約束しました。
この合意によって、新たな規制上の要件が生じるわけではありません。AIの安全性に関する新たな規則を求める声に反対してきたトランプ氏は、記者団に対し、この協定は道義的な拘束力を持つと述べ、AI企業は自ら襲を律するべきだとの考えを示しました。
翻訳元: https://www.infosecurity-magazine.com/news/trump-ai-giants-super-intelligence/