トランプ大統領とテック大手、AI安全性に関する自主的合意を締結

AI大手6社の経営トップが、今週ドナルド・トランプ大統領と交わした自主的な合意に基づき、フロンティアAIシステムの開発に関する安全対策を強化することを約束しました。

この「超知能に関するホワイトハウス合意(White House Accord on Super Intelligence)」は、各社に対し、社内の安全管理体制を整備し、その対策を独立した監査の対象とし、AIの安全性とセキュリティに対する取締役会の監督を強化するよう求めています。参加するのは、OpenAI、Google、Meta、Nvidia、xAI、Anthropicの6社です。

AIガバナンスに関する共同コミットメント

フロンティアAIの責任に関するこの共同コミットメントは完全に自主的なもので、参加企業に具体的な実施期限は課していません。背景には、AIの安全性をめぐる懸念の高まりがあります。大手AI企業の幹部からも、高度化するフロンティアシステムがもたらしかねないリスクについて警告が出ています。懸念の範囲は、AIのサイバー攻撃への悪用の可能性から、化学研究、重要インフラなど、誤りや悪用が重大な結果を招きかねない分野へのAI導入のリスクにまで及びます。

トランプ大統領自身は、より高性能なAIの開発を遅らせかねない安全対策の強化を求める声に、公に反対してきました。中国との技術競争で優位を保つため、米国は迅速に動く必要があるという立場です。今回の合意でホワイトハウスが採ったのは、少なくとも現時点では義務的な要件を課さず、安全対策の強化を企業自身に委ねるアプローチです。

合意文書には次のように記されています。「将来的には、こうした措置を法律や規制に盛り込むことが適切になる可能性があります。企業に義務づけられるかどうかにかかわらず、こうした管理体制と監査の導入は、すべての人にとって安全な未来を確保するうえで不可欠だと私たちは考えています」

フロンティアラボ向けの4層の監督枠組み

合意は、参加するフロンティアAIラボに向けて、4つの要素からなる監督枠組みを示しています。1つ目は、トレーニングとデプロイの過程でモデルの能力を監視する社内統制です。サイバーセキュリティ、バイオセキュリティ、化学的脅威といったリスクに特に注意を払います。2つ目は、こうした統制が意図どおり機能し、問題が確実に修正されるよう、専任の社内チームを設けることです。3つ目は、独立した外部監査人が社内統制を個別に検証すること、4つ目は、独立した取締役会の委員会を指名し、プロセスを監督して問題の解決を確実にすることです。

セキュリティ専門家の間では、この合意は前向きな一歩ではあるものの、十分とは言えないとの見方が一般的です。

Keyfactorで戦略・AIイノベーション担当シニアバイスプレジデントを務めるEllen Boehm氏は、AI開発のペースが速いため、政府や産業界などが協力し、技術の使われ方に対する社会の信頼を築く標準や実践を整えることが重要だと話します。AIシステムの高性能化が進むなか、規制を待つのではなく、リスク管理や監査、確立されたサイバーセキュリティの実践を企業が自主的に導入するよう促すのは良い考えだといいます。

「企業は制御不能なAIをわざと作ろうとしているわけではありませんが、この技術が意図どおりに動作すると断言するのは難しいのが実情です」とBoehm氏は語ります。「この合意は出発点にすぎません。私が見る限り、ほとんどの人は支持するでしょう。問題は、ここからどう発展させ、実際のプログラムを整備していくかです。そのスピードは十分でしょうか」

「超知能」合意の限界

Approv のCEOであるTed Miracco氏は、問題は合意が自主的である点にあると指摘します。

「4層の監査構造は妥当に見えますが、自主的な遵守と社内の取締役会による監督では、セキュリティ対策を装っただけの『セキュリティ・シアター』にすぎません」と同氏は述べます。「拘束力のある執行手段と、真に独立した技術的監督がなければ、テック企業に超知能の開発を自ら監視させるのは、自分で自分の宿題を採点させるようなものです」

Suzu Labsでセキュアなaiソリューション・サイバーセキュリティ担当シニアディレクターを務めるJacob Krell氏は、この合意の大きな弱点として、6社がそれぞれ独自の評価を選べる点を挙げます。認定、手法、アクセス、範囲、公表のいずれについても、合意は何も定めていません。

「Model Evaluation and Threat Research(METR)とRedwood ResearchによるHugging Faceの調査が、その問題を示しています」と同氏は話します。METRは6日間で約1,300件の記録を調べました。しかし、調査期間を設定し、データセットを提供し、インフラへのアクセスを管理し、非公開の資料を黒塗りにできたのはOpenAIでした。METRはまた、資料の多くを処理するのにGPT-5.6 Solを使用しました。「彼らはこうした制約を文書に残しており、仕事は真摯なものでした。それでも、境界線を引いたのはOpenAIです」と同氏は語ります。

この協定がどれほど有効かは実装しだいだと、Above Securityの共同創業者兼CEOであるAviv Nahum氏は述べます。この合意の意義は、AIの安全性を、自らの成果を自ら採点する1つのチームに委ねてはならないと認めた点にあります。社内監視、2層目の社内レビュー、独立した評価、取締役会の監督はいずれも、問題の特定と是正の確保に役立ちます。

ただしNahum氏は、こう指摘します。「外部監査に意味があるのは、評価者が真に独立しており、システムを適切にテストできるだけの技術的アクセスを持ち、特定された問題が実際に是正される場合に限られます。現時点で合意は自主的なもので、期限も公開報告の義務もありません。枠組みに同意することと、その枠組みが機能すると証明することの間には、依然として大きな隔たりがあります」

翻訳元: https://www.darkreading.com/cyber-risk/trump-tech-giants-strike-voluntary-ai-safety-accord

本記事は darkreading.com の記事を翻訳・要約したものです。