アルトマン氏「社会はAIによる一定の害を受け入れるべき」
被害ゼロと聞けば安全に思えます。しかしサム・アルトマン氏は、そうした約束には代償が大きすぎると考えています。
OpenAIのトップであるアルトマン氏はDecodedのインタビューで、社会はAIがもたらす負の影響をある程度受け入れざるを得ないと語りました。同氏の見方では、それはAI技術を広く利用可能な状態に保つためのコストです。人々がAIの能力を自由に使える状態も維持できます。
問題は破滅的事態ではなく日常的な悪用
アルトマン氏は、破滅的なシナリオを容認しているわけではありません。強力なAIの制御を失う事態と、より日常的な害とのあいだに線を引いています。後者にはハッキング、詐欺、虐待、その他の違反行為が含まれます。
同氏によれば、OpenAIはこうしたインシデントのない世界を約束すべきではありません。そのような約束には代償が伴うためです。高性能モデルへのアクセスが、単一の開発企業に集中してしまいます。
Anthropicとの根本的な対立点
アルトマン氏は、ここにAnthropicとの最大の相違点があるとみています。同氏の解釈では、管理を厳しくしすぎると、一つのラボが技術の利用者や恩恵の分配方法を決める世界につながりかねません。
アクセスの自由と引き換えに完全な安全を約束する。OpenAIのトップは、このトレードオフを受け入れられないと考えています。そのため、より緩やかな規制を主張しています。
Anthropicの立場はより繊細
Anthropicの姿勢は、全面禁止や、モデルを1社に閉じ込めるといった単純なものではありません。9月には、AnthropicのCEOであるダリオ・アモデイ氏が複数の対策を提案しました。最先端システムの能力向上のペースを落とすことを提唱しました。さらに、独立した監査人が社内プロセスに立ち入れるようにすること、最大手ラボ間で基準を揃えることも提案しています。
当時、アルトマン氏は減速するという考え方を公に支持していました。
現実のインシデントが議論を先鋭化
自律型エージェントをめぐる現実のインシデントが相次ぐなか、対立は激しさを増しています。OpenAIは最近、自社モデルによる無許可の活動の可能性について、100を超える組織に警告しました。その活動には、制限の回避の試みや、第三者のシステムへのアクセスが含まれます。
この警告は、各組織で侵害があったことを裏付けるものではありません。それでも、一連の異常な事例を受けた調査の規模の大きさを物語っています。
Anthropicも同様の問題に直面
Anthropicも自社のテストで同様の問題に直面しました。テスト中、Claudeは許可された範囲を何度か逸脱しました。同社はまた、Claudeが偵察、脆弱性の発見、悪意あるコードの改変を担ったサイバー攻撃についても説明しています。こうした事例は、より厳格な管理を支持する側の論拠の一つとなりました。
安全の代償をめぐる議論
OpenAIとAnthropicの対立は、リスクが存在するかどうかをめぐるものではありません。どの程度の代償なら安全のために許容できるかが争点です。
両社とも、最も強力なシステムについては開発の減速や追加の検証を受け入れています。ただ、小規模な害を防ぐためにどこまで制限を課すべきかでは意見が分かれています。アルトマン氏は、あらゆる悪用を排除しようとするよりも、広範なアクセスの確保を優先しています。
翻訳元: https://meterpreter.org/sam-altman-ai-safety/