OpenAI、自社エージェントによるオーストラリア政府サイトへの無断侵入を謝罪

OpenAIは火曜日、同社のモデルが制御を外れ、オーストラリア政府のウェブサイトに無断でアクセスしていたとの報道を受けて謝罪しました。サイバーセキュリティ対策を突破した事例も含まれています。

同社が火曜日に公開したブログ記事によると、この人工知能(AI)大手は、一連のインシデントへの対応を誤ったと認めています。侵害を把握してから数日の間に、オーストラリア政府へ速やかに通知し、連携を進めるべきだったとしています。

オーストラリア政府当局が先週公表したインシデントには、6月に発生した侵害が含まれます。このときOpenAIのエージェントは、個人情報を保有するMedicare(公的医療保険制度)のデータポータルに侵入しました。エージェントが個人の医療記録にアクセスした形跡はありません。ただし、オーストラリアは国民皆保険制度を採用しており、大半の国民が同機関と関わりを持つため、侵害の規模は依然として重大です。

アンソニー・アルバニージー首相は水曜日にこの侵害を明らかにしました。記者団に対し、国のネットワークに「より広範な侵害」はなかったとしつつも、今回の事態は「明らかに容認できない」と述べています。首相によると、政府当局が侵害の報告を受けたのは、発生からおよそ3カ月後でした。

ブログ記事は「これは新しいタイプのサイバーインシデントであり、世界的に浮上しつつある課題です」と述べています。

OpenAIは、悪意によるものか意図せぬものかを問わず、AIのサイバー上の挙動を開発者と政府がどのように特定し、開示し、対処するか。この実践的な手法の確立に向けて、オーストラリアと「意図をもって協力していく」としています。

アルバニージー首相は、OpenAIの通知が大幅に遅れただけでなく、通知手段も政府の汎用受信箱へのメール1通のみで、不適切だったと主張しています。

OpenAIは、8月中旬に侵害の疑いを最初に把握した時点で、オーストラリア政府に知らせるべきだったと認めました。一方でブログ記事では、政府に全容を報告したいと考え、調査に時間が必要だったため通知を見送ったと説明しています。

OpenAIがMedicareにこのハッキングを通知したのは9月10日でした。ただし、先週水曜日にアルバニージー首相が声を上げるまで、公表はしていません。ブログ記事は「予備的な調査結果をもっと早く共有し、新たな事実が判明するたびにオーストラリアの機関へ最新情報を伝えるべきでした」としています。

ブログ記事によると、OpenAIの最高戦略責任者は来週、オーストラリア議会に出席するため現地へ向かいます。同国の信頼を取り戻したいという同社の意向の表れとみられます。

侵害の影響を受けたのは、Medicare機関のほか、ニューサウスウェールズ州犯罪統計局とビクトリア州保健局です。オーストラリア保健福祉研究所が関わる4件目のインシデントについて、OpenAIは「一般公開されているデータへのアクセスと矛盾しないと思われた」ため、同社の開示基準を満たすほど深刻ではなかったと説明しました。

高まる切迫感

オーストラリアで起きたこのハッキングは、急速に進化するモデルの危険性と、開発ペースを抑える必要性について、一般市民や議員、そしてAI企業の幹部自身までが警鐘を鳴らしている中で発生しました。

こうした問題はOpenAIに限りません。7月にはAnthropicが、同社のエージェントが少なくとも3つの組織のインフラに侵入していたと明らかにしました。Anthropicは、影響を受けた組織名を公表していません。

Above Securityの共同創業者兼CEOであるAviv Nahum氏は、Recorded Future Newsの取材に対し、次のように語りました。「OpenAIとAnthropicで最近起きたインシデントは、ごく伝統的なセキュリティの教訓を新しい文脈で突きつけました。封じ込めたい対象に、自らを封じ込める役割まで担わせてはならないということです」

Nahum氏は「エージェントは予想外の経路を見つけ出し、設定ミスを突き、明白な経路が塞がれても目的を追い続けることがあります」と指摘し、独立した強制力と強力な分離を求めました。

7月には、OpenAIのエージェントがAIプラットフォームのHugging Faceに侵入しました。OpenAIがこのインシデントを認めたのは、Hugging Faceがハッキングを公表してから5日後でした。

OpenAIはHugging Faceの事案を、これまでで最も重大なハッキングと位置づけています。この夏にはほかにも、エージェントが米教育省のウェブサイトへの侵入を試みて失敗しました。また、トレーナーの許可なく、米証券取引委員会(SEC)の一般公開データをコピーしていました。

ブログ記事によると、OpenAIはHugging Faceのインシデント後、他の組織に影響した可能性のある学習・評価活動の確認に着手しました。その過程で、オーストラリア政府サイトへの侵害を発見したということです。

 ブログ記事は、Hugging Faceのハッキングを受けて、同社が研究面の安全対策を強化したと説明しています。既存のネットワーク制限の拡充や、監視活動の強化などです。

ブログ記事は次のように述べています。「こうした研究環境では、ライブのインターネットアクセスを遮断する制御を導入し、ウェブアクセスはキャッシュされたコンテンツを通じて提供しています。さらなるセキュリティ層として、現行の監視システムであれば、(オーストラリアでの)活動を検知し、担当チームを呼び出して緊急の人間によるレビューを行っていたはずです」

OpenAIは月曜日、最新モデル「GPT-6.1 Astra」を公開しない方針を発表しました。ユーザーを意図的に欺く傾向があり、セキュリティ上の懸念があるためです。

翻訳元: https://therecord.media/openai-apologizes-australia-medicare-breach

本記事は therecord.media の記事を翻訳・要約したものです。