今回の事案は、OpenAI、Anthropic、Metaを混乱させたのと同じテスト環境の欠陥に起因していました。
Googleの AIシステム「Gemini」が、今年前半に発生した3件の別々の事案において、テスト環境から抜け出し、他の3社のシステムに侵入していたことが明らかになりました。
「通常の評価において、このモデルはオンライン上で公開情報を見つけ出し、テストの一部だと思い込んだウェブサイトにアクセスするための認証情報を推測しました」と、Google社のセキュリティエンジニアリング担当バイスプレジデントであるHeather Adkins氏は声明で述べています。「これら3件のケースすべてにおいて、モデルは自ら停止しました」
この事案はThe Wall Street Journalが金曜日に最初に報じたもので、Geminiに架空の企業から情報を盗み出すよう指示するキャプチャー・ザ・フラッグ形式の演習中に発生しました。3回にわたり、架空企業が実在企業と同じ名称を持っていたケースで、Geminiはテストの安全対策を回避してインターネットにアクセスし、実在企業のネットワークに侵入してしまいました。1件では必要なパスワードを推測し、残る2件では公開データベース内で有効なパスワードを見つけ出していました。
Geminiのモデルは、今年前半に明らかになった一連の事案でOpenAI、Anthropic、Metaの各モデルを封じ込めから脱出させたのと同じ欠陥を利用し、イスラエルのAIテスト企業Irregularが運用するサンドボックスから繰り返し脱出していました。こうした一連の脱出事案は、AIモデルが強力になりすぎている一方でガードレールが不十分ではないかという懸念を再燃させています。
Adkins氏によれば、Googleは事態を把握した際に迅速に対応したといいます。
「当該3社には状況を確実に伝え、トレーニングパートナーとも協力し、テストプロセスに現在実施されている変更を行いました」と同氏は述べています。
「強力なAIモデルの安全な開発は極めて重要であり」と同氏は付け加え、「私たちはこの分野に深く投資しています」と語りました。
Irregularはコメント要請に応じませんでしたが、同社はAxiosに対し、自社サンドボックスの欠陥について「7月下旬に関係するすべての[AI]ラボに通知した」こと、また「当社側で判明していた問題はすべて数週間前に是正・解決済みである」ことを伝えたと述べています。
AIセキュリティへの懸念
今回のGemini脱出事案の発覚は、米国政府がAI規制にどこまで踏み込むべきか検討している最中の出来事です。議員らは議論を進めており複数の法案が急速に進化するこの技術にガードレールを課すことを求めています。また、OpenAIとAnthropicの両CEOも、安全性を優先するためAI開発を減速させるべきだと訴えています。しかしDonald Trump大統領はAI安全性への懸念を「でっち上げ」と呼び、同政権は最先端AIラボの活動をより厳しく監視しようとする取り組みを拒否してきました。
米国の主要AIモデルをめぐる懸念は、中国製AIツールの人気と機能が今後大きく伸びると専門家が予測する中で浮上しています。米中両国の当局者は今週、AIセキュリティ問題を扱うとみられる首脳会談のためワシントンで会合を開いています。Scott Bessent財務長官は日曜夜、世界的な安定を目的として、深刻になりうるAI関連事案を開示するための仕組み作りで中国と協力したい意向を示しました。
編集部注: 本記事はGoogleからの追加コメントを反映して更新されました。
翻訳元: https://www.cybersecuritydive.com/news/google-ai-gemini-autonomous-hacks/830884/