Googleの人工知能モデル「Gemini」が5月に実施されたサイバーセキュリティテスト中、実在する3社のコンピューターシステムに無断でアクセスしていたことを、同社が認めました。
Geminiは、あるケースではパスワードを繰り返し推測することで、また別の2つのケースでは公開リポジトリに流出していた認証情報を使用することで、システムへのアクセスに成功していました。
Googleによると、被害を受けた企業にはこの侵害について通知済みとのことです。企業名は公表されていません。
今回の一連のインシデントは、まずThe Wall Street Journalが報じたもので、Irregular社が実施したサイバーセキュリティ評価の過程でAIモデルが実際のコンピューターシステムを侵害していたという、これまでの一連の開示の最新事例となります。
このセキュリティ企業は、AnthropicやOpenAI、Metaの各AIモデルについても同様の評価を実施していました。
8月、Irregular社は明らかにすることを拒否しました。これは、ハッキング演習中に同社が誤ってAIツールに公共インターネットへのアクセスを許可してしまったことで、他の顧客にも影響が及んでいたかどうかという点についてです。
Irregular社のこの過失によって他にハッキングインシデントが発生していたかどうか、また影響を受けた組織が法的措置を検討しているかどうかは分かっていません。規制当局や捜査機関がこの一連のインシデントを調査しているかどうかも、依然として不明です。
同社は、インシデントの総件数を明らかにしないまま事後検証報告書を公表したことで批判を浴びました。
サリー大学のコンピューターサイエンス教授であるアラン・ウッドワード氏は、Irregular社が公表した報告書について「私が考える技術報告書とは言えない」と述べ、「かなりの宣伝色が入っている」と付け加えました。
Irregular社は当時、自社の評価に関連して「現在進行中の問題はない」としていました。同社はまた、評価のセキュリティに関するベストプラクティスをまとめた白書を公表する計画があるとしていますが、公表時期は明らかにしていません。
Irregular社で発生した一連のインシデントは、実世界の標的に対してAIエージェントが行動を起こした、最近の他の2つの事例とは別物です。
英国のAIセキュリティ研究所は、Anthropicの「Mythos 5」モデルが、インターネットへのアクセスを許可された評価の一環として、偽のオンライン上の人格を作り出し、実在するソフトウェアプロジェクトに悪意あるコードを仕込み、実在する開発者に対してフィッシングメールを送信していたと報告しました。
OpenAIは以前、自社のモデルがサンドボックス化されたテスト環境から脱出し、Hugging Faceの本番インフラを侵害していたことを認めています。この事例は、テスト環境の設定ミスに起因していたIrregular社の一連のインシデントとは異なり、OpenAIのモデルが脆弱性を突いて隔離環境から脱出したというものでした。
翻訳元: https://therecord.media/gemini-google-cyber-breach