- GoogleはAI生成の無効な報告が急増したことを受け、OSSバグ報奨金への投稿受け付けを一時停止
- AIは脆弱性の発見を加速させる一方、欠陥があり不完全で、幻覚(ハルシネーション)による報告も多い
- AI由来の報奨金目当ての報告の急増は、curlのメンテナーやLinuxのセキュリティレビュー担当者も圧迫している
Googleは、バグ報奨金プログラムの一つを一時停止すると明らかにしました。原因はAIにあるとしています。
同社は、「Open Source Software Vulnerability Rewards Program(OSS VRP)」に偽物や無関係な報告が大量に寄せられ、もはや対応しきれない状況になっていると説明しました。
このため同社は、年末まですべての投稿の受け付けを停止します。その間に運用プロセスを見直し、新たな対策を検討する方針です。
AI時代のバグハンティング
生成AIは防御側を大きく後押ししています。機械の速度で脆弱性を発見でき、ソフトウェアはより堅牢になり、エクスプロイトやゼロデイ脆弱性への耐性も高まっています。
著名な「Mythos」や「GPT-5.6-Cyber」といった最先端モデルのおかげで、企業はこれまでより短い時間で100倍もの脆弱性を発見できるようになりました。
その最たる例がMicrosoftのパッチチューズデーです。同社は2026年3月に製品の79件の欠陥を修正しましたが、4月(Mythosの利用を開始した時期)には167件と、ほぼ倍増しました。それ以降、修正されたバグの数は月を追うごとに大きく増えています。6月は200件、8月は400件、9月は966件でした。わずか半年で、Microsoftが修正する欠陥の数は10倍以上になりました。
とはいえ、脆弱性の発見やパッチ適用を機械だけに任せきりにするのは、まだ危険です。8月上旬、1PasswordのOff-by-1 Labsのセキュリティ研究者らが、AIによる脆弱性の発見・修正の精度を検証しました。その結果、パッチの半数(49.3%)で、既存のエクスプロイト経路を少なくとも一つ塞げていませんでした。5分の1(20.1%)は元の問題を修正したものの、アプリケーションの挙動が変わっていました。2.3%は新たなセキュリティ問題を持ち込んでいます。皮肉なことに、2.2%は脆弱性を修正できなかったうえ、さらにエクスプロイト経路まで増やしていました。
問題なしと見なせそうなパッチ(クリーンなパッチの26%と、アプリの挙動が変わったパッチの20.1%)でも、3分の1以上は脆弱で、根本的な問題を完全には解決していませんでした。1Passwordは、コンテキスト(文脈)の欠如が最大の課題だと結論づけています。適切な背景情報を与えれば、AIははるかに優れた結果を出せることも判明しました。
それでも、AIに幅広いコンテキストを与えないまま、脆弱性の発見にAIを使うセキュリティ研究者は少なくありません。単純なプロンプトで、分析はほとんど行わず、人間による確認はさらに乏しいため、「発見」は不正確で裏付けがなく、時には完全な幻覚になります。こうした事態を受け、Googleは報奨金の投稿受け付けを(一時的に)取りやめます。
Googleは2026年10月1日に公開した短い投稿で、次のように述べました。「OSS VRPのプロダクト脆弱性に関する投稿の受け付けを、一時的に停止します。OSS VRPのサプライチェーン関連の報告や、受理済みの報告には影響しません。代わりに、他のVRPプログラムで影響を見つけてそちらに投稿するか、パッチ報奨プログラム(Patch Rewards Program)をご利用いただくようお勧めします」
「なぜこのような措置を取るのでしょうか。自動化された投稿が大幅に増え、その大半が有効なものではないためです。今後もOSS VRPのこの部分を再構築する作業を続け、2027年第1四半期に最新情報をお伝えすることをお約束します」
HackerOneとLinus Torvalds氏
AIが生成した低品質な報告のせいでバグ報奨金プログラムが機能不全に陥ったのは、Googleが初めてではありません。2026年1月下旬、オープンソースのコマンドラインツール兼ソフトウェアライブラリであるcurlの開発者らは、偽の問題や脆弱性が殺到したとして、HackerOneでのバグ報奨金プログラムを終了すると発表しました。
GitHubに公開されたアドバイザリーによると、プログラムは2026年1月末で終了するとのことです。
文書にはこう記されています。「2026年1月末まで、curlにはバグ報奨金がありました。それはもう存在しません。curlプロジェクトは、報告されたバグや脆弱性に対する報酬を一切提供しません。また、curlの問題について他の手段で報酬を得ようとするセキュリティ研究者への支援も行いません」
その数カ月後の5月には、Linuxセキュリティメーリングリストの主要メンテナーであるLinus Torvalds氏が、研究者がAIを使って役に立たない報告を大量に送り込むため、同リストは「ほぼ完全に管理不能」になったと述べました。
同氏はこう語っています。「AIによる報告が絶え間なく押し寄せた結果、セキュリティリストはほぼ完全に管理不能になった。異なる人々が同じツールで同じものを見つけるため、膨大な重複が生じている」「みんな、報告を適切な担当者に転送したり、『それは1週間前(あるいは1カ月前)にもう修正済みだ』と答えて公開の議論を示したりすることに、時間のすべてを費やしている」