Google、「Gemini 4 Argon」は重大なソフトウェア脆弱性を発見し修正できると発表

Googleは、新たなフロンティアAIモデル「Gemini 4 Argon」を発表しました。信頼できるサイバー防御担当者を対象とした「Fairwind Program」を通じて、まずは限られた利用者に提供を始めます。Googleによると、このモデルは重大なソフトウェアの脆弱性を見つけ出し、検証し、人手を介さずにパッチを適用できます。サイバー分野のガードレールを外したバージョンを、こうした防御担当者と社内チームに提供する予定です。

Image

開発者、企業、一般ユーザーへの提供は後になり、有料APIの顧客とGoogle AI Ultraの加入者から順に始まります。Googleはブログで、この水準の能力を安全に公開するには段階的な手法が必要だと説明しています。ガードレールは初期テスターのフィードバックを受けて調整を続けており、リリース前のモデルに米国政府が自主的にアクセスする枠組みにも参加しているということです。

Googleは一般公開に先立ち、サイバー攻撃に加え、化学、生物、放射性物質、核による悪用への防御策を強化しているといいます。社内外のレッドチーム(システムを攻撃して弱点を洗い出すグループ)がこれらの防御策をテスト済みです。さらに、Argonの推論と動作を監視するモニターが、必要に応じて実行を停止するとしています。

Argonにできること

Googleは出力上限、つまりモデルが1回の応答で書けるテキスト量を、6万4,000トークンから100万トークンへ引き上げました。Googleによると、この余裕によって、モデルは1回の実行で数十万トークンにわたり思考し、文章を生成できます。

Wizは「Scan for Good」プログラムでArgonを活用しています。このプログラムは、重要な公共インフラを対象に、リスクの高い露出を無償でスキャンして修正するものです。Googleによると、Argonは世界中の病院で使われている医療ソフトウェアで、機微な個人情報が露出する重大な脆弱性を発見しました。従来のフロンティアモデルが見逃していたものです。ただし、Googleはソフトウェア名を明らかにしておらず、パッチが適用済みかどうかも説明していません。

Argonのエージェントは、Googleのデータセンター全体にメモリ最適化を適用しました。展開後に解放されたメモリは300 TiB超に上ります。また、動画デコーダー「libgav1」のSIMDコード3万2,000行を、メモリエラーを避けるよう設計された言語であるRustに置き換えました。このRust版デコーダーは、従来のRust移植版より2.7倍高速で、動画の出力は同一です。別のエージェントはCやC++のコードをRustに書き換えており、Fuchsia Zirconカーネル向けの80万行超も含まれます。ただし、これらの書き換えは本番投入の前に、監査、エミュレーションテスト、レビューを受けている段階です。

ベンチマークの結果

Googleは、長時間のソフトウェアエンジニアリング課題を測る「DeepSWE v1.1」で77.9%を記録し、最先端の水準だとしています。ZapierのAutomationBenchでは51.3%で首位、長尺動画テスト「LVBench」では91.7%で、こちらも最先端の水準だといいます。セキュリティ脆弱性の修正を測る「CWE-bench v1」では、Argonのスコアは68%で、首位タイとなりました。

脆弱性発見の結果は、社内テストによるものです。Googleのテストは、20種類のプログラミング言語にまたがる複雑なコードベースを対象としています。Wizのブラックボックス型ペネトレーションテストでは、モデルがソースコードなしで稼働中のWebシステムを調べます。Argonは、攻撃対象領域のマッピング、脆弱性の発見、概念実証(PoC)の証拠作成のいずれでも、3.8 Flash Cyberを上回りました。

価格

Argonは導入価格で提供を始め、入力は100万トークンあたり2ドル、出力は100万トークンあたり10ドルです。キャッシュされた入力トークンは、入力価格より95%安くなります。導入期間が終わると、料金は4ドルと20ドルへ倍増します。

翻訳元: https://www.helpnetsecurity.com/2026/10/01/google-gemini-4-argon/

本記事は helpnetsecurity.com の記事を翻訳・要約したものです。