Anthropic、セキュリティプログラムを再編 3段階の脅威ハンティング枠に

セキュリティ

同社の「Project Glasswing」と「Cyber Verification Program」は、3つのティアからなる脅威ハンティングプログラムへと姿を変えました

競合するZ.aiのモデル「GLM-5.3」と、その高度なサイバーセキュリティ能力の危険性について警告してからわずか1週間後、Anthropicは「Cyber Verification Program(CVP)」を拡大しました。より正確に言えば、再編しました。

AI企業である同社は発表の中で、次のように述べています。「過去6か月間、当社はProject GlasswingとCVPという2つのプログラムを通じて、信頼できる組織にアクセスを提供してきました。今回、これらを1つの拡張プログラムに統合しました。より多くのセキュリティ組織が、システム防御に必要な機能を利用できるようにするためです」

Project GlasswingとCVPは、2026年4月に始まりました。同時に、高い能力を持ち、同じくらい大きな話題を集めた同社のフロンティアモデル「Mythos」もデビューしています。Project Glasswingでは、パートナー企業がMythosに先行してアクセスできました。攻撃者より先に、自社システムの脆弱性を洗い出すためです。

ただ、VulnCheckの研究者Patrick Garrity氏は、Project Glasswingが特定したCVEをそれほど評価していません。同氏が追跡したAnthropic関連の脆弱性225件のうち、実際に悪用が確認されたのは0.5%未満だったといいます。さらに、Anthropic自身が先月公表したGLM-5.3のリスクに関する警告は、自社のMythosモデルが特別だという見方をいくらか弱めています。

それでもAnthropicは、2026年4月から7月までの間に、パートナー企業が検証済みのソフトウェア脆弱性を少なくとも12万9,000件発見したと説明しています。さらに、同社自身のオープンソーススキャンでも、4月から10月にかけて新たに5,500件の検証済み脆弱性が見つかったとしています。

Anthropicは次のように述べています。「検証済みの脆弱性のうち、これまでに3万3,000件超が重大(critical)または高(high)の深刻度と評価されました。ただし、この数字は過少である可能性があります。Glasswingパートナーの一部を対象にしたアンケートデータに基づいているためです。実際の影響は、少なくとも5倍にのぼると見ています」

これらがいつ修正されるのかは不明です。同社自身の数字によると、真陽性の脆弱性5,674件のうち、深刻度が高いものは3,014件、重大なものは1,522件ありますが、修正済みはわずか516件にとどまります。AIモデルのサイバーセキュリティ能力が業界でこれほど喧伝されている以上、修正の生成、テスト、展開は、今ごろほぼ自動化されていてもおかしくないはずです。 

しかし、脆弱性の特定と修正の間にこれほど開きがあることは、システムにまだ多くの緩みがあり、解消すべき課題が残っていることを示唆しています。 

2つのプログラムを1つに統合、3つのティアで運用

Anthropicの2つのプログラムは、一方が組織向け、もう一方が個々のセキュリティ専門家向けでしたが、今回統合され、3つのティアに再編されました。Anthropicは理由を説明していません。ただ、モデルの能力を特定のタスクに結びつけることが狙いだとしています。ティアは「Defense Access」「Red Team Access」「Specialized Access」です。ティアによって、セキュリティ関連タスクでの制限の多さが変わります。

プログラム参加の価値を示す指標として、Anthropicは次の結果を挙げています。10件のCyScenarioBench課題に各5回ずつ挑戦したところ、CVPのアクセス権を持たない場合は、すべての試行でブロックされました。

Defense Accessは、システム防御に取り組む企業、非営利団体、大学、政府機関のセキュリティチームを対象としています。このティアでは、Claude Opus 5.5は50回の試行のうち46回で拒否に遭い、成功したのは4回でした。

Red Team Accessは、ペネトレーションテストや攻撃的なサイバー評価向けです。ただし、物理的な被害や大規模な混乱を招くおそれのあるモデルの利用では、引き続き拒否される場合があります。具体的には、Red Team Accessの保護機能を有効にした状態で、Claude Opus 5.5は50タスクのうち34件を完了しました。この成功率は、Specialized Accessで見込まれる水準と同程度です。

Specialized AccessはGlasswingの名称変更のように見えます。対象は「人々の生活に影響を与えたり、市場を混乱させたりしうる安全システム(フライト運用システム、電力網、通信ネットワーク、銀行間送金インフラ、政府の行政ネットワークなど)のテストを認められた、検証済みの限られた組織」に限られます。

この限定ティアへの参加を認められた組織は、モデルによる拒否が最も少なくなります。ただし、ガードレールを無効化したアブリタレーション(abliterated)済みのオープンウェイトモデルを使う場合は別です。

今後1〜2か月は、プログラム参加者はAnthropicのAI安全要件の一環として、データの保持を許可する必要があります。しかし近いうちに、同社のEnterprise Frontier Safeguardsプログラムで、データのゼロ保持が提供される予定です。Claude Fable 5.1またはClaude Mythos 5.1の利用時にすでにゼロデータ保持を認められている組織は、同じ条件でCVPに参加できます。®


翻訳元: https://www.theregister.com/security/2026/10/07/anthropic-reconfigures-its-cool-kids-security-program/5301509

本記事は theregister.com の記事を翻訳・要約したものです。