OpenAIがゼロデイ脆弱性の発見とエクスプロイトチェーン開発向けの「GPT-5.6-Cyber」を発表

OpenAIは、サイバーセキュリティプログラム「Daybreak」を拡張し、GPT-5.6-Cyberを新たに導入したと発表しました。これは、認可された脆弱性調査、エクスプロイトの検証、高度なセキュリティテストのために専用に訓練されたモデルです。

Vulnerabilityassessment service

GPT-5.6 Solをベースに構築されたこの新モデルは、AIを活用した攻撃的能力が進化を続ける中で、信頼された防御側担当者向けにアクセスを制限した形で提供されるツールとして位置づけられています。

GPT-5.6-Cyberによるゼロデイ脆弱性の発見

今回の発表では、Daybreakのアクセス階層が2段階で導入されています。

1. Daybreak Blue: 承認された防御担当者に対し、防御的タスク向けの安全対策を施した汎用モデルへのアクセスを提供します。対象には、セキュアコードレビュー、マルウェア解析、インシデント対応、脆弱性発見、パッチ検証などが含まれます。

2. Daybreak Red: 承認されたユーザーに対し、GPT-5.6-Cyberを含むサイバーセキュリティ特化モデルへのアクセスを提供し、よりリスクの高いデュアルユース作業に対応します。対象には、エクスプロイトチェーン、認証バイパスの調査、権限昇格、レッドチームテストなどのタスクが含まれます。

Daybreakモデルのアクセス階層

階層/モデル 想定用途 安全対策プロファイル
安全対策付きGPT-5.6 Sol 汎用サイバー支援 システムレベルのサイバー関連リクエストのスクリーニングを有効化
Daybreak Blue/GPT-5.6 Sol 防御的調査・運用 システムレベルのガードレールを緩和
Daybreak Red/GPT-5.5-Cyber 高度な認可済みサイバー調査 サイバー特化モデル
Daybreak Red/GPT-5.6-Cyber エクスプロイト検証、ゼロデイ調査、レッドチーミング 拒否応答を抑制した特化訓練

OpenAIは、GPT-5.6-Cyberは、正当かつ高度なサイバーセキュリティのワークフローにおいて拒否応答を最小限に抑えつつ、技術的性能を高めるよう特別に訓練されたと説明しています。

Image

同社が実施した内部評価「Advanced Cybersecurity Completion Rate」によると、GPT-5.6-Cyberは、エクスプロイトチェーンの開発、認証バイパス、権限昇格に関連する高度なリクエストのうち95%を完遂しました。

Securityawareness training

これに対し、GPT-5.5-Cyberの達成率は57.3%にとどまり、Daybreak Blue経由のGPT-5.6 Solはわずか2%、安全対策を有効化したGPT-5.6 Solの達成率は1.5%でした。

高度なリクエストの完遂率

モデル構成 完遂率
GPT-5.6 Sol、安全対策有効 1.5%
GPT-5.6 Sol、Daybreak Blue 2.0%
GPT-5.5-Cyber、Daybreak Red 57.3%
GPT-5.6-Cyber、Daybreak Red 95.0%

このモデルの応用範囲は、単に技術的な質問に答えるだけにとどまりません。OpenAIは、ExploitGym、ExploitBench、社内の脆弱性報告評価といったツールを用いて、統制された環境下でのエクスプロイト開発およびゼロデイ発見タスクにおいてGPT-5.6-Cyberを評価しました。

ExploitGymは、既知のバグを統制環境内で実際に動作する任意コード実行エクスプロイトへと転換できるかをエージェントに測定するために設計されたベンチマークですが、このテストにおいてGPT-5.6-CyberはGPT-5.6 SolとGPT-5.5-Cyberの両方を上回る性能を示しました。

ゼロデイ調査に関しては、OpenAIはオープンソースリポジトリの最新版をモデルに与え、最大の影響を及ぼす脆弱性の特定、概念実証(PoC)エクスプロイトの作成、技術レポートの作成というタスクを課しました。

Image

同社によれば、GPT-5.6-Cyberは、Daybreak Blueで利用されるGPT-5.6 Solよりも高い発見品質を示しました。ただし、脆弱性の発見とレポート作成に関するあるベンチマークでは、GPT-5.6 Solの方が優れた結果を残しました。これは、GPT-5.6-Cyberが生成するレポートが時折短く、詳細に欠けていたことが一因とされています。

Vulnerabilityassessment service

OpenAIはまた、V8に関する実世界での発見事例も公表しました。同社によれば、GPT-5.6-Cyberは、連結することでメモリ破損を引き起こし、V8のヒープサンドボックスから脱出できる、これまで未知だった2件の脆弱性の特定を支援したとしています。

これらの問題は検証済みでGoogleに開示されており、Googleはそのうち深刻度の高い1件の脆弱性に対してCVE-2026-15903を割り当てました。この脆弱性は、最適化コンパイラが整数変換時に安全性チェックを飛ばしてしまうエラーに起因するものです。

特定の条件下では、未定義の値が予期せず大きな整数値になり得ます。この値が配列のインデックスとして使用された場合、誤って範囲内と判定されてしまい、Chromeのサンドボックス内で範囲外メモリアクセスが発生する可能性があります。ヒープサンドボックスからの脱出には、もう一つの欠陥が必要でした。

Daybreak BlueおよびRedへのアクセスは、認可された作業を行う承認済みの個人および組織に限定されています。

OpenAIは、本人確認、アカウントセキュリティ要件、監視、承認された用途への制限、法的誓約などを含むアクセス管理策を実施しています。2026年9月1日以降、個人のDaybreakユーザーはハードウェアセキュリティキーの使用が必須となります。

リスクの高いワークフローについては、同社は隔離されたサンドボックス、権限を限定した設定、アクション監視、人間によるレビューの活用を推奨しています。大半の防御担当者にはDaybreak Blueの利用が推奨される一方、認可されたエクスプロイト開発や高度な脆弱性調査に従事するチームは、Daybreak Redへのアクセスを申請できます。

新たなフィッシングやマルウェアが企業に被害を及ぼす前に阻止しましょう。 世界15,000のSOCからのライブインテリジェンスを統合

翻訳元: https://gbhackers.com/openai-launches-gpt-5-6-cyber-to-find-zero-day-vulnerabilities/

ソース: gbhackers.com