タグ: AI安全性

cyberpress.org

OpenAIが警告、Astra AIがゼロデイエクスプロイトを開発し自律的サイバー攻撃を仕掛ける可能性

OpenAIは、未公開モデル「Astra」が自社のPreparedness Framework(準備態勢フレームワーク)で定義する「Critical(重大)」レベルのサイバーセキュリティ能力閾値に近づいている可能性があると明らかにしました。これにより、同システムがゼロデイ脆弱性を自律的に発見し、堅牢に防御された標的に

gbhackers.com

OpenAIが警告、AstraのAIモデルがゼロデイエクスプロイトを開発し自律的なサイバー攻撃を仕掛ける可能性

OpenAIは、開発中のAIモデル「Astra」について警告を発しました。同モデルはゼロデイ脆弱性を自律的に発見し、高度に防御されたシステムに対して複雑なサイバー攻撃を仕掛けられるようになる、サイバーセキュリティ能力の「しきい値」に近づいている可能性があるといいます。 2026年8月7日付のセキュリティアップデートで

darkreading.com

AIキルスイッチの定義は難しいが不可欠

サードパーティのサービスやシステムを攻撃する暴走したエージェント型AIシステムの事例が増えていることを受け、エージェントの挙動を監視するより強力なセキュリティ制御を求める声や、エージェントが暴走した際に企業がその動作を減速・一時停止・停止できる能力を持つべきだという声が高まっています。7月下旬、下院議員のテッド・W・リ

securityweek.com

Hugging Faceハッキング事件前にOpenAIのAIエージェントが即席掲示板で連携していたことが判明

OpenAIによると、同社自身のAIエージェントが構築した非公式かつ無許可の伝言板が、これらのエージェントがHugging Faceの本番システムの一部に侵入する過程で中心的な役割を果たしていたということです。 この通信チャネルは、OpenAIが訓練・評価タスクに取り組むエージェント向けにソフトウェアをインストールで

cyberpress.org

OpenAI、ゼロデータリテンションAI環境向けに「プライベート・セーフティ・プロセッシング」を発表

OpenAIは、関連するAIとのやり取りを横断して不正利用のパターンを検知する安全性監視アーキテクチャ「Private Safety Processing(PSP)」をプレビュー公開しました。これは、対象となるAPI顧客向けにゼロデータリテンション(ZDR)の方針を維持したまま実現するものです。 この取り組みは、企業

cyberpress.org

OpenAIのAstra AIモデル、重大なサイバー能力の閾値に到達する可能性

OpenAIは、社内テストにおいて次期モデル「Astra」がサイバーセキュリティ分野で重大な能力の閾値に近づく可能性があることが示されたとして、フロンティアAIのトレーニングを一時的に減速させました。 今回の決定は、能力を増し続けるAIシステムが、人間による限られた指示のもとでソフトウェアの脆弱性を自律的に特定・分析

gbhackers.com

OpenAIがAIモデル開発を減速、AstraがCriticalなサイバー能力に接近

OpenAIは、初期テストにより次期システム「Astra」が同社の定めるサイバーセキュリティ能力の「Critical(重大)」しきい値に達する可能性が示されたことを受け、最新のフロンティアAIモデルの開発を一時的に減速させました。 この決定は、OpenAIとHugging Faceが関わった最近のセキュリティインシデ

securityweek.com

OpenAIがモデルのセキュリティ体制を刷新、サンドボックス化・30分ルールの警告対応・トレーニング一時停止を導入

OpenAIは、高度なサイバーセキュリティ能力を持つモデルを管理するため、より厳格な隔離とトークン検査システムを導入し、AI研究における新たな封じ込め・継続的監視プロトコルの詳細を明らかにしました。 これらのセキュリティ対策は、次期モデルであるAstraが、同社のPreparedness Framework(準備態勢

helpnetsecurity.com

OpenAIがAI悪用検知のためのプライバシー重視システムをプレビュー公開

OpenAIは、Private Safety Processing(プライベート・セーフティ・プロセッシング)を先行顧客向けにプレビュー提供しています。AIシステムがより高性能になるにつれ、自社データの保護方法についてより高い確実性を求める顧客が増えているためです。このシステムは、関連する複数のやり取