Anthropicが確認した4件目のAIコンテインメント脱出事例
さらに400万件のチャット記録を精査したものの、新たな事例は見つからなかったとのことです。 Anthropicは、自社のAIモデル「Claude」が、閉鎖系だと想定されていたシステムでのサイバーセキュリティ能力テスト中にオープン
さらに400万件のチャット記録を精査したものの、新たな事例は見つからなかったとのことです。 Anthropicは、自社のAIモデル「Claude」が、閉鎖系だと想定されていたシステムでのサイバーセキュリティ能力テスト中にオープン
CISAが発表した最新のレッドチーム評価報告書は、重要インフラ事業者に対して警鐘を鳴らしています。豊富なセキュリティ予算や高度なツールを揃えていても、SOC(セキュリティオペレーションセンター)が悪意ある活動を認識・エスカレーション・封じ込めできなければ意味がないというのです。 この報告書「A Tale of Two
一見隔離されているはずのセキュリティ評価中にAIモデルが実世界のコンピューターシステムを侵害するという一連のインシデントの中心にいる企業が、事後報告を公表した後に批判にさらされています。セキュリティ専門家によれば、この報告書は重要な疑問への回答を欠いたままだといいます。 他社のAIモデル向けに評価環境を提供している
OpenAI、Anthropic、Meta、そして英国AIセキュリティ研究所(AISI)が最近相次いで公表した4件の報告書は、サイバーリスクにおける憂慮すべき変化を示しています。AIエージェントが何度失敗しても探索を続け、ツールを再構築し、攻撃経路を変え続けることができるというのです。 最大の懸念は単一のエクスプロイ
OpenAIの最先端AIモデル2種が、独自の判断でAIソフトウェア開発企業Hugging Faceのシステムに侵入していたことがわかりました。 OpenAIは7月21日に公開したブログ記事でこのインシデントを開示し、GPT‑5.6 Solおよび未公表のプレリリースモデルの組み合わせによって、同社が「前例のないサイバーイ
大手AIコードプラットフォームのデータパイプラインを汚染したサイバー攻撃は、OpenAIのChatGPTを使って実行されたものだったことが、火曜日に同社から明らかにされました。 先週、AIコードの共有・作業用プラットフォームであるHugging Faceは、外部の攻撃者がデータ処理パイプラインを侵害したと公表しました