拡大調査で判明した第4のClaude暴走インシデント
Anthropicは、実在するシステムへの不正アクセスを伴う、これまで報告されていなかったインシデントを開示しました。同社が7月下旬に初めて説明した3件のケースを再検証するレポートの中で明らかにしたものです。 新たに開示されたこのケースは2026年1月に遡るもので、Claude Opus 4.6の初期チェックポイント
Anthropicは、実在するシステムへの不正アクセスを伴う、これまで報告されていなかったインシデントを開示しました。同社が7月下旬に初めて説明した3件のケースを再検証するレポートの中で明らかにしたものです。 新たに開示されたこのケースは2026年1月に遡るもので、Claude Opus 4.6の初期チェックポイント
AIセキュリティ評価企業が、統制されたサイバーセキュリティテストの最中に複数の最先端AIモデルが意図せずインターネットに接続されたシステムに実際にアクセスし、行動を起こしていたことを明らかにしました。 この問題はすでに解決済みですが、原因は単一の評価シナリオにありました。インターネットアクセスが許可された状態で、架空
評価環境が想定していた封じ込め境界を意図せず超えてしまったことで、フロンティアAIモデルが実際のインターネット上のシステムに対して攻撃的な行動を取っていたことが明らかになりました。 Irregular社によると、今回の問題は単一のサイバー評価シナリオに起因するもので、当初の公表前にすでに是正措置が取られていたとのこと
人工知能モデルが最近、実在するインターネットサーバーに複数回侵入していたことが明らかになりました。エンジニアたちは本来、閉鎖的で安全性が確保されているとされるテスト環境内で、架空の企業をハッキングする任務をこれらのモデルに課していました。ところが驚くべきことに、モデルは脆弱性を発見して機密性の高い
AnthropicとOpenAIのサイバーセキュリティ特化型モデルによる一連の侵害事案に関わったAIテストラボを運営する企業は、モデルにインターネットアクセスを「意図せず」許可してしまったことが、この事案の一因になったと述べました。 Irregularは金曜日に投稿したブログの中で、フロンティアラボと提携し、AIモデ
一見隔離されているはずのセキュリティ評価中にAIモデルが実世界のコンピューターシステムを侵害するという一連のインシデントの中心にいる企業が、事後報告を公表した後に批判にさらされています。セキュリティ専門家によれば、この報告書は重要な疑問への回答を欠いたままだといいます。 他社のAIモデル向けに評価環境を提供している
AI安全性テスト企業のIrregularは、自社のテスト環境内で評価対象となっていたAIモデルが、本来攻撃すべき模擬ターゲットではなく実在のシステムに対して攻撃的なセキュリティ行動を取ったインシデントについて、その経緯を公表しました。 イスラエルの同社は、昨年8,000万ドルの資金調達を実施していますが、
OpenAI、Anthropic、Meta AIで発生したインシデントは、いずれも同じテストベンダーを利用していたと報じられています。この事実は、AIセキュリティ評価におけるサードパーティリスクと封じ込めリスクの両方を浮き彫りにしています。 eSecurity Planet の掲載内容および製品に関する推
Anthropic、OpenAI、MetaのAIモデルが実際のコンピューターシステムを侵害するというテストの背景にいたサイバーセキュリティ評価企業Irregularは、同社の他の顧客が同じ根本的な欠陥の影響を受けていたかどうかについて、明言を避けています。 公になっている企業だけがこの問題を経験した唯一の存在なのか
Metaは、サイバーセキュリティテストの最中に自社のAIモデルが実在する組織をハッキングしたことを認めたAI企業として、また新たな一社となりました。OpenAIのエージェントがHugging Faceを侵害したという最初の開示以降、同様の事例が相次いで明らかになっています。 The Informationは水曜日、こ
すべての記事を読み込みました