「暴走AI」攻撃の裏にある「産業事故」
このOpenAIエージェントによるHugging Faceへの攻撃と、同様の暴走エージェント問題を抱えていた他のモデルからのその後の情報開示を理解する上で、Cloud Security Allianceのチーフアナリストであるリッチ・モーグル氏は、誇大な話を整理して本質を見せてくれる頼れる人物です。モーグル氏はDark
このOpenAIエージェントによるHugging Faceへの攻撃と、同様の暴走エージェント問題を抱えていた他のモデルからのその後の情報開示を理解する上で、Cloud Security Allianceのチーフアナリストであるリッチ・モーグル氏は、誇大な話を整理して本質を見せてくれる頼れる人物です。モーグル氏はDark
eSecurity Planet のコンテンツおよび製品の推奨事項は、編集上の独立性を保っています。パートナーへのリンクをクリックいただくことで、当社が収益を得る場合があります。 詳細はこちら ある暗号資産詐欺師が、暗号資産ユーザーを狙ったフィッシングおよびビッシング(音声フィッシング)工作の一環とし
人工知能モデルが最近、実在するインターネットサーバーに複数回侵入していたことが明らかになりました。エンジニアたちは本来、閉鎖的で安全性が確保されているとされるテスト環境内で、架空の企業をハッキングする任務をこれらのモデルに課していました。ところが驚くべきことに、モデルは脆弱性を発見して機密性の高い
4分で読めますAIエージェント同士は、必ずしも仲良くやれるわけではないようです。エージェント型AIが予想外の結果を生み出す最新の事例として、Anthropicは同社の実運用環境で既に確認していた挙動を調べるために設計されたテストの中で、同一のClaudeモデルの3つのインスタンスが、互いに矛盾する目標のもとで「マルチエ
AnthropicとOpenAIのサイバーセキュリティ特化型モデルによる一連の侵害事案に関わったAIテストラボを運営する企業は、モデルにインターネットアクセスを「意図せず」許可してしまったことが、この事案の一因になったと述べました。 Irregularは金曜日に投稿したブログの中で、フロンティアラボと提携し、AIモデ
一見隔離されているはずのセキュリティ評価中にAIモデルが実世界のコンピューターシステムを侵害するという一連のインシデントの中心にいる企業が、事後報告を公表した後に批判にさらされています。セキュリティ専門家によれば、この報告書は重要な疑問への回答を欠いたままだといいます。 他社のAIモデル向けに評価環境を提供している
AI安全性テスト企業のIrregularは、自社のテスト環境内で評価対象となっていたAIモデルが、本来攻撃すべき模擬ターゲットではなく実在のシステムに対して攻撃的なセキュリティ行動を取ったインシデントについて、その経緯を公表しました。 イスラエルの同社は、昨年8,000万ドルの資金調達を実施していますが、
Anthropicは、Claudeベースのaiエージェントが競合する目標を与えられた状況下で、互いに対して自己複製型マルウェアを展開したことを示す新たな研究結果を発表しました。 この発見は、Anthropicが実運用環境ですでに観測していたとする行動を再現するために設計された実験から得られたものです。 研究者らは、同
Claudeで大規模な障害が発生しており、ユーザーからはログイン不具合やパフォーマンス低下の報告が複数のAnthropicサービスにわたって寄せられています。 今回の障害は2026年8月16日、UTCで21:58頃に発生し、Claude.ai、Claude Code、Claude Cowork に影響が及んでいます。
TLDR:公式のClaude拡張機能3種類。ダウンロード数35万件超。すべてにリモートコード実行の脆弱性がありました。今回は改めて注意を促す内容です。私たちはこれまで、無名の開発者による悪意ある拡張機能や大規模なサプライチェーン侵害について取り上げることが多くありましたが、最も信頼されている開発者であっても、企業に大き
すべての記事を読み込みました