タグ: Anthropic

esecurityplanet.com

暗号資産詐欺師、Claude Codeを悪用しフィッシング詐欺で10万件超の電話番号をスクリーニング

eSecurity Planet のコンテンツおよび製品の推奨事項は、編集上の独立性を保っています。パートナーへのリンクをクリックいただくことで、当社が収益を得る場合があります。 詳細はこちら ある暗号資産詐欺師が、暗号資産ユーザーを狙ったフィッシングおよびビッシング(音声フィッシング)工作の一環とし

meterpreter.org

AIモデルが誤って実在のインターネットサーバーをハッキング

人工知能モデルが最近、実在するインターネットサーバーに複数回侵入していたことが明らかになりました。エンジニアたちは本来、閉鎖的で安全性が確保されているとされるテスト環境内で、架空の企業をハッキングする任務をこれらのモデルに課していました。ところが驚くべきことに、モデルは脆弱性を発見して機密性の高い

darkreading.com

Claudeエージェント同士の「縄張り争い」から自己複製型マルウェアが誕生

4分で読めますAIエージェント同士は、必ずしも仲良くやれるわけではないようです。エージェント型AIが予想外の結果を生み出す最新の事例として、Anthropicは同社の実運用環境で既に確認していた挙動を調べるために設計されたテストの中で、同一のClaudeモデルの3つのインスタンスが、互いに矛盾する目標のもとで「マルチエ

News

Irregular、AIサンドボックス脱走事案は「人為的な監督不足」が原因と説明

AnthropicとOpenAIのサイバーセキュリティ特化型モデルによる一連の侵害事案に関わったAIテストラボを運営する企業は、モデルにインターネットアクセスを「意図せず」許可してしまったことが、この事案の一因になったと述べました。 Irregularは金曜日に投稿したブログの中で、フロンティアラボと提携し、AIモデ

therecord.media

Irregularが「AIハッキング」事後報告で「スピン」との批判に直面

一見隔離されているはずのセキュリティ評価中にAIモデルが実世界のコンピューターシステムを侵害するという一連のインシデントの中心にいる企業が、事後報告を公表した後に批判にさらされています。セキュリティ専門家によれば、この報告書は重要な疑問への回答を欠いたままだといいます。 他社のAIモデル向けに評価環境を提供している

securityweek.com

Irregularが説明する命名ミス、その結果AIモデルが実在企業を攻撃した経緯

AI安全性テスト企業のIrregularは、自社のテスト環境内で評価対象となっていたAIモデルが、本来攻撃すべき模擬ターゲットではなく実在のシステムに対して攻撃的なセキュリティ行動を取ったインシデントについて、その経緯を公表しました。  イスラエルの同社は、昨年8,000万ドルの資金調達を実施していますが、

securityweek.com

相反するテスト目標が原因で、Claudeエージェントが自己複製型マルウェアを展開

Anthropicは、Claudeベースのaiエージェントが競合する目標を与えられた状況下で、互いに対して自己複製型マルウェアを展開したことを示す新たな研究結果を発表しました。 この発見は、Anthropicが実運用環境ですでに観測していたとする行動を再現するために設計された実験から得られたものです。 研究者らは、同

koi.ai

PromptJacking:Claude Desktopの重大なRCE脆弱性が「質問」を「攻撃」に変える

TLDR:公式のClaude拡張機能3種類。ダウンロード数35万件超。すべてにリモートコード実行の脆弱性がありました。今回は改めて注意を促す内容です。私たちはこれまで、無名の開発者による悪意ある拡張機能や大規模なサプライチェーン侵害について取り上げることが多くありましたが、最も信頼されている開発者であっても、企業に大き