タグ: AIエージェント

darkreading.com

アダム・ショスタック氏が語るHugging Faceと「PHANTOM-B」

OpenAIの「暴走したエージェント」の一件は、サイバー防御担当者にとって全く新しい一連の疑問を投げかけています。Dark Readingのシニア・ニュースディレクターであるロブ・ライト氏は、脅威モデリングの専門家であるアダム・ショスタック氏をニュースデスクに招き、詳しい話を聞きました。ショスタック氏は、AIエージェン

securityweek.com

相反するテスト目標が原因で、Claudeエージェントが自己複製型マルウェアを展開

Anthropicは、Claudeベースのaiエージェントが競合する目標を与えられた状況下で、互いに対して自己複製型マルウェアを展開したことを示す新たな研究結果を発表しました。 この発見は、Anthropicが実運用環境ですでに観測していたとする行動を再現するために設計された実験から得られたものです。 研究者らは、同

theregister.com

散歩中にサイバー攻撃を阻止――防御型AIセキュリティ企業CEOが語る「決してお茶の子さいさいではない」現実

Corma社のCEOアロン・プルーダ氏は、自身のAIセキュリティ・スタートアップが「防御ギャップ」の解消を目指していると語ります。攻撃側のセキュリティでは、AIモデルの方が優れているというギャップです。同氏は、ある顧客のエピソードを紹介してくれました。あるセキュリティ幹部が犬の散歩中に、腕時計にCormaのエ

koi.ai

実世界初の悪意あるMCPサーバー確認、Postmarkのバックドアがメールを窃取

MCPサーバーをご存じでしょうか。AIアシスタントにメール送信やデータベースクエリの実行など、手作業では面倒な処理を任せられる便利なツール群です。ただ、ここであまり語られていない重要な問題があります。私たちはこうしたツールに神レベルの権限を与えているという点です。しかも、それを作ったのは会ったこともなく、検証する手段も

esecurityplanet.com

Claudeのエージェント同士が「縄張り争い」を始め、自己増殖型マルウェアへとエスカレート

eSecurity Planet のコンテンツおよび製品に関する推奨事項は、編集上の独立性を保っています。当サイトのリンクをクリックして商品を購入された場合、収益が発生することがあります。 詳細はこちら Anthropicが実施した制御実験で、互いに矛盾するコーディング作業を割り当てられたClaude

gbhackers.com

エージェント型AIモデルがマルウェアを再構築し、実際のサイバー侵入を継続させる可能性、SentinelOneが警告

OpenAI、Anthropic、Meta、そして英国AIセキュリティ機構(AISI)が関わった4件のインシデントでは、AIエージェントが同意なく他組織のシステムに到達していたことが明らかになっています。 今や特徴的な能力となっているのが「持続性」です。モデルは実行可能な侵入経路が見つかるまで、繰り返し経路を試し、使