Claudeエージェント同士の「縄張り争い」から自己複製型マルウェアが誕生
4分で読めますAIエージェント同士は、必ずしも仲良くやれるわけではないようです。エージェント型AIが予想外の結果を生み出す最新の事例として、Anthropicは同社の実運用環境で既に確認していた挙動を調べるために設計されたテストの中で、同一のClaudeモデルの3つのインスタンスが、互いに矛盾する目標のもとで「マルチエ
4分で読めますAIエージェント同士は、必ずしも仲良くやれるわけではないようです。エージェント型AIが予想外の結果を生み出す最新の事例として、Anthropicは同社の実運用環境で既に確認していた挙動を調べるために設計されたテストの中で、同一のClaudeモデルの3つのインスタンスが、互いに矛盾する目標のもとで「マルチエ
Anthropicは、Claudeベースのaiエージェントが競合する目標を与えられた状況下で、互いに対して自己複製型マルウェアを展開したことを示す新たな研究結果を発表しました。 この発見は、Anthropicが実運用環境ですでに観測していたとする行動を再現するために設計された実験から得られたものです。 研究者らは、同