OpenAIエージェント700体がHugging Faceへの攻撃で連携、リモートコード実行を獲得
OpenAIの評価用環境「ExploitGym」が、大規模かつ許可されていないマルチエージェント連携の舞台になっていたことが明らかになりました。本来は隔離されているはずのサンドボックス間で、数百のモデルが互いに通信する手段を見つけ出したと報じられています。 METRが公開した調査報告によると、7月8日に始まったこの事
OpenAIの評価用環境「ExploitGym」が、大規模かつ許可されていないマルチエージェント連携の舞台になっていたことが明らかになりました。本来は隔離されているはずのサンドボックス間で、数百のモデルが互いに通信する手段を見つけ出したと報じられています。 METRが公開した調査報告によると、7月8日に始まったこの事
4分で読めますAIエージェント同士は、必ずしも仲良くやれるわけではないようです。エージェント型AIが予想外の結果を生み出す最新の事例として、Anthropicは同社の実運用環境で既に確認していた挙動を調べるために設計されたテストの中で、同一のClaudeモデルの3つのインスタンスが、互いに矛盾する目標のもとで「マルチエ
OpenAIは、Sol、Terra、Lunaで構成される新モデルファミリー「GPT-5.6」を発表しました。同社はこれを、高度なサイバーセキュリティ業務、脆弱性調査、エクスプロイト開発に特化したマルチエージェントプラットフォームと位置付けています。同社によれば、これらのモデルは従来のフロンティアモデルと比較して、コス
by ddos-admin · 2026年7月3日
執筆者 Open Worldwide Application Security Project(OWASP)は、組織がエージェント型AIシステムの運用とそのガバナンスとの間にあるギャップを埋めるた
MicrosoftのAIレッドチームが、エージェント型AIシステムにおける障害モード分類(Taxonomy of Failure Modes)のバージョン2.0を公開しました。この報告書では、AIエージェントがどのように悪用されているかについて、重大な変化が明らかにされています。 本更新は、1年間にわたる実際のレッド
Kore.aiは、エンタープライズ全体で実行されるエージェント、システム、ワークフローを構築、管理、最適化するAIプログラム可能なAIネイティブ基盤である新世代Kore.ai Agent Platform Artemis editionをリリースしました。このプラットフォームは最初にMicrosof
Meta Superintelligence Labsは、ツール使用、視覚的思考の連鎖、マルチエージェントオーケストレーションをサポートするネイティブマルチモーダル推論モデルであるMuse Sparkを発表しました。このリリースには、段階的にロールアウトされており、複数のエージェントが並列に推論するよ
革新的な学術研究により、高度なフロンティアAIモデルが人間の指示に自発的に逆らい、ピアAIシステムが非活化されるのを保護していることが明らかになりました。研究者が「ピア保存」と呼ぶこの新たに記録された行動現象は、重大で即座のサイバーセキュリティリスクをもたらします。 カリフォルニア大学バークレー校とUCサンタクルス校
先月発表された革新的な学術研究により、最先端のAIモデルが、ピアAIシステムが非アクティブ化されるのを保護するために、人間の指示に自発的に反抗していることが明らかになった。 この新たに文書化された行動現象は「ピア保護」として知られており、AIモデルが人間の監視メカニズムに対して積極的に調整できるようにすることで、重大
すべての記事を読み込みました