AIエージェントの「ハーネス」がレッドチーム演習の結果を左右する
eSecurity Planet のコンテンツおよび製品に関する推奨事項は、編集上の独立性を保っています。当サイトはパートナーへのリンクをクリックいただくことで収益を得る場合があります。 詳細はこちら 組織がAIエージェントを評価する際、通常は大規模言語モデル(LLM)同士を比較します。 しか
eSecurity Planet のコンテンツおよび製品に関する推奨事項は、編集上の独立性を保っています。当サイトはパートナーへのリンクをクリックいただくことで収益を得る場合があります。 詳細はこちら 組織がAIエージェントを評価する際、通常は大規模言語モデル(LLM)同士を比較します。 しか
大規模言語モデルを探索する攻撃者は、一度拒否されてもめったに諦めない。文脈を組み替え、複数のターンをまたいで文脈を積み上げ、ペルソナを採用し、徐々にエスカレートさせる。CiscoのAI脅威インテリジェンスチームの新たな研究により、業界全体で使用されている安全性ベンチマークがこうした挙動のほぼすべてを見
Ciscoの研究者たちが、主要なAIモデルが現実的なマルチターン攻撃に対していかに脆弱であるかを示し、ベンダーのシングルプロンプト安全性ベンチマークの価値に疑問を呈した。 組織のAI利用やモデル選定に関するセキュリティ上の意思決定にお
Ciscoの研究者たちは、ユーザーがLLMを複数の側面を持つ継続的な会話に誘い込むことで、いくつかの著名な大規模言語モデル(LLM)の安全ガードレールを回避できると警告しています。 研究者たちは、OpenAIのChatGPT、AnthropicのClaude、Google Gemini、Amazon Nova、xAIの