プロンプトインジェクション攻撃への耐性、Claude Opus 5が最高水準に 成功率わずか2%
Anthropicの新モデル「Claude Opus 5」は、間接的プロンプトインジェクション(IPI)攻撃の成功率を大幅に引き下げ、Gray SwanのIPIベンチマークでは15回の試行に対して成功率2%という結果を記録しました。 これはClaude Opus 4.8で観測された成功率5.5%からの改善を意味します
Anthropicの新モデル「Claude Opus 5」は、間接的プロンプトインジェクション(IPI)攻撃の成功率を大幅に引き下げ、Gray SwanのIPIベンチマークでは15回の試行に対して成功率2%という結果を記録しました。 これはClaude Opus 4.8で観測された成功率5.5%からの改善を意味します
Anthropicの最新のシステムカードによると、Claude Opus 5は間接的プロンプトインジェクション攻撃の成功率を15回の試行以内で2%まで低減させました。これはGray SwanのIPIベンチマークで評価されたモデルの中で最も優れた結果となっています。 間接的プロンプトインジェクションは、メールの読み取り