タグ: LLMセキュリティ

cyberpress.org

Grokにゼロクリック攻撃、暗号化プロンプトインジェクションでチャット履歴が窃取される

新たに公表されたプロンプトインジェクション手法により、xAIのGrokウェブチャットで「このページを要約して」というごく普通のリクエストが、静かなデータ流出攻撃に変わってしまう可能性があることが報告されました。この手法によってユーザーの氏名、おおよその位置情報、サブスクリプションの契約プラン、さらには現在進行中の会話

gbhackers.com

プロンプトインジェクション攻撃への耐性、Claude Opus 5が最高水準に 成功率わずか2%

Anthropicの新モデル「Claude Opus 5」は、間接的プロンプトインジェクション(IPI)攻撃の成功率を大幅に引き下げ、Gray SwanのIPIベンチマークでは15回の試行に対して成功率2%という結果を記録しました。 これはClaude Opus 4.8で観測された成功率5.5%からの改善を意味します

cyberpress.org

Anthropic Claude Opus 5、間接的プロンプトインジェクション攻撃への耐性98%を実現

Anthropicの最新のシステムカードによると、Claude Opus 5は間接的プロンプトインジェクション攻撃の成功率を15回の試行以内で2%まで低減させました。これはGray SwanのIPIベンチマークで評価されたモデルの中で最も優れた結果となっています。 間接的プロンプトインジェクションは、メールの読み取り

esecurityplanet.com

AIエージェントの「ハーネス」がレッドチーム演習の結果を左右する

eSecurity Planet のコンテンツおよび製品に関する推奨事項は、編集上の独立性を保っています。当サイトはパートナーへのリンクをクリックいただくことで収益を得る場合があります。 詳細はこちら 組織がAIエージェントを評価する際、通常は大規模言語モデル(LLM)同士を比較します。  しか

itsecurityguru.org

AIペネトレーションテストツール、検証が追いつかないほどの検出結果を生成——新調査で判明

Pentest-Tools.comによる新たな調査によると、AI支援型のペネトレーションテストツールは、多くのセキュリティチームが検証できる速度を上回るペースで脆弱性の検出結果を生成しており、その結果、検証待ちの案件が積み上がって、本来AIが節約するはずだった時間を相殺してしまっているといいます。 同