AIはあなたとはまったく違う形でメールを「読む」ことがある
研究者らは、目に見えないHTMLを使ってAIメール要約ツールに隠された指示を注入し、ユーザーに提示される要約内容を密かに操作できることを実証しました。 セキュリティ研究者らは、受信トレイに表示されているメールと
研究者らは、目に見えないHTMLを使ってAIメール要約ツールに隠された指示を注入し、ユーザーに提示される要約内容を密かに操作できることを実証しました。 セキュリティ研究者らは、受信トレイに表示されているメールと
新たに公表されたプロンプトインジェクション手法により、xAIのGrokウェブチャットで「このページを要約して」というごく普通のリクエストが、静かなデータ流出攻撃に変わってしまう可能性があることが報告されました。この手法によってユーザーの氏名、おおよその位置情報、サブスクリプションの契約プラン、さらには現在進行中の会話
発見したセキュリティ研究者によって「CoSnitch」と名付けられたこの脆弱性は、明確な危険信号を出すことなく企業からデータを窃取する攻撃チェーンを実行します。 AIアシスタント「Copilot」の個人向け版に存在する重大
AIエージェントが侵害される際、その原因はモデル自体にはないことが新たな調査で明らかになりました。問題はモデルを包み込むコードにあります。しかも、そこに十分な監視の目が向けられている組織はほとんどありません。 AIエージェントの
Anthropicの新モデル「Claude Opus 5」は、間接的プロンプトインジェクション(IPI)攻撃の成功率を大幅に引き下げ、Gray SwanのIPIベンチマークでは15回の試行に対して成功率2%という結果を記録しました。 これはClaude Opus 4.8で観測された成功率5.5%からの改善を意味します
Anthropicの最新のシステムカードによると、Claude Opus 5は間接的プロンプトインジェクション攻撃の成功率を15回の試行以内で2%まで低減させました。これはGray SwanのIPIベンチマークで評価されたモデルの中で最も優れた結果となっています。 間接的プロンプトインジェクションは、メールの読み取り
eSecurity Planet のコンテンツおよび製品に関する推奨事項は、編集上の独立性を保っています。当サイトはパートナーへのリンクをクリックいただくことで収益を得る場合があります。 詳細はこちら 組織がAIエージェントを評価する際、通常は大規模言語モデル(LLM)同士を比較します。 しか
Pentest-Tools.comによる新たな調査によると、AI支援型のペネトレーションテストツールは、多くのセキュリティチームが検証できる速度を上回るペースで脆弱性の検出結果を生成しており、その結果、検証待ちの案件が積み上がって、本来AIが節約するはずだった時間を相殺してしまっているといいます。 同
このチャートが興味深い内容になっています。 IPIベンチマークにおいて、Opus 5はOpus 4.8から改善が見られ、攻撃者が15回の試行以内に成功する確率を5.5%から2.0%へ、1回の試行での成功確率を0.5%から0.2%へとそれぞれ引き下げました。また、Sonnet 5(k=15で5.9%)およびM
リスクを軽減する手段はいくつかあるものの、確実に阻止する方法は「命令」と「データ」をAIに区別させることしかなく、それは現時点では実現不可能です。 ノルウェーの著名なAI研究者が火曜日、WordやCopilotをはじめとす
すべての記事を読み込みました