beelzebub.ai 2026年7月11日 04:48 野生のAIエージェントを捕らえる 第2回:LLMだけが直せる、壊れたカナリアトークン 概要 第1回では、ハニーポットの検知手法として「リバース・プロンプトインジェクション」を紹介し、自律型LLMエージェントによる攻撃セッション全体の捕捉に成功しました。単一のTor出口ノードから約19分間で58件のリクエストがあり、複数ツールの切り替え、HTMLコメントからの意味的な認証情報抽出、文脈に応じたペイロード