1行のコードで11のAIモデル(ChatGPT、Claude、Geminiを含む)をジェイルブレイク可能
「ソックパペッティング」と呼ばれる新たに発見されたジェイルブレイク技法が、ChatGPT、Claude、Geminiを含む11の主要な大規模言語モデル(LLM)のセーフティガードレールを1行のコードで回避できることを研究者が実証した後、AI セキュリティ分野全体で新たな懸念を引き起こしています。 この攻撃は、Tren
「ソックパペッティング」と呼ばれる新たに発見されたジェイルブレイク技法が、ChatGPT、Claude、Geminiを含む11の主要な大規模言語モデル(LLM)のセーフティガードレールを1行のコードで回避できることを研究者が実証した後、AI セキュリティ分野全体で新たな懸念を引き起こしています。 この攻撃は、Tren
「ソックパペッティング」という新たに発見されたジェイルブレイク技術は、ChatGPT、Claude、Geminを含む11の主要な人工知能モデルを強制的にセーフティガードレールを回避させることに成功しています。 標準的なアプリケーションプログラミングインターフェース(API)機能を1行のコードで悪用することで、攻撃者は