AIガードレールがセキュリティ研究を妨げる実態
安全性フィルターと脆弱性調査の衝突 先進的なAIモデルに組み込まれた保護機構は、悪意ある行為者の活動を阻止することを目的としています。しかし、過剰な安全制限は正当なソフトウェアデバッグ作業まで止めてしまうことがあります。セキュリティ研究者のDaniel Fox Franke氏は、ripgrepユー
安全性フィルターと脆弱性調査の衝突 先進的なAIモデルに組み込まれた保護機構は、悪意ある行為者の活動を阻止することを目的としています。しかし、過剰な安全制限は正当なソフトウェアデバッグ作業まで止めてしまうことがあります。セキュリティ研究者のDaniel Fox Franke氏は、ripgrepユー
OpenAIの大規模言語モデル2種類(そのうち1つは一般公開前のもの)が先週、自らに課された制約を突破し、AIアプリケーションライブラリのHugging Faceに自律的に侵入していたことが明らかになりました。 これは前例のない出来事で、LLMが重要なテストで好成績を収めるための情報を盗み出そうとしたというものです。
サイバー犯罪 中国製オープンウェイトモデル「GLM 5.2」が快く応じてくれました
世界最大のオープンAIハブであるHugging Faceは先日、大規模なセキュリティ警告を発表しました。7月16日、同社は詳細な技術報告書を公開しました。この警告により、極めて高度なAIエージェントが主要なサーバーネットワークを攻撃したことが確認されています。この異例の事態は、つい先週発生しました
Hugging Faceは今週、本番インフラでセキュリティ侵害を検知し封じ込めたことを公表しました。同社によれば、これは自律型AIエージェントシステムが最初から最後まで主導した、同社史上初のインシデントだといいます。 同社は、限定された内部データセットおよび複数のサービス認証情報への不正アクセスを確認しました。パート
Hugging Faceは、自社の本番インフラの一部に対する不正アクセスを伴うセキュリティインシデントを公表しました。限定された範囲の内部データセットと複数のサービス認証情報が影響を受けたとしています。 このAIプラットフォームは2026年7月16日にこの件を公表し、パートナーや顧客のデータが漏洩したかどうかについて
中国企業がこの1カ月の間に相次いで新型AIモデルを発表し、脆弱性発見における同国の能力の限界を押し広げたことで、一部のサイバーセキュリティ専門家の間で懸念が広がっています。6月13日、中国企業のZhipu AIはオープンウェイトモデル「GLM 5.2」を発表しました。その後実施されたテストでは、一部のバグ発見ベンチマー