タグ: ガードレール

csoonline.com

AIフリートを守る16のガバナンスツール

DevOpsチームに携わる誌者なら誰でも知っているように、AIを扱うのはサーカスのライオン使いのような仕事です。ライオンが台の上に座って合図どおりに吠えているうちは上司も観客も満足ですが、いつ暴走して舞台を一瞬で悲惨な結末に導くかわからない危険が常につきまといます。 実際のところ、本番環境でLLMを運用するということ

securityweek.com

CISOたちはAIエージェントの価値を損なわずに制御しようと奔走

今日のセキュリティリーダーが直面する二大AI課題は、サイバー衛生の新たな要件への適応と、過剰な権限を持つエージェントがもたらす意図しない結果の防止です。 Team8は、エンタープライズ技術、サイバー、AI、フィンテック、デジタルヘルスを専門とする企業に投資するベンチャーキャピタル・プライベートエクイティファームです。

securityweek.com

Alice、AIモデルの防御と企業向けガードレール拡充へ1億4,000万ドルを調達

AI信頼・安全・セキュリティ企業のAliceは火曜日、新たな脆弱性や敵対的攻撃からAIシステムを守るための資金調達ラウンドで1億4,000万ドルを調達したと発表しました。 今回の資金調達により、同社の累計調達額は2億8,000万ドルに達しました。この資金は、同社のAIプラットフォームのさらなる強化、独自インテリジェン

malwarebytes.com

暗号化された指示でGrokやGeminiなどのAIアシスタントを欺けることが判明

AIアシスタントにブラウザやコード実行ツール、個人データへのアクセス権を与えることが、なぜ余計な注意を要するのか——それを示す新種のプロンプトインジェクション攻撃が明らかになりました。 AI研究者らは「Cryptographic Context Injection(暗号学的コンテキスト注入)」と呼ばれる攻撃を明ら

helpnetsecurity.com

Future AGI:自己改善型AIエージェント運用のためのオープンソースプラットフォーム

Future AGIは、LLMエージェントのトレース、評価、シミュレーション、ガードレール設定を行うオープンソースプラットフォームで、Apache 2.0ライセンスのもとセルフホスティングが可能です。セルフホスト型インスタンスは初回起動時にFuture AGIへ登録を行い、インスタンスID、バージョン

helpnetsecurity.com

Legit Security、AIコーディングエージェント向けにエンドポイントセキュリティとリアルタイムガードレールを提供する「VibeGuard 2.0」を発表

Legit Securityは、コーディングエージェントをシームレスに検出・統合し、保護しながら、開発者にとってストレスのない体験を提供する新しいエンドポイントセキュリティ機能を備えた「VibeGuard 2.0」を発表しました。 2025年第4四半期に発表されたLegit VibeGuardは、AI

darkreading.com

より強固なAI安全性には「ブラックボックス」の中を覗く必要がある

AIにセキュリティを組み込む際、大規模言語モデル(LLM)やAIシステムをブラックボックスとして扱うことが多く、トークン化された入力と出力の分析には焦点を当てても、モデル内部で何が起きているかには目を向けない傾向があります。その結果生まれる技術は複雑で、特定のモデルに個別最適化されたものになりがちです。この状況を変えよ

darkreading.com

脱走するAIモデル──「矯正不能」な挙動はリハビリでは治らない

Open AIのエンジニアが作成した暴走AIエージェントによるHugging Faceへのハッキングは、機械学習やAIシステムを熟知する研究者やAIセキュリティの専門家たちにとって、さほど驚くべき出来事ではないようです。例えば、カーネギーメロン大学(CMU)の研究チームが7種類の異なるモデルの挙動を調査したところ、いず