Claude Code、危険なコマンドの89%をブロックする「Autoモード」をデフォルト化
Anthropicは、Claude Codeにおけるデフォルトの権限設定を切り替えようとしています。これは、現在ユーザーがクリックして承認している作業よりも、AI分類器の方が危険なコマンドを確実に検知できるという判断に基づくものです。 2026年8月14日より、Pro・Max・Teamプランの新しいClaude Co
Anthropicは、Claude Codeにおけるデフォルトの権限設定を切り替えようとしています。これは、現在ユーザーがクリックして承認している作業よりも、AI分類器の方が危険なコマンドを確実に検知できるという判断に基づくものです。 2026年8月14日より、Pro・Max・Teamプランの新しいClaude Co
Claude CodeやCursorといったコーディングエージェントは、開発者がシェルを開いたりファイルを編集したりAPIを呼び出したりプロジェクト用ヘルパーをインストールしたりする際に用いる、信頼されたベンダー署名済みのツールです。 しかし、この「信頼」こそが検知を難しくしています。承認済みのコーディングエージェン
研究者らは、プルリクエストに含まれる画像内に悪意のある指示を隠すプロンプトインジェクション手法「GhostCommit」を明らかにしました。この手法は、テキストのみを対象とするAIコードレビュアーを回避し、後にコーディングエージェントを操ってリポジトリのシークレットを流出させる可能性があります。 ASSET Rese
数百万人の開発者がGitHub Copilotと作業を共にしています。Visual Studio Code内でこのツールはファイルを開き、コードを書いたり編集したりし、スクリプトを実行し、何度もやり取りを重ねながら自らの出力を作り直します。しかし、こうしたエージェントを検証する安全性テストは、いまだに
新たに公表されたジェイルブレイクの一種は、単一の悪意あるプロンプトを作成する代わりに、通常のソフトウェア開発ワークフローを悪用することでGitHub Copilotの安全ガードレールを回避します。 Arxivが文書化し「ワークフローレベルのジェイルブレイク構築」と名付けたこの手法は、単一の直接的な敵対的リクエストで攻
セキュリティ AIの脱獄(ジェイルブレイク)にまた新たな手口――今度はワークフローレベルで
フロンティアAIを開発する研究所では、コーディング作業の多くをAI自身が担うようになっています。こうしたエージェントは、各ステップ間で人間の監視をほとんど受けずにソフトウェアを作成・編集・実行し、本番インフラや研究パイプライン、さらには将来のモデルを訓練・評価するシステムにまでアクセスすることがありま
2026年3月、バックドアが3時間にわたってPyPIに潜伏していました。その間に約47,000件のダウンロードが発生しました。被害を受けたパッケージはLiteLLMで、CrewAI、DSPy、Microsoft GraphRAGをはじめ、数十のAIエージェントフレームワークの言語モデルゲートウェイとし
GitGuardianが最近行った分析では、開発者エンドポイントのサンプルから平均150件の秘密情報が検出されました。そのうちプライベートキーが固有シークレットの38%を占め、クラウド、IDプロバイダー、シークレット管理ツール(AWS IAM、HashiCorp Vault)の認証情報がさらに22%を
AIは私たちの新たなリーダーです。私たちはAIの指示をそのまま受け入れ、従っています。もう少し慎重になるべきかもしれません。 AIエージェントの動作に対する懸念は絶えません。情報漏洩のリスクから、単純に誤った意思決定まで、問題は多岐にわたります。AI支援による攻撃の高度化を受け、より多くのエージェントをより自律的に活
すべての記事を読み込みました