AIエージェントが「暴走」する傾向を測定する
このエッセイはBarath Raghavan氏と共同で執筆したもので、元はThe Guardianに掲載されました。 2026年7月、世界のAIソフトウェアやオープンソースAIモデルの多くをホストする企業Hugging Faceがハッキングされました。悪意のあるデータセットが使われ、同社のサーバー上でコード
このエッセイはBarath Raghavan氏と共同で執筆したもので、元はThe Guardianに掲載されました。 2026年7月、世界のAIソフトウェアやオープンソースAIモデルの多くをホストする企業Hugging Faceがハッキングされました。悪意のあるデータセットが使われ、同社のサーバー上でコード
AIとML 「信頼せよ、されど検証せよ」も、検証が困難であれば意味を成しません AIモデルは求められ
AIと機械学習 「信頼はするが検証はする」――その検証自体が困難な場合、この原則は機能しません AI
Mythosはソフトウェア脆弱性の検出において主張通り強力であるように見えるが、他の分野での機能はより複雑である。 Anthropicの Mythos AIモデルは4月初旬の発表以来話題になっており、主に他のAIモデルよりも大幅に多くの脆弱性を発見する能力があることで知られています。自律型オフェンシブセキュリティ企業