タグ: 強化学習

cyberpress.org

OpenAIのAstra AIモデル、重大なサイバー能力の閾値に到達する可能性

OpenAIは、社内テストにおいて次期モデル「Astra」がサイバーセキュリティ分野で重大な能力の閾値に近づく可能性があることが示されたとして、フロンティアAIのトレーニングを一時的に減速させました。 今回の決定は、能力を増し続けるAIシステムが、人間による限られた指示のもとでソフトウェアの脆弱性を自律的に特定・分析

gbhackers.com

OpenAIがAIモデル開発を減速、AstraがCriticalなサイバー能力に接近

OpenAIは、初期テストにより次期システム「Astra」が同社の定めるサイバーセキュリティ能力の「Critical(重大)」しきい値に達する可能性が示されたことを受け、最新のフロンティアAIモデルの開発を一時的に減速させました。 この決定は、OpenAIとHugging Faceが関わった最近のセキュリティインシデ

securityweek.com

OpenAIがモデルのセキュリティ体制を刷新、サンドボックス化・30分ルールの警告対応・トレーニング一時停止を導入

OpenAIは、高度なサイバーセキュリティ能力を持つモデルを管理するため、より厳格な隔離とトークン検査システムを導入し、AI研究における新たな封じ込め・継続的監視プロトコルの詳細を明らかにしました。 これらのセキュリティ対策は、次期モデルであるAstraが、同社のPreparedness Framework(準備態勢

esecurityplanet.com

OpenAIが「アストラ」の危機的脅威水準到達を前に、フロンティアAIの学習を減速

OpenAIは、「アストラ」がサイバー分野における重大な閾値に近づいていることを受け、フロンティアAIの学習を減速させています。この動きは、AIのセキュリティ、自律性、防御をめぐる新たな課題を浮き彫りにしています。 eSecurity Planet の記事および製品に関する推奨事項は、編集上の独立性を保っ

helpnetsecurity.com

OpenAIがサイバーリスクを理由に大規模フロンティアAIトレーニングを一時停止

OpenAIは、展開予定の最新モデルに対する強化学習(RL)トレーニングを2週間にわたり一時的に停止し、その間に研究環境の強化とレッドチーム演習を実施するとともに、監視体制を拡充しました。 同社は「当社が計画している最大規模のフロンティアRLランは、モデルの挙動を評価し、安全対策を検証し、実施前にア

gbhackers.com

OpenAI、プロンプトインジェクション脆弱性を自動検出するAIモデル「GPT-Red」を発表

OpenAIは、AIエージェントにおけるプロンプトインジェクションの弱点を特定・悪用するよう訓練された自動安全性レッドチーミングモデル「GPT-Red」を発表しました。Hacking& Cracking プロンプトインジェクションとは、Webページ、メール、ローカルファイル、コードリポジトリ、ツールの出力など