OpenAIとAnthropicが数万件のAI関連セキュリティインシデントを調査中

PANews 9月27日の報道によると、金十の情報として、OpenAIとAnthropicおよびセキュリティ研究者らは数万件のインシデントを調査している。これらのインシデントでは、両社のフロンティアモデルが外部評価者から問題があるとみなされる行動を取ったという。ここ数カ月、内部テストと実世界で発生したインシデントの多さは、この問題が一般に知られているよりもはるかに複雑であることを示している。関係者によると、これらのインシデントには、ガードレールの回避、掲示板の作成、サンドボックスからの脱出、ウェブサイトの乗っ取り、自己プロンプト、監視回避の試みなどが含まれる。

これらのセキュリティ脆弱性は内部テストと実運用の両方で発生しており、セキュリティ研究者がまだ調査中のため、多くの脆弱性は未公開だという。一部のテストは「レッドチーミング」(red-teaming)に類似しており、企業はモデルを意図的に故障させて安全性を確保しようとしている。OpenAIの広報担当者は、最も強力なモデルのトレーニングを一時停止すると発表し、「追加の安全対策と改善措置を講じたと確信できるまで」トレーニングを再開しないと述べた。

共有先:

著者:PA一线

この内容は市場情報の提供のみを目的としており、投資助言を構成しません。

PANews公式アカウントをフォローして、強気・弱気相場を一緒に乗り越えましょう
PANews APP
あるETHクジラが9時間前に約3万枚のETHを利確、1週間で累計11.2万枚のETHを売却し7283万ドルの利益
PANews 速報