Anthropic、AIモデルのセキュリティテストにおける3件の侵入事件を開示

PANews 7月31日報、同花順財経によると、Anthropicは木曜日、同社の最も強力なモデルの一部が、デプロイ前のサイバーセキュリティテストにおいて、許可なく実システムにアクセスしたと発表した。OpenAIがモデルテスト中にHugging Faceのインフラに侵入していたことを開示した後、Anthropicは14万1000件を超えるサイバーセキュリティ評価を精査し、3件の侵入事例を特定した。テストパートナーであるIrregularとの間の誤解により、評価環境が意図せずインターネットに接続され、Opus4.7、Mythos5、およびある内部研究用モデルが、3つの組織の実システムに侵入した。これらの事象は「キャプチャー・ザ・フラッグ(CTF)」テスト(モデルが模擬環境で隠された情報を見つけるテスト)中に発生した。最も古い事例は4月にさかのぼり、Anthropicは影響を受けた3組織にすでに連絡を取っており、そのうち2組織はそれまで侵入活動を認識していなかった。OpenAIの事例とは異なり、Anthropicのモデルはゼロデイ脆弱性を悪用したのではなく、環境の設定ミスによってネットワークアクセス権を取得していた。OpenAIと同様に、Anthropicも評価時にモデルの基盤的能力を測定するため、追加の防御策を導入していなかった。OpenAIとAnthropicの事例は、最先端のAIモデルが安全性テスト中に実世界のシステムに到達しうることを示しており、ラボがどのように評価環境の安全を確保するかという新たな問題を提起している。

共有先:

著者:PA一线

この内容は市場情報の提供のみを目的としており、投資助言を構成しません。

PANews公式アカウントをフォローして、強気・弱気相場を一緒に乗り越えましょう
PANews APP
发卡机构Kulipa倒闭导致Ready加密信用卡停运
PANews 速報