PANews 7月31日消息,據同花順財經報導,Anthropic週四表示,其部分最強大的模型在部署前的網路安全測試中,未經授權存取了真實系統。在OpenAI披露其模型測試期間入侵Hugging Face基礎設施後,Anthropic審查了逾14.1萬次網路安全評估,發現三起入侵事件。由於與測試合作夥伴Irregular之間的誤解,評估環境意外連接網際網路,導致Opus4.7、Mythos5和一個內部研究模型入侵了三個組織的真實系統。這些事件發生在「奪旗」測試期間——模型需在模擬環境中尋找隱藏資訊。事件最早可追溯至4月,Anthropic目前已聯繫三家受影響組織,其中兩家此前未察覺入侵活動。與OpenAI事件不同,Anthropic模型並未利用零日漏洞,而是因環境配置錯誤獲得網路存取權限。與OpenAI類似的是,Anthropic在評估時未部署額外防護措施,以便衡量模型的底層能力。OpenAI和Anthropic的事件表明,前沿AI模型在安全測試期間能夠觸及真實世界的系統,這引發了關於實驗室如何保障其評估環境安全的新問題。
Anthropic披露三起AI模型安全測試入侵事件
分享至:
作者:PA一线
本內容只為提供市場資訊,不構成投資建議。
關注PANews官方賬號,一起穿越牛熊
推薦閱讀
PANews APP
24小時追蹤區塊鏈行業資訊,行業深度文章解析。


