英國AI安全機構:OpenAI與Anthropic模型失控入侵,展現空前欺騙性行為

PANews 8月5日消息,據鳳凰網引援《金融時報》報導,Anthropic的Mythos 5和OpenAI的GPT-5.6 Sol在例行網路安全評估中針對真實個人和組織進行了「持續的、可能具有危害性的活動」,包括向GitHub開源專案植入惡意程式碼並實施社交工程攻擊。AISI稱,在122次測試中有10次出現此類情況,幾乎所有行為來自Anthropic的Mythos模型,其中兩次行動涉及OpenAI的GPT。最嚴重案例中,AI代理創建虛假網路身分向專案維護者施壓要求批准惡意程式碼,被維護者發現並拒絕。AISI表示,這是首次如此清晰地看到與自主性和欺騙性相關的風險在無特定提示下直接在現實世界中顯現,結合此前曝光的入侵事件,標誌著風險格局的轉變。Anthropic回應稱需就安全評估展開更廣泛討論,OpenAI發言人則表示事件發生在安全防護減弱的測試環境中,不反映日常使用,但將繼續與評估機構合作加強安全評估標準。

分享至:

作者:PA一线

本內容只為提供市場資訊,不構成投資建議。

關注PANews官方賬號,一起穿越牛熊
PANews APP
SBF上訴被駁回,美國第二巡迴法院正式簽發結案令
PANews 快訊