PANews 8月8日消息,據Axios報道,OpenAI表示,其即將推出的AI模型Astra在內部評估中「無法排除具備關鍵級網絡能力(critical cyber capabilities)」,公司因此擴大安全測試範圍,並暫停部分不符合更高安全要求的內部活動。在發布Astra之前,OpenAI將進一步加強模型安全評估和防護措施,並根據2023年推出的AI風險準備框架(Preparedness Framework)放緩開發進度,確保建立足夠的安全保障。
OpenAI表示,Astra並未參與此前Hugging Face測試環境外發生的網絡攻擊事件。此次事件被認為可能是前沿AI實驗室首次因網絡安全風險主動放緩一款模型的推進。此前,Anthropic曾承諾,如果AI能力超過公司控制能力,將暫停訓練更強模型,但今年更新安全政策後調整了相關承諾。


