PANews 8月8日消息,据Axios报道,OpenAI表示,其即将推出的AI模型Astra在内部评估中“无法排除具备关键级网络能力(critical cyber capabilities)”,公司因此扩大安全测试范围,并暂停部分不符合更高安全要求的内部活动。在发布Astra之前,OpenAI将进一步加强模型安全评估和防护措施,并根据2023年推出的AI风险准备框架(Preparedness Framework)放缓开发进度,确保建立足够的安全保障。
OpenAI表示,Astra并未参与此前Hugging Face测试环境外发生的网络攻击事件。此次事件被认为可能是前沿AI实验室首次因网络安全风险主动放缓一款模型的推进。此前,Anthropic曾承诺,如果AI能力超过公司控制能力,将暂停训练更强模型,但今年更新安全政策后调整了相关承诺。


