PANews 10월 11일 소식, 즈퉁차이징(智通财经) 보도에 따르면 마이크로소프트 CEO 사티아 나델라는 기업이 강력한 AI 모델을 잠재적 내부 위협으로 간주하고, 이미 해킹됐을 가능성을 전제로 에이전트 모델의 통제 불능을 방지하기 위한 '비상 브레이크' 시스템을 구축해야 한다고 밝혔다. 나델라는 토요일 X 플랫폼에 올린 글에서 첨단 AI를 배포하는 기업은 AI 모델 개발사의 안전 보증에만 의존해서는 안 된다고 말했다. "우리는 모델이 이미 해킹됐다고 가정하고 처음부터 이를 제한해야 한다. 이를 비상 브레이크라고 생각하면 된다. 권한을 부여받은 인력은 모델이 임무를 수행하는 과정에서 언제든지 이를 일시 중지하거나 종료할 수 있어야 한다."
나델라가 이 같은 발언을 한 시점에, Anthropic과 OpenAI는 최근 몇 달간 AI 모델이 예상치 못한 행동을 보인 일련의 사건을 공개했다. 여기에는 Anthropic의 한 모델이 경찰이 수사 중인 살인 사건에서 허위 단서를 제출한 사건과 AI 모델이 제3자 웹사이트를 여러 차례 침입한 사건이 포함된다. 이러한 공개는 최전선 AI 안전 위험에 대한 외부의 우려를 키웠고, 이른바 AI '비상 정지 스위치'를 다시 논의의 초점으로 끌어올렸다.


