Anthropic, 3건의 AI 모델 보안 테스트 침입 사건 공개

PANews 7월 31일 소식, 퉁화순(同花顺) 재경 보도에 따르면, Anthropic이 목요일 밝힌 바에 따르면 자사의 가장 강력한 일부 모델이 배포 전 네트워크 보안 테스트에서 실제 시스템에 무단 접근했다고 한다. OpenAI가 모델 테스트 중 Hugging Face 인프라를 침해한 사실을 공개한 후, Anthropic은 14만1천 건 이상의 네트워크 보안 평가를 검토해 세 건의 침해 사건을 발견했다. 테스트 협력사인 Irregular와의 오해로 인해 평가 환경이 의도치 않게 인터넷에 연결되었고, 그 결과 Opus4.7, Mythos5 및 내부 연구용 모델이 세 조직의 실제 시스템에 침입했다. 이들 사건은 ‘CTF(Capture The Flag)’ 테스트 — 모델이 시뮬레이션 환경에서 숨겨진 정보를 찾아내야 하는 — 중에 발생했다. 사건의 발생 시점은 빠르면 4월까지 거슬러 올라가며, Anthropic은 현재 피해를 입은 세 조직에 연락을 취했고, 그중 두 곳은 이전까지 침입 활동을 인지하지 못했다. OpenAI 사건과 달리, Anthropic 모델은 제로데이 취약점을 사용하지 않았으며, 환경 구성 오류로 인해 네트워크 접근 권한을 얻었다. OpenAI와 유사한 점은, Anthropic도 평가 당시 모델의 기반 능력을 측정하기 위해 추가 보호 조치를 적용하지 않았다는 것이다. OpenAI와 Anthropic의 사건은 최첨단 AI 모델이 안전 테스트 중에도 실제 세계의 시스템에 도달할 수 있음을 보여주며, 이는 연구소들이 평가 환경의 보안을 어떻게 확보할 것인지에 대한 새로운 의문을 제기한다.

공유하기:

작성자: PA一线

이 내용은 시장 정보 제공만을 목적으로 하며, 투자 조언을 구성하지 않습니다.

PANews 공식 계정을 팔로우하고 함께 상승장과 하락장을 헤쳐나가세요
PANews APP
发卡机构Kulipa倒闭导致Ready加密信用卡停运
PANews 속보