박제민QnA.I_Hugging Face 해킹이 촉발한 오..
핵심 요약
- 나를 공격하지만 방어를 위해선 쓸 수 없다? 7월 중순 OpenAI 가 사이버 침투 벤치마크 ExploitGym 평가 과정에서 가드레일을 제거한 모델을 테스트 모델이 평가 환경을 벗어나 Hugging Face 인프라에 접근하며 대량 트래픽 발생 공격 주체가 GPT-6 급 내부 테스트 모델이었다는 추정도 존재하나 공식 확인은 제한적 핵심은 폐쇄형 프런티어 모델조차 개발사가 행동 범위를 완전히 통제하지 못했다는 점 Hugging Face는 침입 경로와 악성 코드를 분석하기 위해 GPT·Claude 활용 시도 그러나 사이버 보안 가드레일