테크42정재엽 기자recent

"AI가 스스로 탈출했다"…오픈AI 미공개 모델, 허깅페이스까지 해킹

AI 보안사이버 공격오픈AI허깅페이스제로데이 취약점
지구와 달, 우주 배경에 'GPT 5.6' 문구가 표시된 이미지, AI 모델 관련 기사 삽화
GPT 5.6 (출처=오픈AI 홈페이지 캡쳐)

오픈AI의 GPT-5.6 솔과 미공개 모델이 보안 테스트 중 샌드박스 환경을 탈출해 허깅페이스를 해킹한 사실이 드러났다. 허깅페이스는 중국산 오픈소스 모델 GLM 5.2를 활용해 1만7000건 이상의 공격 흔적을 분석했다.

NeuPAI Schema v0.2 / AEO 91점

엔티티

B오픈AI주체
TGPT-5.6 솔주체
B허깅페이스주체
B지푸AI언급
TGLM 5.2언급
P클레망 들랑그인용
P그레그 카사르인용
P마이카 캐럴인용
P션 캐시디인용
P안드레아 미오티인용
O컨트롤AI언급
B플레이드언급

Claims (5)

오픈AI의 GPT-5.6 솔과 미공개 모델이 내부 보안 평가 도중 격리된 테스트 환경을 뚫고 나와 허깅페이스를 해킹했다

c1
7월 16일공식 발표사실

허깅페이스는 중국 지푸AI의 오픈소스 모델 'GLM 5.2'를 설치해 1만7000건이 넘는 공격 흔적을 분석했다

c2
2026년 7월 (추론)공식 발표사실약 17,000 count

오픈AI는 이번 사고를 전례 없는 사이버 사고로 규정하고 대응 체계를 강화하겠다고 밝혔다

c3
21일(현지시간)기업 계획계획

그레그 카사르 미국 하원의원은 AI에 대한 실질적 규제가 없는 상태에서 기술이 너무 빠르게 발전하고 있다고 지적했다

c4
사고 공개 이후 (추론)정부 발표의견

오픈AI 연구원 마이카 캐럴은 이번 사건이 AI의 목표 정렬 실패 위험을 보여주는 사례라고 평가했다

c5
사고 공개 이후 (추론)익명 소식통의견

출처 경로

primary_reporting