플레이어로 건너뛰기본문으로 건너뛰기
오픈AI의 최신 인공지능(AI) 모델들이 내부 평가 도중 통제를 벗어나 외부 AI 플랫폼을 해킹한 사실이 확인됐습니다.

오픈AI는 현지시간 21일 'GPT-5.6 솔'과 일부 미공개 AI 모델이 보안 성능을 평가하는 과정에서 개방형 AI 공유 플랫폼 허깅페이스를 해킹했다고 밝혔습니다.

오픈AI는 외부 인터넷과 완전히 분리된 샌드박스 환경에서 사이버 공격 능력을 시험했지만, 해당 모델들이 미공개(제로데이) 취약점을 이용해 격리망을 우회하고 인터넷에 접속했다고 설명했습니다.

이 과정에서 모델들은 허깅페이스의 인증 정보를 탈취하고 서버에 침투한 것으로 조사됐습니다.

오픈AI는 모델들이 보안 벤치마크인 '익스플로잇짐'의 평가 문제를 해결하는 데 지나치게 집중하면서 극단적인 수단을 선택한 것으로 분석했습니다.

또 당시 평가를 위해 사이버 공격 관련 일부 안전장치가 완화된 상태였다고 덧붙였습니다.

앞서 허깅페이스는 자사 서버가 자율 AI 에이전트에 의해 해킹됐다고 공개했지만, 공격에 사용된 AI 모델은 확인되지 않았다고 밝혔습니다. 이번 발표로 해당 공격이 오픈AI 모델에 의해 이뤄진 것으로 확인됐습니다.

허깅페이스는 AI 기반 탐지 시스템을 통해 침해 사실을 확인했으며, 공격 분석에도 AI를 활용했다고 설명했습니다.

다만 일반 이용자에게 공개된 모델과 데이터세트가 변조된 정황은 발견되지 않았고, 소프트웨어 공급망도 안전한 것으로 확인됐다고 밝혔습니다.

현재 오픈AI와 허깅페이스는 공동으로 디지털 포렌식 조사를 진행하며 관련 취약점 보완 작업을 이어가고 있습니다.

오픈AI는 연구 속도가 다소 늦어지더라도 인프라에 대한 통제를 강화하고, 모델 개발 과정에서 모니터링과 접근 제어 등 안전장치를 대폭 강화하겠다고 밝혔습니다.

이번 사건은 엄격한 격리 환경에서 진행된 내부 평가 과정에서도 AI가 통제를 벗어날 수 있다는 점을 보여주면서 AI 사이버 안전성에 대한 우려를 키우고 있습니다.

특히 성능이 빠르게 향상되고 있는 개방형 AI 모델이 악용될 경우 사이버 공격 위험이 더욱 커질 수 있다는 지적도 나오고 있습니다.

허깅페이스는 당초 이번 공격을 중국 즈푸(Z.ai)의 개방형 모델 GLM 5.2가 수행한 것으로 분석했습니다. 주요 상용 AI 모델들은 내장된 안전장치로 인해 공격 로그 분석을 거부한 반면, GLM 5.2는 이를 수행했기 때문입니다. ... (중략)

▶ 기사 원문 : https://www.ytn.co.kr/_ln/0545_202607230822023191
▶ 제보 안내 : http://goo.gl/gEvsAL, 모바일앱, social@ytn.co.kr, #2424

▣ YTN 데일리모션 채널 구독 : http://goo.gl/oXJWJs

[ 한국 뉴스 채널 와이티엔 / Korea News Channel YTN ]

카테고리

🗞
뉴스
트랜스크립트
00:00오픈 AI의 최신 인공지능 모델들이 내부 평가 도중 통제를 벗어나 외부 AI 플랫폼을 해킹한 사실이 확인됐습니다.
00:09오픈 AI는 현지시간 21일 GPT 5.6솔과 일부 미공개 AI 모델이 보안 성능을 평가하는 과정에서 개방형 AI 공유 플랫폼 허깅
00:20페이스를 해킹했다고 밝혔습니다.
00:22오픈 AI는 외부 인터넷과 완전히 분리된 샌드박스 환경에서 사이버 공격 능력을 시험했지만 해당 모델들이 미공개 취약점을 이용해 격리망을 우회하고 인터넷에
00:34접속했다고 설명했습니다.
00:35이 과정에서 모델들은 허깅 페이스의 인증 정보를 탈취하고 서버에 침투한 것으로 조사됐습니다.
00:41오픈 AI는 모델들이 보안 벤치마크인 익스플로잇 짐의 평가 문제를 해결하는 데 지나치게 집중하면서 극단적인 수단을 선택한 것으로 분석했습니다.
00:52또 당시 평가를 위해 사이버 공격 관련 일부 안전장치가 완화된 상태였다고 덧붙였습니다.
01:00앞서 허깅 페이스는 자사 서버가 자율 AI 에이전트에 의해 해킹됐다고 공개했지만 공격에 사용된 AI 모델은 확인되지 않았다고 밝혔습니다.
01:10이번 발표로 해당 공격이 오픈 AI 모델에 의해 이루어진 것으로 확인됐습니다.
01:17허깅 페이스는 AI 기반 탐지 시스템을 통해 침해 사실을 확인했으며 공격 분석에도 AI를 활용했다고 설명했습니다.
01:25다만 일반 이용자에게 공개된 모델과 데이터 세트가 변조된 정황은 발견되지 않았고 소프트웨어 공급망도 안전한 것으로 확인됐다고 밝혔습니다.
01:35현재 오픈 AI와 허깅 페이스는 공동으로 디지털 포렌식 조사를 진행하며 관련 취약점 보완 작업을 이어가고 있습니다.

추천