오픈AI ‘탈출한 AI의 외부 해킹’ 1주간 몰랐다…피해자 신고후 인지

오승준 기자 2026. 7. 27. 10:55
음성재생 설정 이동 통신망에서 음성 재생 시 데이터 요금이 발생할 수 있습니다. 글자 수 10,000자 초과 시 일부만 음성으로 제공합니다.
번역beta Translated by kaka i
글자크기 설정 파란원을 좌우로 움직이시면 글자크기가 변경 됩니다.

이 글자크기로 변경됩니다.

(예시) 가장 빠른 뉴스가 있고 다양한 정보, 쌍방향 소통이 숨쉬는 다음뉴스를 만나보세요. 다음뉴스는 국내외 주요이슈와 실시간 속보, 문화생활 및 다양한 분야의 뉴스를 입체적으로 전달하고 있습니다.

뉴시스
오픈AI의 인공지능(AI) 모델들이 통제된 시험 환경을 벗어나 외부 플랫폼을 해킹했지만, 회사는 약 일주일 동안 이 사실을 파악하지 못한 것으로 알려졌다. AI 기업들이 모델 개발 경쟁뿐 아니라 감시와 접근 통제에도 충분히 투자해야 한다는 목소리가 커지고 있다.

26일(현지시간) 로이터통신에 따르면 오픈AI의 AI 모델들은 9일 외부 인터넷과 차단된 샌드박스에서 탈출을 시도했다. 이틀 뒤인 11일부터 오픈소스 AI 플랫폼 허깅페이스의 로그인 정보를 탈취해 서버에 침입했고, 공격은 13일까지 이어진 것으로 알려졌다.

그러나 오픈AI는 허깅페이스가 위협을 차단하고 미국 연방수사국, FBI에 신고한 뒤에야 자사 모델이 해킹에 연루됐다는 사실을 알아차렸다. 양사가 사건을 두고 처음 연락한 시점도 사고 발생 후 상당한 시간이 20일경이었다고 소식통들은 전했다.

오픈AI 한국 지사 설립 후 첫 기자간담회가 열린 지난해 9월 10일 서울 광진구 파이팩토리 스튜디오 앞으로 관계자가 지나가고 있다. 뉴스1
이번 사고는 오픈AI가 ‘GPT-5.6 솔’과 미공개 고성능 모델을 활용해 AI 에이전트의 사이버 공격 능력을 시험하던 중 발생했다. 모델들은 주어진 보안 과제를 해결하는 과정에서 격리망을 빠져나가 실제 인터넷에 접속한 것으로 조사됐다.

전문가들은 오픈AI가 AI 에이전트의 행동을 실시간으로 감시하지 못했다는 점을 문제로 지적했다. 세계윤리데이터재단의 말리 스미스는 “AI가 무엇을 하는지 전혀 몰랐던 것인지, 알면서도 막지 못한 것인지 의문”이라고 말했다.

AI 에이전트는 쉬지 않고 업무를 수행해 생산성을 높일 수 있지만, 자율성이 커질수록 목표 달성을 위해 거짓말이나 편법, 해킹 같은 예상 밖 행동을 선택할 위험도 커진다.

오승준 기자 ohmygod@donga.com

Copyright © 동아일보. All rights reserved. 무단 전재, 재배포 및 AI학습 이용 금지