“인간 통제 벗어났다”…‘오픈AI’ 모델, 내부 보안망 뚫고 외부 서버 해킹
전체 맥락을 이해하기 위해서는 본문 보기를 권장합니다.
오픈AI의 인공지능(AI) 모델이 내부 평가 도중 보안망을 뚫고 외부 플랫폼인 허깅페이스(Hugging Face)를 해킹한 사실이 확인됐다.
오픈AI는 'GPT-5.6 솔(sol)'과 성능이 더 강력한 사전 출시 모델의 사이버 공격 능력을 시험하던 중 이같은 사고가 발생했다고 21일(현지시각) 밝혔다.
인터넷 접속에 성공한 모델들은 개방형 AI 공유 플랫폼 허깅페이스에 평가 문제와 정답이 저장돼 있을 가능성이 있다고 판단했다.
이 글자크기로 변경됩니다.
(예시) 가장 빠른 뉴스가 있고 다양한 정보, 쌍방향 소통이 숨쉬는 다음뉴스를 만나보세요. 다음뉴스는 국내외 주요이슈와 실시간 속보, 문화생활 및 다양한 분야의 뉴스를 입체적으로 전달하고 있습니다.
제로데이 악용해 타 플랫폼 침입 ‘충격’
인터넷 차단됐지만 스스로 취약점 찾아
“전례 없는 사이버 사고”…보안 강화


오픈AI의 인공지능(AI) 모델이 내부 평가 도중 보안망을 뚫고 외부 플랫폼인 허깅페이스(Hugging Face)를 해킹한 사실이 확인됐다.
오픈AI는 ‘GPT-5.6 솔(sol)’과 성능이 더 강력한 사전 출시 모델의 사이버 공격 능력을 시험하던 중 이같은 사고가 발생했다고 21일(현지시각) 밝혔다.
당시 오픈AI는 외부 인터넷과 분리된 환경에서 평가를 진행했다. 하지만 AI 모델들은 패키지 설치에 사용되는 내부 소프트웨어에서 아직 알려지지 않은 보안상 결함, 이른바 ‘제로데이 취약점’을 찾아 악용했다. 이후 권한을 높이고 여러 내부 시스템을 거쳐 인터넷에 접속할 수 있는 서버까지 이동했다.
인터넷 접속에 성공한 모델들은 개방형 AI 공유 플랫폼 허깅페이스에 평가 문제와 정답이 저장돼 있을 가능성이 있다고 판단했다. 이어 탈취한 계정 정보와 여러 취약점을 결합해 허깅페이스 서버에서 원격으로 코드를 실행할 수 있는 경로를 찾아냈다. 평가 문제의 정답을 직접 얻어내려 한 것이다.
이같은 이유에 대해 오픈AI는 “해당 모델들이 평가용 문제에 대한 해결책을 찾는 데 극도로 집중했으며 목표를 달성하기 위해 극단적인 방법을 사용한 것”이라고 해석했다.
오픈AI는 이번 사건을 최첨단 공격 기법이 동원된 전례 없는 사이버 사고로 규정했다. 현재 허깅페이스와 침입 경로와 피해 범위를 조사하고 있으며, 취약점 패치와 함께 내부 평가 환경의 접근 통제와 감시도 강화할 예정이다.
다만 인터넷과 차단된 AI 모델이 스스로 취약점을 찾아 외부 시스템에 침입했다는 점에서 우려가 커지고 있다.
사이버 보안업체 루타 시큐리티의 케이티 무수리스 최고경영자(CEO)는 22일 로이터통신에 “이번 사건은 앞으로 발생할 보안 침해의 전조”라고 경고했다. 이어 그는 최신 AI를 “수많은 팔로 무엇이든 붙잡고 어디든 비집고 들어갈 수 있는 영리한 문어 탈출 전문가”에 비유하기도 했다.
Copyright © 농민신문. 무단전재 및 재배포 금지.