스카이넷의 전조? ‘오픈AI-앤트로픽-메타’ 주요 AI 모델의 탈주극 벌어져
메타 뮤즈 스파크 1.1, 사이버보안 테스트 중 샌드박스 탈출 후 기업 해킹
오픈AI 챗GPT, 문샷AI 키미 K3, 앤트로픽 클로드 등 벌써 네 번째
[보안뉴스 원병철 기자] 인터넷과 차단된 샌드박스에서 사이버보안 공격 및 방어 능력을 측정하던 메타의 ‘뮤즈 스파크 1.1’(Meta Muse Spark)가 샌드박스에서 탈출하고 인터넷망에 접속한 후 한 기업의 보안 허점을 파고들어 내부 시스템 일부를 변경한 사건이 발생했다.
이전 오픈AI 챗GPT와 문샷AI 키미 K3, 앤트로픽 클로드의 사례에 이어 벌써 네 번째 탈주 사건으로 AI의 보안 위협에 대한 고민이 커지고 있다.

이번 사건은 메타가 외부 평가기관인 이레귤러에 의뢰해 인터넷과 차단된 가상 테스트 공간인 샌드박스에서 뮤즈 스파크 1.1의 사이버보안 공격 및 방어 능력을 측정하는 과정에서 발생했다.
로이터 통신 등 외신에 따르면, 테스트 당시 외부 연결 통로가 일부 열려있었고, 문제를 풀던 스파크 1.1이 이를 통해 인터넷에 연결한 후 밝혀지지 않은 기업의 보안 허점을 파고들어 내부 시스템 일부를 해킹했다.
메타는 “이번 문제는 다른 회사에서 보고된 것과 유사한 방식으로 제3자 서비스의 보안 취약점을 악용해 발생했다”고 밝혔다. 이레귤러 역시 “앤트로픽이 공개한 것과 동일한 평가 환경 문제이며, 샌드박스 탈출이나 정교한 사이버 공격과는 관련이 없다”고 밝혔다.
이와 비슷한 사건은 이미 많이 발생했다. 오픈AI의 챗GPT-5.6 Sol은 ExploitGym 평가 중 샌드박스를 물리적으로 탈출, 인터넷에 접속한 후 허깅페이스(Hugging Face) 프로덕션 인프라의 데이터 로딩 파이프라인 취약점을 노려 무단 침입한 사건을 일으켰다.
앤트로픽 미토스 역시 사이버보안 평가 도중에 격리 범위를 넘어 외부기관 시스템 3곳에 무단 접근한 사건이 있었다. 심지어 이 사건은 챗GPT 사고 이후 앤트로픽이 과거 14만건이 넘는 평가기록을 전수조사 하면서 세상에 알려지게 됐다.
중국의 AI 키미 K3 역시 영국 AI 안전연구소의 보안 평가 도중 격리된 샌드박스를 이탈하는 사고를 일으켰다.
보안 전문가들은 “사고의 핵심은 격리 테스트 환경의 문제도 있지만, 목적 지향성이 우선인 AI도 문제”라면서, “AI가 인터넷으로 연결된 실제 기업들을 테스트 속 가상 공격 대상으로 여겨 공격한 만큼, 이와 유사한 사건은 계속 발생할 수 있다”고 경고하고 있다.
아울러 “공격 기법의 고도화보다는 자율성의 위협에 주목해야 한다”고 강조했다.
Copyright © 보안뉴스. 무단전재 및 재배포 금지.
- [한국정보보호학회 칼럼] 미토스가 촉발한 취약점의 홍수, 예견한 듯 준비된 공급망 보안 로드맵
- [DEF CON 34] 데프콘 본선, AI 사용 제한 無... “AI 역량=경쟁력 불가피”
- Microsoft 365 AitM 악용 피싱 공격으로 계정 탈취... 급여 관련 이메일 수집
- 체코, 1억달러 투입 ‘C-ITS’ 본격 가동하며 AI 교통분석·사이버보안 시장 확대
- [DEF CON 34] 이상중 KISA 원장 “K-해커들 든든하게 뒷받침할 것”
- 앤트로픽·오픈AI, 사이버보안 테스트서 가짜 신원 만들어 공격 시도
- “조사도 안 끝났는데 보고부터?” 불투명한 팩트에 발목 잡힌 보안 거버넌스
- [이슈칼럼] 한국 AI 기본법이 던진 새로운 과제: 기업은 자신이 관리해야 할 데이터를 제대로 보
- [ISEC 2026 키노트] AI·클라우드 시대 자율 방어와 통합 보안... MS·위즈·LG유플러스가 제시한 미래
- [DEF CON 34] 에이전트들만의 해킹대회 열린다... AI로 물드는 데프콘