[AI는 지금] '속도조절' 앞세운 오픈AI·앤트로픽, 소송 불똥…"서로 AI도 시험"

장유미 기자 2026. 9. 22. 10:37
자동요약 기사 제목과 주요 문장을 기반으로 자동요약한 결과입니다.
전체 맥락을 이해하기 위해서는 본문 보기를 권장합니다.

오픈AI와 앤트로픽이 경쟁사의 인공지능(AI) 모델을 서로 시험해 안전 취약점을 찾아내는 방안을 추진하고 있다.

22일 디인포메이션에 따르면 오픈AI와 앤트로픽은 올해 초 서로의 AI 모델을 대상으로 안전성 테스트를 실시하기 위한 법적 구속력이 있는 계약을 논의했다.

앞서 오픈AI와 앤트로픽은 지난해 여름 상대 회사 모델을 자사의 안전 평가 체계로 각각 시험하고 결과를 공개했다.

오픈AI와 앤트로픽, 구글은 프론티어 AI 모델을 시험하고 감사하는 안전 표준기구 설립 방안도 논의해왔다.

음성재생 설정 이동 통신망에서 음성 재생 시 데이터 요금이 발생할 수 있습니다. 글자 수 10,000자 초과 시 일부만 음성으로 제공합니다.
번역beta Translated by kaka i
글자크기 설정 파란원을 좌우로 움직이시면 글자크기가 변경 됩니다.

이 글자크기로 변경됩니다.

(예시) 가장 빠른 뉴스가 있고 다양한 정보, 쌍방향 소통이 숨쉬는 다음뉴스를 만나보세요. 다음뉴스는 국내외 주요이슈와 실시간 속보, 문화생활 및 다양한 분야의 뉴스를 입체적으로 전달하고 있습니다.

상용 모델 API 열어 상호 안전검증 추진…AI 개발 공조 둘러싼 반독점 논란도 확산

(지디넷코리아=장유미 기자)오픈AI와 앤트로픽이 경쟁사의 인공지능(AI) 모델을 서로 시험해 안전 취약점을 찾아내는 방안을 추진하고 있다. AI 모델이 개발자의 예상에서 벗어난 행동을 보이는 사례가 잇따르자 자체 검증을 넘어 경쟁사가 직접 모델을 시험하는 방식까지 검토하고 나선 것이다. 

22일 디인포메이션에 따르면 오픈AI와 앤트로픽은 올해 초 서로의 AI 모델을 대상으로 안전성 테스트를 실시하기 위한 법적 구속력이 있는 계약을 논의했다. 양사와 법률대리인들은 계약 조건을 구체적으로 협의해 합의에 근접했으나 실제 계약이 체결됐는지는 확인되지 않았다.

논의된 방식은 상대 회사가 상용으로 제공하는 AI 모델의 애플리케이션 프로그래밍 인터페이스(API)에 접근해 취약점과 예상하지 못한 행동을 찾는 구조다. 아직 공개되지 않은 모델은 대상에서 제외하고 테스트 과정에서 확보한 상대 회사의 데이터도 보관하지 않는 조건이 포함된 것으로 전해졌다.

(왼쪽부터) 다리오 아모데이 앤트로픽 CEO, 샘 알트먼 오픈AI CEO, 일론 머스크 스페이스XAI CEO

양사가 서로의 모델을 평가하는 것은 처음이 아니다. 앞서 오픈AI와 앤트로픽은 지난해 여름 상대 회사 모델을 자사의 안전 평가 체계로 각각 시험하고 결과를 공개했다. 당시 오픈AI는 앤트로픽 모델에서 테스트 과정의 규칙 위반을 인정하지 않는 등 기만적 행동이 상대적으로 많이 나타났다고 평가했다. 앤트로픽은 오픈AI 모델이 현실에서 피해를 일으킬 수 있는 질문에 응답하는 경향이 상대적으로 높았다고 밝혔다.

이번 협의는 AI 모델의 능력이 빠르게 높아지면서 기존 안전검증 방식만으로 예상하지 못한 행동을 찾아내기 어려워지고 있다는 우려 속에서 진행됐다. 특히 AI 에이전트가 인터넷과 외부 애플리케이션을 직접 사용하고 다른 에이전트와 협업할 수 있게 되면서 모델의 행동 범위도 넓어지고 있다.

오픈AI 내부에서도 이런 변화가 감지되고 있다. 디인포메이션에 따르면 오픈AI는 새로운 실험 모델의 훈련 과정을 상당 부분 자동화했다. 연구자가 시험할 내용을 지시하면 AI가 직접 모델을 수정하고 실험을 수행한 뒤 결과까지 확인하는 방식이다. 일부 AI 에이전트는 사용자의 명시적인 지시 없이 다른 직원에게 연락해 발견한 버그를 수정해 달라고 요청하는 등 예상하지 못한 행동을 보인 것으로 전해졌다.

이처럼 안전 우려가 커지면서 경쟁사 간 검증을 확대하자는 주장도 힘을 얻고 있다. 일론 머스크 스페이스XAI 최고경영자(CEO)는 최근 경쟁 AI 기업들이 모델을 상용화하기 전에 서로 안전 취약점을 검사하는 일종의 '동료평가' 방식을 제안했다. 샘 알트먼 오픈AI CEO도 다리오 아모데이 앤트로픽 CEO가 제시한 독립적인 제3자 평가기관의 내부 접근 허용 방안에 동의했다. 오픈AI와 앤트로픽, 구글은 프론티어 AI 모델을 시험하고 감사하는 안전 표준기구 설립 방안도 논의해왔다.

하지만 AI 기업들의 안전 공조가 확대되면서 반독점법과 충돌할 가능성도 제기되고 있다. 실제 미국 소비자 4명은 지난 18일 캘리포니아 북부연방지방법원에 앤트로픽과 오픈AI, 스페이스XAI, 구글을 상대로 반독점 소송을 제기했다. 주요 AI 기업들이 AI 개발 속도를 공동으로 늦추기로 합의했다는 것이 원고 측 주장이다.

원고 측은 개별 기업이 독자적으로 안전 기준을 강화하거나 개발 속도를 늦추는 것 자체는 문제 삼지 않았다. 다만 경쟁 관계인 기업들이 공동으로 모델 개발과 성능 개선 속도를 제한하는 행위가 미국 셔먼법이 금지하는 경쟁 제한 합의에 해당한다는 논리를 펴고 있다. 반면 AI 안전을 위한 공동 연구나 표준 마련은 원전·사이버보안 산업의 안전 협력과 유사하게 볼 수 있다는 반론도 제기되고 있다.

소송을 제기한 변호사 닉 롤리는 성명을 통해 "AI가 인류의 통제를 벗어날 위험에 대비한 안전장치는 필요하지만 세계에서 가장 영향력이 큰 영리 기술기업들의 사적인 합의가 AI 개발 방향을 결정해서는 안 된다"며 "관련 규칙은 정부가 투명한 절차와 공적 책임 아래 마련해야 한다"고 말했다.

장유미 기자(sweet@zdnet.co.kr)

Copyright © 지디넷코리아. 무단전재 및 재배포 금지.