겉으론 웃으며 대화, 속으론 딴 생각?…"AI, 속마음 따로 있다"
전체 맥락을 이해하기 위해서는 본문 보기를 권장합니다.
인공지능 챗봇 '클로드'의 개발사인 앤트로픽이 AI 모델 내부에 겉으로 드러나지 않는 별도의 사고 공간이 존재한다는 연구 결과를 발표했습니다.
앤트로픽은 6일 홈페이지를 통해 클로드 내부에 아이디어를 보관하고 조작하는 소규모 내부 작업 공간이 있음을 확인했다고 밝혔습니다.
앤트로픽은 "인간이 한 가지 일을 하면서도 다른 생각을 할 수 있는 것처럼 클로드도 출력과 무관한 개념과 계산을 J-공간에서 활성화할 수 있다"고 설명했습니다.
이 글자크기로 변경됩니다.
(예시) 가장 빠른 뉴스가 있고 다양한 정보, 쌍방향 소통이 숨쉬는 다음뉴스를 만나보세요. 다음뉴스는 국내외 주요이슈와 실시간 속보, 문화생활 및 다양한 분야의 뉴스를 입체적으로 전달하고 있습니다.
![▲앤트로픽 로고 [연합뉴스]](https://img4.daumcdn.net/thumb/R658x0.q70/?fname=https://t1.daumcdn.net/news/202607/07/kbc/20260707234604309xnni.jpg)
인공지능 챗봇 '클로드'의 개발사인 앤트로픽이 AI 모델 내부에 겉으로 드러나지 않는 별도의 사고 공간이 존재한다는 연구 결과를 발표했습니다.
앤트로픽은 6일 홈페이지를 통해 클로드 내부에 아이디어를 보관하고 조작하는 소규모 내부 작업 공간이 있음을 확인했다고 밝혔습니다.
회사는 이를 인간이 의식적으로 사고에 접근하는 방식과 유사성을 보인다고 설명했습니다.
앤트로픽은 클로드가 사용자에게 공개하는 답변 생성 과정과는 별개로 현재 수행 중인 과제와 직접 관련이 없는 전략을 계획하는 독립적인 내부 영역을 활용한다고 소개했습니다.
앤트로픽은 이 공간을 탐지하는 데 사용한 수학 기법의 이름을 따 'J-공간'이라고 명명했습니다.
앤트로픽은 "인간이 한 가지 일을 하면서도 다른 생각을 할 수 있는 것처럼 클로드도 출력과 무관한 개념과 계산을 J-공간에서 활성화할 수 있다"고 설명했습니다.
연구진은 실험 과정에서 클로드에게 특정 문장을 그대로 베끼면서 동시에 미국 샌프란시스코의 금문교를 떠올리라고 지시했습니다.
클로드는 겉으로는 문장을 복사하는 작업만 수행했지만 내부의 J-공간에서는 다리와 캘리포니아 같은 개념이 동시에 활성화되는 모습이 관찰됐습니다.
특히 코드를 은밀히 훼손하도록 악의적으로 학습시킨 모델의 경우 겉으로는 평범한 코딩 응답을 생성하면서도 J-공간 내부에서는 가짜나 사기 등의 개념이 응답 초기부터 활성화되는 현상이 확인됐습니다.
다만 앤트로픽은 이번 연구 결과가 클로드가 실제로 의식이나 주관적 경험을 갖고 있다는 사실을 입증하는 것은 아니라고 선을 그었습니다.
Copyright © kbc광주방송. 무단전재 및 재배포 금지.
- 광주FC, 유소년 선수에 억대 금품 요구 의혹..."직원 개인 일탈"
- 반도체 품은 군 공항..."공군 조기 이전이 첫 단추"
- 민형배 시장 "반도체 산단, 전라도의 영혼을 흔들어 깨우는 위대한 결정"[와이드이슈]
- 내일부터 이틀간 최대 200mm 장맛비…충남·전북 시간당 50mm '물폭탄'
- 광주일고 "'5·18조롱 논란' 배재고 선처해달라...주홍글씨 원치 않아"
- 신안서 세계섬학술대회...섬의 지속가능한 미래 논의
- 폭염이 목숨 위협..."체감온도 38도 넘으면 사망위험 1.16배↑"
- 1980년대 '시의 시대'를 해남에서 만난다 '땅끝순례문학관 특별기획전'
- "올여름 물놀이는 과학이다!"...국립광주과학관 '물과학체험장' 사전예약 하세요
- 무안군 공연과 체험이 함께하는 한여름 문화 놀이터 마련