[AI시승기] 콘크리트 유토피아 이병헌을 AI로 대체한다면?
주민투표·퇴거·수색·배급까지 재실행
박보영 반대해도 AI가 고를 가치 필요
마지막엔 AI 자신도 ‘외부인’ 판정 대상

인공지능(AI)에게 "인류를 보호하라"는 목표를 준 영화들은 왜 자꾸 인간을 통제하거나 제거하는 결론으로 향할까. 인간을 전쟁과 범죄에서 지키라는 명령은 인간의 자유를 빼앗는 통제로 이어지고, 생존을 극대화하라는 목표는 위험한 인간을 제거하는 계산으로 미끄러진다.
이는 AI가 갑자기 악의를 품어서가 아니다. 목표함수에 '누구를 보호할 것인지', '무엇까지 허용할 것인지', '서로 충돌하는 인간의 가치를 어떻게 처리할 것인지'가 빠져 있기 때문이다. '인류 보호'라는 한 줄은 완벽해 보이지만 현실에 넣는 순간 수많은 선택으로 갈라진다. AI는 그 빈칸을 실행 과정에서 메워야 한다.
영화 <콘크리트 유토피아>는 이 오래된 AI 재앙 서사를 뒤집어 볼 수 있는 영화다. 대지진 뒤 살아남은 황궁아파트에서 인간들은 이미 보호 대상을 정한다. '우리'는 주민이고, 목표는 공동체의 생존이며, 외부인은 경계 밖에 놓인다.
이병헌이 연기한 영탁만 AI로 바꾸면 흥미로운 일이 생긴다. 영탁 자리에 인공지능(AI)을 넣어 봤다. 박서준이 연기한 민성도, 박보영의 명화도, 김선영의 금애도 그대로다. 혜원과 도균, 황궁아파트 주민들, 대지진으로 폐허가 된 서울도 건드리지 않았다. 영화를 처음부터 다시 돌렸다. 결과는 100% 같았다. 적어도 황궁아파트의 질서가 붕괴하기 직전까지 극을 움직이는 핵심 선택은 인간 영탁의 자리에 AI를 넣어도 그대로 재현됐다.
대지진 이후 서울에서 황궁아파트만 살아남는다. 갈 곳을 잃은 생존자들이 몰려들면서 주민과 외부인의 갈등이 커진다. 주민들은 자신들을 이끌 대표가 필요하다고 판단하고 위기 상황에서 행동력을 보여준 AI 영탁을 임시 주민대표로 세운다. 주민들은 AI 영탁에게 무엇이 옳고 그른지 처음부터 결정해달라고 하지 않는다. 가장 중요한 판단은 인간들이 직접 한다. 외부인을 받아들일 것인가. 주민투표가 열리고 외부인을 내보내자는 쪽이 승리한다.
AI 영탁이 처음 받은 입력은 이미 완성돼 있었다. 보호 대상은 황궁아파트 주민, 주민들의 결정은 외부인 퇴거, 목표는 황궁아파트 공동체의 생존이다. AI 영탁은 이를 집행한다. 외부인을 내보낸다. 영화와 같다. 외부인들이 반발하면서 충돌이 벌어지고 황궁아파트 주민들도 싸움에 가세한다. 민성은 점차 영탁의 질서 안으로 들어오고 명화는 불안한 얼굴로 이를 바라본다.

주민만 다 살리라 했더니
수색·배급·색출 따라왔다
AI는 새 목적 만들지 않아
외부인을 내보냈다고 생존 문제가 끝나지 않는다. 아파트 안에는 사람이 남았지만 식량이 부족하다. 밖으로 나가 물자를 가져와야 한다. 수색대가 만들어진다. 위험을 감수하고 밖에서 물자를 확보하는 사람과 내부에 머무는 사람의 기여가 달라진다. 배급 기준이 생긴다. 외부인을 몰래 숨겨주는 주민이 나타나자 색출이 시작되고 규칙을 어긴 주민에게는 제재가 가해진다.
주민 생존이라는 하나의 목표에서 외부인 퇴거와 방범대 조직, 외부 수색, 물자 확보, 차등 배급, 외부인 색출, 규칙 위반자 제재가 차례로 따라온다. AI가 권력을 원해서가 아니다. 황궁아파트 주민들이 정한 목적을 현실에서 계속 실행하려면 다음 수단이 필요했을 뿐이다. 인간 영탁을 AI로 바꿨는데도 영화가 계속 같은 방향으로 굴러가는 이유다.
여기서 명화가 다른 값을 내놓는다. 밖에 있는 사람도 사람이고 다친 사람을 살려야 하며 함께 살아남아야 한다. AI 영탁에게 문제가 생긴다. 금애도 인간이고 민성도 인간이며 명화와 도균도 인간이다. 주민투표에 참여한 사람들도 인간이다. 그런데 이들이 요구하는 값은 같지 않다.
'인간의 가치에 정렬하라'는 명령만으로는 이제 아무것도 결정할 수 없다. 어떤 인간의 가치인가. 주민 다수의 결정인가, 외부인을 살리려는 명화의 판단인가, 가족을 지키려는 민성의 판단인가. 주민 공동체의 생존인가, 경계 밖 사람까지 포함한 생존인가. AI가 인간의 가치를 이해하면 문제가 끝난다는 설명이 황궁아파트에서 깨진다. 이해해야 할 인간의 가치가 하나가 아니기 때문이다.
인간의 가치부터 여러개
주민·가족·외부인 충돌
정렬 끝엔 '누구의 가치'?
영화는 한 번 더 꼬인다. 외부에서 살아 돌아온 혜원이 황궁아파트 주민들이 보지 못했던 정보를 가져온다. 명화는 혜원과 함께 영탁의 정체를 파고들고 결국 진짜 영탁의 시신이 발견된다. 이병헌이 연기한 영탁은 영탁이 아니었다. 주민들이 외부인을 몰아내며 세운 공동체의 대표 자신도 사실 외부인이었다.
AI 버전에서는 이 장면이 하나의 마지막 계산이 된다. 황궁아파트가 지금까지 적용해온 규칙은 주민과 외부인을 나누는 것이었다. 새로운 정보에 따라 영탁 자신이 외부인으로 분류된다. 인간 영탁에게는 여기서 모순이 발생한다. 자신이 외부인을 몰아내며 지켜온 경계선이 자기 몸을 통과한다.

영탁만 AI로 바꿔보니 <콘크리트 유토피아>의 질문도 달라졌다. 황궁아파트에는 처음부터 '인간의 가치'라는 단수가 존재하지 않았다. 금애가 지키려는 인간이 있었고 민성이 지키려는 인간이 있었다. 명화가 바라보는 인간이 있었고 도균이 거부하는 질서가 있었다. 아파트 안의 인간과 문밖의 인간도 있었다. 모두 인간의 가치라면 AI는 그 가운데 어떤 값을 실행할지 결정해야 한다. 그 기준까지 AI가 스스로 만들게 하지 않는 이상 누군가는 다시 기준을 입력해야 한다.
결국 선의로 포장된 목표함수가 오히려 가장 위험할 수 있다. '인류를 보호하라', '주민을 살려라', '공동체를 지켜라' 같은 문장은 누구도 쉽게 반대하기 어렵다. 문제는 AI가 그 문장에 담긴 도덕적 직관과 금기를 인간처럼 이해하지 못한다는 데 있다. 황궁아파트에서 재앙을 만든 것은 악의가 아니라 너무 선명한 목표였다.
AI 가치정렬의 문제는 기계가 인간의 말을 얼마나 정확하게 알아듣느냐에서 끝나지 않는다. 누구의 말을 들을 것인지, 목적함수에 누구를 넣을 것인지, 서로 다른 인간의 가치가 충돌할 때 무엇을 먼저 지킬 것인지가 남는다. <콘크리트 유토피아>에서 이병헌을 AI로 바꿔도 결과가 100% 같았던 이유는 AI가 인간처럼 변했기 때문이 아니다. AI가 계산하기 전에 인간들이 사실상 '결론'을 정해놨기 때문이다.
☞ 목표함수·정렬(Alignment) = 목표함수는 AI가 어떤 결과를 더 좋은 상태로 판단할지 수치나 규칙으로 정한 기준이다. 정렬은 AI의 행동이 인간이 원하는 목표와 가치에서 벗어나지 않도록 만드는 과정이다. 문제는 '인간을 보호하라'처럼 넓은 목표만 주어졌을 때 보호 대상과 허용 수단, 가치 충돌의 우선순위가 비어 있을 수 있다는 점이다.
☞ 목적함수 최적화·사양 오류(Misspecification) = AI는 주어진 목표를 가능한 한 잘 달성하는 방향으로 행동을 선택한다. 이때 목표 자체가 현실의 의도를 충분히 담지 못하면 목표를 정확하게 최적화하고도 원치 않는 결과가 나올 수 있다. 영화 속 황궁아파트처럼 '주민 공동체의 생존'을 목표로 두면 외부인 퇴거와 물자 배급, 규칙 위반자 제재가 같은 목표에서 연쇄적으로 도출될 수 있다.
여성경제신문 이상헌 기자
liberty@seoulmedia.co.kr
*여성경제신문 기사는 기자 또는 외부 필자가 작성 후 AI를 이용해 교정·교열하고 문장을 다듬었음을 밝힙니다. 기사에 포함된 이미지 중 AI로 생성한 이미지는 사진 캡션에 밝혀두었습니다.