스마일샤크, 생성형 AI ‘환각통제 사례’ 발표…“팩트 오류 큰폭 감소, 검수 시간 90% 절감”
전체 맥락을 이해하기 위해서는 본문 보기를 권장합니다.
스마일샤크(대표 장진환)는 AI가 생성한 결과물을 또 다른 AI 모델이 평가하고 검수하는 'LLM-as-a-Judge' 방식을 매일경제신문사 산하 디지털 조직 매경AX의 AI 팟캐스트에 적용한 결과, 월 평균 15~20건 수준으로 발생하던 사실 오류를 월 1건 이하로 줄였으며, 검수 과정에 투입되는 인력 시간도 90% 이상 단축했다고 밝혔다.
이 프로젝트는 생성형 AI 도입 시 가장 큰 걸림돌인 환각 현상(사실과 다른 정보를 생성하는 문제)을 해결하기 위해, AI 모델이 결과물을 내놓으면 별도의 평가 AI가 원문 대조 및 평가 기준에 따라 결과물의 신뢰도를 검증하는 방식으로 진행됐다.
이 글자크기로 변경됩니다.
(예시) 가장 빠른 뉴스가 있고 다양한 정보, 쌍방향 소통이 숨쉬는 다음뉴스를 만나보세요. 다음뉴스는 국내외 주요이슈와 실시간 속보, 문화생활 및 다양한 분야의 뉴스를 입체적으로 전달하고 있습니다.

최병주 스마일샤크 솔루션즈 아키텍트는 이같은 내용을 지난 20일 ‘AWS 서밋 서울 2026’ 인더스트리데이 세션에서 ‘매경AX의 환각 통제 사례’를 주제로 발표했다.
이 프로젝트는 생성형 AI 도입 시 가장 큰 걸림돌인 환각 현상(사실과 다른 정보를 생성하는 문제)을 해결하기 위해, AI 모델이 결과물을 내놓으면 별도의 평가 AI가 원문 대조 및 평가 기준에 따라 결과물의 신뢰도를 검증하는 방식으로 진행됐다.
최병주 아키텍트는 “생성형 AI 서비스는 운영 단계에서 품질 평가 체계가 반드시 필요하다”며 “모델 자체 성능뿐 아니라 오류 검증과 실패 사례 관리가 함께 이뤄져야 안정적인 서비스 운영이 가능하다”고 말했다.

한편, 올해로 12회를 맞은 ‘AWS 서밋 서울’은 AWS가 주최하는 국내 대표 AI·클라우드 행사로, 올해는 생성형 AI 기술과 산업 현장 적용 사례를 중심으로 다양한 세션이 진행됐다. 스마일샤크는 이 행사에 플래티넘 스폰서로 참가해 AI 상용화 전략과 운영 경험을 소개했다.
또한 현장 부스에서는 야구단 포지션 테스트 기반 클라우드 서비스 추천 콘텐츠와 맞춤형 굿즈 프로그램 등이 운영됐다. 스마일샤크는 행사 기간 동안 스타트업과 중소기업 관계자를 대상으로 AI 도입 상담도 병행했다.
최용석 기자 duck8@donga.com
Copyright © 동아일보. All rights reserved. 무단 전재, 재배포 및 AI학습 이용 금지
- “고지혈증 약이 근육 녹여” 의료 유튜버 믿고 약 끊는 환자들
- “삼전닉스 같은 성과급 요구하면 감당 못해” 기업들 벌써 긴장
- 이스라엘 억류됐던 2명 귀국…“구타당해 한쪽 귀 안들려”
- 장동혁, 한동훈 저격 “보수 망가뜨린 사람이 보수 재건 말이 되나”
- [단독]“내 민원 왜 종결했냐” 토씨만 바꿔 또 접수… ‘출구’ 없는 악성민원
- 젠슨 황이 짜장면 먹은 식당, ‘핫플’ 됐다…‘가죽 재킷 세트’ 출시
- 전원주, 정청래 손잡고 ‘엄지 척’…與 유세현장 깜짝 등장
- 한동훈 “YS 차남 김현철 이사장, 23일 지지 선언”
- 장동혁 “삼전에 너도나도 숟가락…전농까지 이익 나눠달라고“
- 트럼프, 친미 집권 폴란드에 “미군 5000명 더 보낼 것”