병원 가기 애매한데 ‘챗지피티’한테 물어볼까? 정확도 봤더니…

이해림 기자 2026. 4. 14. 22:23
자동요약 기사 제목과 주요 문장을 기반으로 자동요약한 결과입니다.
전체 맥락을 이해하기 위해서는 본문 보기를 권장합니다.

몸에 전에 없던 이상 증상이 나타난 초기, 병·의원에 곧바로 가기보다 AI 챗봇에 원인을 질문하는 사람이 더 많다.

이용자가 자신의 증상에 대한 일부 정보만 제공했을 때, AI 챗봇이 원인을 정확히 감별해내는 능력이 현저히 떨어진다는 연구 결과가 나왔다.

연구팀은 환자의 병력과 현재 아픈 양상, 각종 신체검사 결과 내용을 AI 챗봇에게 제시하고, 몸 상태에 관한 질문을 던졌을 때 정확하게 대답하지 못한 비율을 측정했다.

음성재생 설정 이동 통신망에서 음성 재생 시 데이터 요금이 발생할 수 있습니다. 글자 수 10,000자 초과 시 일부만 음성으로 제공합니다.
번역beta Translated by kaka i
글자크기 설정 파란원을 좌우로 움직이시면 글자크기가 변경 됩니다.

이 글자크기로 변경됩니다.

(예시) 가장 빠른 뉴스가 있고 다양한 정보, 쌍방향 소통이 숨쉬는 다음뉴스를 만나보세요. 다음뉴스는 국내외 주요이슈와 실시간 속보, 문화생활 및 다양한 분야의 뉴스를 입체적으로 전달하고 있습니다.

[헬스테크]
사진=게티이미지뱅크
몸에 전에 없던 이상 증상이 나타난 초기, 병·의원에 곧바로 가기보다 AI 챗봇에 원인을 질문하는 사람이 더 많다. 그러나 맹신은 위험하다.

이용자가 자신의 증상에 대한 일부 정보만 제공했을 때, AI 챗봇이 원인을 정확히 감별해내는 능력이 현저히 떨어진다는 연구 결과가 나왔다.

미국 연구팀은 의학 교과서를 바탕으로, 실제 진료 현장에서 만날 법한 환자의 사례를 재구성한 이야기 29개를 활용해 AI 챗봇의 진단 능력을 시험했다. ▲오픈에이아이의 챗지피티(ChatGPT) ▲앤트로픽의 클로드(Claude) ▲구글의 제미나이(Gemini) ▲엑스에이아이의 그록(Grok)을 비롯한 21개 챗봇이 그 대상이었다. 연구팀은 환자의 병력과 현재 아픈 양상, 각종 신체검사 결과 내용을 AI 챗봇에게 제시하고, 몸 상태에 관한 질문을 던졌을 때 정확하게 대답하지 못한 비율을 측정했다.

실험 결과, 가상 환자에 대한 정보를 일부만 제공한 상태에서는 다양한 후보 질환 중 진짜 원인을 정확하게 짚어내는 ‘감별 진단’ 실패율이 모든 AI 챗봇에서 80%를 뛰어넘었다. 정보를 온전히 제공했을 때에는 진단 실패율이 40% 미만으로 떨어졌다.

이는 AI 챗봇만으로 건강 문제의 원인을 진단하는 것이 위험할 수 있음을 보여준다. 질병 초기에는 이용자가 자신의 몸 상태에 대한 정보를 AI에게 낱낱이 보고하는 것이 불가능하기 때문이다.

논문 저자인 매스 제너럴 브리검 헬스케어 시스템 소속 연구자 아리아 라오는 “AI 챗봇들은 판단에 필요한 데이터가 완벽하게 주어졌을 때에는 훌륭한 진단을 내리지만, 정보가 불충분한 때에는 고전한다”고 말했다.

Copyright © 헬스조선. 무단전재 및 재배포 금지.