한국 스타트업 AI, 글로벌 빅테크 제치고 ‘세계 5관왕’…수학 올림피아드 문제 만점
전체 맥락을 이해하기 위해서는 본문 보기를 권장합니다.
인공지능(AI) 딥테크 기업 비드래프트(대표 김민식)가 개발한 추론 모델 'Darwin-180B-RSI'가 글로벌 AI 플랫폼 허깅페이스(Hugging Face)의 5개 공인 벤치마크 리더보드에서 모두 정상에 올랐다. 비드래프트는 28일 이 같은 성과를 밝히며, 해당 모델 전반을 오픈 소스로 공개해 누구나 검증할 수 있도록 조치했다고 발표했다.
이 글자크기로 변경됩니다.
(예시) 가장 빠른 뉴스가 있고 다양한 정보, 쌍방향 소통이 숨쉬는 다음뉴스를 만나보세요. 다음뉴스는 국내외 주요이슈와 실시간 속보, 문화생활 및 다양한 분야의 뉴스를 입체적으로 전달하고 있습니다.
허깅페이스 공인 리더보드 5곳 1위
스스로 배우는 AI로 글로벌 정상

이번 평가 결과는 기업이 임의로 제시한 지표가 아닌 허깅페이스의 공식 심사를 거친 주요 부문에서 이뤄졌다는 점에서 의미를 갖는다. 특히 고난도 수학 올림피아드 관문인 ‘AIME 2026’과 ‘HMMT 2026’에서 100% 만점을 획득했다. 40여 개 글로벌 모델이 경쟁한 해당 부문에서 종전 최고 기록은 각각 97.1%, 92.7% 수준이었으나, 허깅페이스 공식 수학 리더보드에서 만점이 나온 것은 이번이 처음이다.
박사급 전문가 수준의 과학 추론 능력을 측정하는 ‘GPQA Diamond’ 부문에서도 94.44%의 높은 정답률을 기록하며 종전 1위였던 ‘Kimi-K3(93.5%)’를 제쳤다. 비드래프트는 이전 모델인 ‘Darwin-397B-ZTC’ 역시 해당 지표 3위에 올리며 최상위권을 동시에 점유했다. 아울러 다방면 전문 지식을 평가하는 ‘MMLU-Pro(88.12%)’와 다중모달 시험인 ‘MMMU-Pro(79.48%)’에서도 1위를 차지했다.
이번에 석권한 5개 분야는 박사 수준의 과학 논제, 14개 전문 영역의 10지선다 문항, 도표·영상 해석 능력이 필요한 대학교재 수준 평가, 그리고 올림피아드 대표급 수학 문제 등 AI 분야에서 가장 높은 난도로 꼽히는 검증 단계들이다.

인공지능 맞춤형 제작(AI 파운드리)을 지향하는 비드래프트는 경량화 모델 ‘POCKET-35B’의 흥행에 힘입어 전체 누적 다운로드 250만 건을 넘어서는 등 생태계 저변을 넓히고 있다. 현재 네이버클라우드 컨소시엄에 참여해 보안 특화 AI 파운데이션 모델 구축 국책 과제도 수행 중이다.
김민식 비드래프트 대표는 스스로 학습하고 신뢰도를 측정하는 AI 기술로 세계적 수준을 증명했다며, 인간의 추가적인 개입 없이 스스로 진화하는 인공지능을 구현해 나가겠다고 전했다.
김상준 기자 ksj@donga.com
Copyright © 동아일보. All rights reserved. 무단 전재, 재배포 및 AI학습 이용 금지
- [단독]서울집 ‘현금부자’들이 샀다…자기자금 비율 66%로 급등
- ‘암살자(들)’ 논란 확산…장동혁 “표현의 자유는 좌파 전유물이냐”
- 강신철 “北지뢰 확인되면 상응 조치…은폐 분명히 없다”
- [단독]한푼도 못 버는 ‘깡통 법인’ 작년 16만개…파산·폐업도 역대 최다
- “날 죽이지 마” 절규 여성 납치 하마스 테러범, 3년만에 사살됐다[청계천 옆 사진관]
- BTS ‘스윔’, 美 VMA 올해의 노래…리사는 亞 솔로 최초 ‘베스트 팝’
- 통화자제 요청에 “버스나 몰아, 얻다대고…” 기사에 막말-차에 침뱉은 중년여성
- ‘카드빚 돌려막기’ 1조6569억원…8개월새 23.4% 급증
- 내년 하반기 도입되는 ‘생산적 금융 ISA’로 한국 증시 장기 투자 활성화
- 이기인 “천하람 순천 출마, 10월내 결론…정량평가도 할 것”