
정부의 국가 대표 인공지능(AI) 프로젝트에 참여한 노타(Nota AI)의 핵심 경쟁력은 고성능 AI 모델의 ‘그래픽처리장치(GPU) 연산 부담 축소'와 '하드웨어 최적화'다.
노타는 정부의 독자 인공지능(AI) 파운데이션 모델 개발 사업(독파모)의 업스테이지 컨소시엄과 전 국민 대상 실생활 AI 서비스 구축 사업인 '모두의 AI' SK텔레콤(SKT) 컨소시엄에 모두 포함됐다. 사업 주관사와 성격은 서로 다르지만 업스테이지와 SKT는 AI 모델 개발부터 실질적 서비스 운영까지 관통하는 노타의 최적화 기술을 선택했다.
AI 산업의 패러다임이 고성능 모델 개발에서 실제 서비스 운영으로 급격히 이동하면서 고가의 GPU 자원 소모를 줄이고 구동 효율을 극대화하는 최적화 기술은 선택이 아닌 필수 요소로 자리 잡았다.
반도체 공룡도 사들이는 최적화
최적화는 모델 내부의 수열 배열을 변경해 가볍게 만드는 '양자화'와 불필요한 연산 모듈을 쳐내는 '가지치기' 등 고도의 기술이 집약된 영역이다.
노타는 독파모 사업에서 업스테이지의 '솔라 오픈2' 모델에 최적화를 적용했다. 엔비디아 H100 GPU 필요량을 8장에서 2장으로 줄이며 메모리를 76.5% 감축했다. 모델 크기를 대폭 줄이면서도 구동 속도는 1.49배 향상시키는 성과를 거뒀다. 다양한 그래픽 카드의 가격 대비 성능 등을 비교·분석해 주는 웹사이트 GPUPoet 등에 따르면 이는 서버당 최소 2억8000만원 상당의 인프라 절감 효과를 내는 것으로 나타났다. 비싼 GPU 장벽을 낮춰 누구나 AI를 쓸 수 있도록 허들을 허문 셈이다.
최적화 기술 범위는 20여가지가 넘을 정도로 넓어 엔비디아 등 글로벌 반도체 기업조차 1~2개 기술을 가진 스타트업을 연쇄적으로 인수하며 최적화 역량 확보에 사활을 걸고 있다. 엔비디아가 최근 옴니ML·데시AI·런에이아이 등 경량화·최적화 전문 스타트업을 연달아 인수한 것도 같은 맥락이다.

이러한 시장 흐름 속에서 노타의 차별점은 10년에 달하는 업력과 하드웨어 다변화 적용력에 있다. 단일 기술이나 특정 칩셋에 국한된 해외 기업과 달리 엔비디아 GPU는 물론 신경망처리장치(NPU)·중앙처리장치(CPU)·모바일·로봇 등 다양한 하드웨어 환경에 AI 모델을 맞춤 이식하는 기술 체계를 갖췄다는 것이 회사의 설명이다.
노타의 하드웨어 다변화 성과는 산업 현장 곳곳에서 입증됐다. 서버용 GPU 사용량을 줄인 것은 물론 퀄컴의 최신 엣지 AI 디바이스(드래곤윙 IQ-9075) 환경에서 비전언어행동(VLA) 모델을 안정 구동시키며 모바일·엣지 최적화 역량을 증명했다.
나아가 전력과 메모리가 극도로 제한된 로봇 분야에서는 AMD의 '로보틱스 파트너 네트워크'에 합류해 로봇 전용 프로세서 맞춤형 최적화를 담당하고 있다.
'넷츠프레소'로 AI 운영 패러다임 선도
노타 기술력의 집약체는 자체 최적화 플랫폼 '넷츠프레소'다. 넷츠프레소는 AI 모델과 타깃 하드웨어를 지정하면 가용 자원을 스스로 분석해 최적의 상태로 자동 변환하는 원스톱 플랫폼 서비스를 제공한다. 특정 반도체 제조사에 종속되지 않고 모든 AI를 모든 하드웨어에 자유롭게 이식하는 기술적 기반이다.

노타는 플랫폼을 넘어 온디바이스 및 엣지 환경에서 스마트 영상관제를 구현하는 '노타 비전 솔루션' 등 구체적인 상용 솔루션 사업으로도 영역을 확대하고 있다. 고성능 서버가 없는 현장에서도 영상 AI 솔루션을 제약 없이 구동시켜 실제 산업장의 운영 효율을 극대화하는 전략이다.
기업간거래(B2B) AX(AI전환) 시장에서도 성과가 가시화되고 있다. 노타는 최근 AI 고객센터(AICC) 전문 기업 메타엠과 최적화 솔루션 공급 계약을 체결하며 기업의 인프라 운영비 절감에 나섰다.
노타 관계자는 "AI의 진짜 가치는 뛰어난 성능을 넘어 대규모 환경에서 얼마나 효율적으로 구동되느냐는 운영 역량에서 완성된다"며 "10년간 축적해 온 최적화 기술력을 바탕으로 온디바이스부터 글로벌 데이터센터까지 AI 밸류체인 전반을 관통하는 필수 솔루션으로 입지를 더욱 강화하겠다"고 말했다.
정채윤 기자
Copyright © 블로터