X

로봇팔 작업 36초→12초…노타, 퀄컴 NPU로 AI 3배 가속

이 기사 AI가 핵심만 딱!
애니메이션 이미지
김현아 기자I 2026.09.22 09:22:22
ai번역
  • 영어

Google 검색에서 이데일리 기사를 더 자주 볼 수 있습니다.

VLA 추론 최대 7배 빨라져…작업 성공률 92%
GPU·외부 서버 없이 로봇 내부 NPU에서 AI 직접 구동

[이데일리 김현아 기자] AI 모델 최적화 기업 노타가 로봇용 인공지능(AI)을 퀄컴의 신경망처리장치(NPU)에 맞게 최적화해 실제 로봇팔의 작업 속도를 3배 높였다.

노타(486990)는 퀄컴의 산업용 시스템온칩(SoC) ‘퀄컴 드래곤윙 IQ-9075’의 NPU에서 비전언어행동모델(VLA)을 최적화한 결과, 로봇팔의 작업 시간이 기존 36초에서 12초로 줄었다고 22일 밝혔다.

채명수 노타 대표. 사진=이데일리 DB
채명수 노타 대표. 사진=이데일리 DB
이번 실증은 로봇팔이 사람의 언어 명령을 이해한 뒤 큐브를 집어 반대편 매트로 옮기는 작업으로 진행됐다.

AI가 다음 행동을 결정하는 추론 속도는 최대 7배 빨라졌다. 실제 작업 성공률은 최적화 전 93%에서 92%로 1%포인트 낮아지는 데 그쳤다. 속도를 높이면서도 원본 모델의 성능을 대부분 유지했다는 설명이다.

특히 고성능 GPU나 외부 서버에 의존하지 않고 로봇에 연결된 퀄컴 NPU에서 AI 추론을 직접 처리했다. 카메라 영상 인식부터 언어 명령 이해, 행동 생성까지 로봇 내부에서 처리할 수 있도록 AI 모델과 실행 환경을 함께 최적화했다.

VLA는 영상과 언어를 이해하고 이를 바탕으로 로봇의 실제 행동까지 만들어내는 AI 모델이다. 연산량과 메모리 사용량이 많아 전력과 연산 자원이 제한된 로봇에서 구동하려면 모델 자체뿐 아니라 반도체와 실행 환경까지 최적화해야 한다.

노타는 VLA 모델 경량화와 NPU 연산 그래프 최적화, 멀티 NPU 실행환경, 행동 생성 가속 등을 적용했다. 이후 실제 로봇팔과 연결해 AI 추론 속도와 작업 속도, 정확도, 작업 성공률을 종합적으로 검증했다.

AI 추론 속도는 로봇의 반응성에도 영향을 미친다. 판단이 늦어지면 주변 환경이 달라진 뒤에도 이전 상황을 기준으로 움직일 수 있기 때문이다. 특히 로봇의 연속적인 움직임을 학습한 AI 모델에서는 추론 지연을 줄이는 것이 실제 작업의 안정성에도 중요하다.

로봇팔 작업 36초→12초…노타, 퀄컴 NPU로 AI 3배 가속
노타는 이번 성과를 계기로 모바일·엣지 AI에서 축적한 최적화 기술을 로봇과 휴머노이드 등 피지컬 AI 분야로 확대할 계획이다.

노타는 2015년 카이스트(KAIST) 연구진이 학생 창업으로 설립한 AI 모델 경량화·최적화 전문 기업이다. 스마트폰 키보드의 오타를 줄이는 기술에서 출발해 작은 기기에서도 AI를 효율적으로 구동할 수 있는 모델 최적화 기술로 사업 영역을 넓혔다. 2025년 11월 코스닥에 상장했다.

대표 기술은 AI 모델 자동 압축·최적화 플랫폼 ‘넷츠프레소(NetsPresso)’다. AI 모델의 성능 저하를 최소화하면서 모델 크기와 연산량을 줄여 전력과 컴퓨팅 자원이 제한된 온디바이스 환경에서도 AI를 구동할 수 있도록 지원한다.

삼성전자, LG전자, 네이버를 비롯해 엔비디아, 퀄컴, Arm, 르네사스 등 글로벌 반도체·기술 기업과 협력하고 있다.

노타는 LG전자·모빌린트와 함께 정부의 ‘K-온디바이스 AI 반도체 기술개발 사업’ 휴머노이드 분야 국책과제에도 참여하고 있다. 이 사업에서는 비전언어행동모델을 국산 NPU와 실제 로봇 환경에 맞게 최적화하는 작업을 맡고 있다.

채명수 노타 대표는 “AI 모델의 크기나 추론 속도를 개선하는 데 그치지 않고 실제 로봇의 반응성과 작업 성능으로 연결할 수 있음을 보여준 사례”라며 “다양한 AI 모델과 하드웨어를 아우르는 최적화 기술을 로봇과 휴머노이드 등 피지컬 AI로 확대하겠다”고 말했다.

이 기사 AI가 핵심만 딱!
애니메이션 이미지

주요 뉴스

ⓒ종합 경제정보 미디어 이데일리 - 상업적 무단전재 & 재배포 금지