"GPU 없이 VLA 구동"…노타, 퀄컴 NPU서 로봇 AI 3배 가속

"로봇팔 큐브 옮기기 36초→12초…추론 속도 최대 7배 향상"
멀티 NPU 런타임 최적화…피지컬 AI '실행 병목' 공략

본문 이미지 - 노타 제공
노타 제공

(서울=뉴스1) 김민석 기자 = 인공지능(AI) 모델 경량화·최적화 기업 노타가 퀄컴의 산업용 시스템온칩(SoC) 신경망처리장치(NPU)에서 비전언어행동모델(VLA)을 구동해 로봇팔 작업 속도를 3배 높였다고 발표했다.

22일 노타에 따르면 회사는 퀄컴 테크날러지스의 '퀄컴 드래곤윙 IQ-9075' 프로세서 NPU에서 로봇 AI 모델과 실행 환경을 최적화했다.

언어 명령에 따라 로봇팔이 큐브를 집어 반대편 매트로 옮기는 작업을 수행한 결과 작업 시간은 기존 36초에서 12초로 줄었다.

카메라 영상 인식부터 언어 명령 이해, 다음 행동 생성과 로봇팔 제어까지 전 과정의 AI 추론은 외부 서버가 아닌 드래곤윙 IQ-9075 기반 엣지 AI 보드에서 이뤄졌다. VLA 추론 속도는 최대 7배 빨라졌고, 실제 물체 이동 작업 속도는 3배 향상됐다.

노타에 따르면 작업 성공률은 92%를 기록했다. 원본 모델의 성공률이 93%인 점을 고려하면 정확도 손실은 1%포인트(p) 수준이다. 추론과 작업 속도를 대폭 끌어올리면서도 원본 모델에 가까운 작업 성능을 유지했다는 설명이다.

VLA는 카메라 영상과 자연어 지시를 함께 받아 로봇의 행동을 생성하는 로봇 파운데이션 모델 계열이다. 다만 대규모 비전·언어 모델을 결합한 구조여서 연산량과 메모리 사용량이 많다. 배터리와 전력, 발열, 공간 제약이 큰 로봇 내부에서 실시간으로 구동하려면 모델뿐 아니라 실행 환경 전반을 함께 손봐야 한다.

노타는 VLA 경량화부터 NPU 연산 그래프 최적화, 멀티 NPU 런타임 구축, 행동 생성 가속까지 전 과정을 최적화했다고 설명했다.

노타는 이 기술을 이달 11일 서울에서 열린 '코리아 리얼-월드 AI 네트워크 2026'(KRAIN 2026)에서 실제 로봇팔 시연으로 공개했다. KRAIN 2026은 과학기술정보통신부가 주최하고 AI네트워크얼라이언스(AINA), 피지컬AI얼라이언스 등이 참여한 행사로 피지컬 AI와 AI 네트워크 관련 실증 사례를 공유했다.

노타는 LG전자·모빌린트와 정부의 K-온디바이스 AI 반도체 기술개발 사업 휴머노이드 분야에도 참여하고 있다. 퀄컴 NPU 기반 실증과 국산 NPU 기반 휴머노이드 프로젝트를 병행해 다양한 AI 반도체와 로봇 환경에서 VLA를 구동하는 최적화 역량을 강화한다는 전략이다.

채명수 노타 대표는 "이번 성과는 노타가 쌓아온 AI 최적화 기술력이 모델의 크기나 추론 속도 개선에 그치지 않고, 실제 로봇의 반응성과 작업 성능으로 이어질 수 있음을 보여준 사례"라며 "다양한 AI 모델과 하드웨어를 아우르는 최적화 레이어를 고도화해 로봇과 휴머노이드를 비롯한 피지컬 AI 전반으로 기술 적용과 사업 영역을 확대해 나가겠다"고 말했다.

ideaed@news1.kr

대표이사/발행인 : 이영섭

|

편집인 : 채원배

|

편집국장 : 김기성

|

주소 : 서울시 종로구 종로 47 (공평동,SC빌딩17층)

|

사업자등록번호 : 101-86-62870

|

고충처리인 : 김성환

|

청소년보호정책 책임자 : 허정현

|

통신판매업신고 : 서울종로 0676호

|

등록일 : 2011. 05. 26

|

제호 : 뉴스1코리아(읽기: 뉴스원코리아)

|

대표 전화 : 02-397-7000

|

대표 이메일 : webmaster@news1.kr

Copyright ⓒ 뉴스1. All rights reserved. 무단 사용 및 재배포, AI학습 활용 금지.