"NPU"
기업
뉴스
AI페스타서 NPU·CXL·DPU 스타트업, GPU 공백 해결 제시
10월 6일부터 코엑스에서 열리는 AI페스타 AI반도체·AI인프라 특별관에서 국내 스타트업 5곳이 GPU 중심 AI 인프라의 한계를 보완하는 기술을 선보인다. 딥엑스와 모빌린트는 클라우드 연결 없이 기기 자체에서 연산하는 NPU 기반 엣지 AI 솔루션을, 디노티시아는 벡터 검색을 전담하는 가속기 VDPU를 전시한다. 파네시아는 국산 CXL 스위치 칩 기반 풀스택 링크 솔루션으로 메모리 확장성을 시연하고, 망고부스트는 데이터센터 내 네트워크·스토리지 가속을 위한 DPU 솔루션을 공개한다. 행사는 과학기술정보통신부 주최, 한국소프트웨어산업협회(KOSA) 주관으로 10월 6일부터 8일까지 열린다.

모빌린트, LG·두산로보틱스·대동과 로봇용 NPU 공동개발
모빌린트가 산업통상자원부의 'K-온디바이스 AI 반도체 기술개발사업'에서 LG전자, 두산로보틱스, 대동과 협력해 로봇·가전용 온디바이스 AI 반도체 개발에 나선다고 9월 28일 밝혔다. 모빌린트는 LG전자 휴머노이드, 두산로보틱스 협동로봇, 대동 무인 농작업 로봇 과제에서 AI 반도체 개발 세부 과제를 각각 주관하며, LG전자 AI홈 과제에는 공동연구개발기관으로 참여한다. 이번 사업은 개발 초기 단계부터 수요기업의 실제 제품 사양에 맞춰 반도체를 설계하고 기기에 적용·검증하는 방식으로 진행된다. 모빌린트는 자체 NPU 기술과 소프트웨어 개발 환경을 활용해 수요기업 기기에서 AI 성능과 경제성을 검증할 계획이다.

퀄컴, 리퀴드 AI와 온디바이스 에이전트 — 스냅드래곤 NPU서 맥락 처리
퀄컴이 파운데이션 모델 기업 리퀴드 AI와 손잡고 스마트폰 기기 단에서 작동하는 선제적 AI 에이전트 생태계 구축에 나섰다. 크리스티아노 아몬 퀄컴 CEO와 라민 하사니 리퀴드 AI CEO는 미국 마우이에서 열린 스냅드래곤 서밋 2026 기조연설에서 이를 발표했다. 이날 리퀴드 AI는 스냅드래곤 NPU에서 구동되는 스마트 메모리 계층 '리퀴드 컨텍스트'를 최초 공개했으며, 사용자 동의 하에 슬랙 메시지·메모·사진 등을 센싱해 맥락을 파악하고 소셜미디어 게시물 초안 작성 등을 스스로 수행한다. 리퀴드 AI는 헥사곤 NPU, 센싱 허브, CPU로 작업을 분담하는 스냅드래곤의 이기종 아키텍처를 핵심 파트너 선택 이유로 꼽았으며, 메르세데스-벤츠 차량용 지능에도 스냅드래곤 기반 에이전트가 적용되고 있다.

리벨리온 아톰맥스, SKT 상용망서 일 1400만건 처리
리벨리온은 자사 NPU '아톰맥스'를 탑재한 서버가 SK텔레콤의 통화요약, 음성합성, AI고객센터, 미끼문자 탐지 등 4개 서비스에서 하루 약 1400만건의 AI 요청을 처리하고 있다고 21일 밝혔다. 처리된 토큰은 40억개가 넘는다고 설명했다. 국산 NPU가 대규모 통신사 상용 서비스에 적용돼 실시간 트래픽을 처리한 사례라고 회사 측은 밝혔다. 리벨리온은 이번 실적을 바탕으로 금융, 통신, 공공 등으로 공급을 확대할 계획이라고 밝혔다.

화웨이 유니파이드버스, 슈퍼팟용 CPU·NPU·메모리 직결 아키텍처
화웨이는 상하이에서 열린 화웨이 커넥트 2026에서 유니파이드버스(UnifiedBus) 상호연결 아키텍처와 이를 기반으로 한 컴퓨팅 제품군을 공개했다. 10개 이상의 상호연결 프로토콜을 하나로 통합하고 CPU·NPU·메모리·SSD를 직접 연결해 클러스터 확장 시 발생하는 자원 유휴 문제를 해결하는 것을 목표로 한다. 캐비닛 내부용 링크블레이드, 캐비닛 간 연결용 링크디바이스, 클러스터 전반용 UBG 스위치 등 신제품과 함께 타이산 950·아틀라스 960 슈퍼팟, 오션스토어 M900, 싱허 UBG 스위치로 구성된 에이전틱 AI 슈퍼클러스터도 발표됐다. 화웨이는 1~8개 NPU를 지원하는 어플라이언스와 쿵펑·어센드 모듈 신제품도 함께 선보였다.

노타 로봇 VLM, 퀄컴 드래곤윙 NPU서 온디바이스 가속
노타는 퀄컴 테크놀로지스의 산업용 시스템온칩 '드래곤윙 IQ-9075' 프로세서 NPU에서 비전언어행동모델(VLM)과 로봇 실행 환경을 최적화했다고 22일 밝혔다. 이를 로봇팔에 적용한 결과 작업 시간이 36초에서 12초로 줄었고, VLM 추론 속도는 최대 7배, 물체 이동 작업 속도는 3배 향상됐다. 작업 성공률은 92%로 원본 모델의 93%와 비교해 1%포인트 낮은 수준을 유지했다. 기존에 GPU나 외부 서버에서 처리하던 로봇 AI 추론을 로봇 내부 엣지 NPU에서 직접 수행한 것이 특징이며, 해당 결과는 '코리아 리얼월드 AI 네트워크 2026'에서 공개됐다.

리벨리온 아톰맥스, SK텔레콤 AI 서비스에 GPU와 병행 가동
리벨리온은 자사 신경망처리장치(NPU) '아톰맥스'가 SK텔레콤의 '에이닷 음성 합성기능', 'AI 고객센터', '스캠 뱅가드' 등 AI 서비스에 적용되고 있다고 21일 밝혔다. 앞서 지난해 12월 '에이닷 통화요약'에 NPU를 적용한 데 이어 상용 적용 사례를 늘린 것이다. SK텔레콤은 그래픽처리장치(GPU)와 아톰맥스를 혼용해 AI 모델을 가동하며, 리벨리온 AI 인프라가 처리하는 트래픽은 하루 1400만건, 토큰 기준 40억개라고 회사 측은 설명했다.

리벨리온 NPU 탑재 확대, SK텔레콤 4개 서비스서 일 40억 토큰 처리
리벨리온은 자사 NPU가 SK텔레콤의 에이닷 통화요약 한 줄 요약, 에이닷 스트리밍 음성합성(TTS), AI 고객센터(AICC) 상담 후처리 및 검색 시스템, 스캠뱅가드 미끼문자 탐지 등 4대 상용 서비스에 확대 적용됐다고 밝혔다. 지난해 12월 에이닷 통화요약 관계추정 기능에 자체 NPU 서버 아톰맥스를 최초 상용 적용한 이후 지난 6월부터 순차적으로 적용 범위를 넓혔다. 현재 리벨리온 인프라가 처리하는 트래픽은 하루 약 1,400만 건, 토큰 기준으로는 일 40억 개를 웃돈다고 회사는 설명했다. SK텔레콤은 NPU 수십 대와 가속 카드 수백 장을 연동한 NPU 팜을 구축해 GPU와 NPU를 서비스 워크로드에 맞춰 재배치하는 방식을 도입했다.
