노타, NeurIPS 2026 채택 — 멀티모달 MoE 모델 경량화 기술

노타는 멀티모달 대규모언어모델을 위한 전문가 프루닝 기술 논문이 AI 학술대회 NeurIPS 2026 메인트랙에 채택됐다고 밝혔다. 이 기술은 혼합전문가(MoE) 모델에서 언어와 이미지 이해 능력을 함께 고려해 전문가 모듈을 제거하는 방식이다. 약 310억 파라미터 모델에서 전문가 모듈을 25% 제거했을 때 원본 성능의 98%를, 50% 제거했을 때도 91%를 유지했다. GPU 메모리 사용량은 58GB에서 31GB로 약 47% 줄어 40GB급 GPU 한 장으로도 구동이 가능해졌다. 노타는 이 기술을 자사 AI 최적화 플랫폼 넷츠프레소에 반영해 멀티모달·MoE 모델 지원을 확대할 계획이다.
이 글에 나온 것
이 글은 원문을 요약한 큐레이션입니다. 제목은 요약에 맞춰 새로 붙였습니다. 수치와 단위는 원문 표기를 유지했습니다. 전체 내용은 원 매체에서 읽어 주세요.원문: ZDNet Korea 「노타, 멀티모달 AI도 경량화…GPU 메모리 47% 절감」
ZDNet Korea 원문 보기 ↗
