딥시크 V4.1 플래시, API 단가 인하로 IPO 앞두고 경쟁력 강조

중국 AI 스타트업 딥시크가 5520억 개 파라미터 규모 혼합전문가(MoE) 기반 멀티모달 모델 'V4.1 플래시'를 허깅페이스에 공개했다. 인과적 인코더-디코더 구조로 프리필과 디코드 단계에서 활성화 파라미터를 제한해 연산 효율을 높였고, 압축 희소 어텐션과 FP4 기반 KV 캐싱을 적용해 메모리 부담도 줄였다. 이미지·텍스트 45조 토큰 데이터로 학습했으며 최대 100만 토큰 컨텍스트를 지원한다. 로이터에 따르면 딥시크는 상하이 과창판 상장을 위해 중신증권을 주관사로 선정하고 올해 안 IPO 절차 개시를 목표로 하고 있다.
이 글에 나온 것
이 글은 원문을 요약한 큐레이션입니다. 제목은 요약에 맞춰 새로 붙였습니다. 수치와 단위는 원문 표기를 유지했습니다. 전체 내용은 원 매체에서 읽어 주세요.원문: ZDNet Korea 「[AI는 지금] IPO 나선 딥시크, 초대형·고효율 'V4.1 플래시' 공개」
ZDNet Korea 원문 보기 ↗
