"AI 추론"
뉴스
세미파이브, 美 팹리스 AI 추론 가속기 설계 수주 — 스펙핸드오프 첫 사례
세미파이브가 미국 AI 팹리스와 차세대 AI 추론 가속기 개발 계약을 체결했다고 29일 밝혔다. 이번 계약은 세미파이브가 북미 시장에서 처음 수주한 '스펙 핸드오프' 방식 프로젝트로, 고객사가 요구 사양만 제시하면 상세 설계부터 패키징, 테스트, 양산, 소프트웨어 개발까지 전 과정을 전담한다. 프로젝트에는 저전력 D램 LPDDR6와 고속 인터페이스 PCIe Gen5가 적용돼 메모리 전력 효율과 데이터 전송 성능을 높이고, 세미파이브의 빅다이 설계 경험이 반영된다. 양사는 2027년 상반기 테이프아웃을 거쳐 2028년부터 글로벌 하이퍼스케일러와 클라우드 서비스 제공업체를 대상으로 양산에 돌입할 계획이다.
시스템반도체·팹리스유클리드, 삼성전자 시리즈A 투자 참여 — AI 추론칩 개발사에 베팅
삼성전자가 엔비디아 GPU와 다른 구조의 AI 추론용 반도체를 개발하는 네덜란드 스타트업 유클리드(Euclyd)의 시리즈A 투자에 공동 투자자로 참여했다. 유클리드는 15일(현지시간) 2억 유로 규모의 시리즈A 투자 유치를 발표했으며, 이는 회사의 첫 대규모 외부 투자 라운드다. 이번 투자는 삼성전자의 벤처투자 조직인 삼성캐털리스트펀드를 통해 이뤄졌다.

화웨이, 초대형 데이터센터 AI 추론 가속 위한 OceanStor M900 Context Memory Storage 공개
메모리(DRAM·NAND·HBM)화웨이 오션스토어 M900, SSD까지 품은 KV캐시 계층 스토리지
화웨이 데이비드 왕 부회장이 화웨이 커넥트 2026 기조연설에서 초대형 데이터센터 AI 추론용 'OceanStor M900 Context Memory Storage'를 공개했다. 이 제품은 UnifiedBus 네트워크로 온칩 메모리·DRAM·SSD를 연계해 SuperPoD에 PB급 완전 공유형 KV 캐시 공간을 제공하며, 단일 클러스터에서 최대 64PB 용량을 지원한다. CPU, 네트워크 컨트롤러, NAND 컨트롤러를 통합한 아키텍처로 NPU에서 SSD까지 원홉 연결을 구현해 액세스 지연 시간을 60마이크로초로 줄였고, 클러스터당 40TB/s의 액세스 대역폭을 제공한다. 화웨이는 이를 통해 추론 클러스터의 토큰 처리량이 2배로 늘고 첫 토큰 생성 시간이 절반으로 줄어든다고 밝혔다.

AI 추론 시대, 케이던스 LPDDR 메모리 IP 부각
반도체 업계가 모델 학습 중심의 대규모 설비투자 단계를 지나 AI 인프라를 실제로 활용하고 수익화하는 단계로 넘어가고 있다고 소개됐다. AI 추론이 컴퓨팅의 주된 워크로드로 부상하면서 데이터 이동을 처리할 새로운 메모리 솔루션이 필요하다는 점이 언급됐다. 이런 흐름을 업계에서는 '추론 슈퍼사이클'이라 부른다고 전했다. 기사는 케이던스의 LPDDR 메모리 IP 솔루션을 소개하는 외부 링크로 연결된다.
시스템반도체·팹리스로봇 AI 추론, 온보드냐 데이터센터냐 — 지연시간이 좌우
SemiAnalysis는 로봇용 AI 모델이 실시간 제어와 온보드 하드웨어 비용 제약 때문에 대형언어모델보다 훨씬 작은 규모로 설계된다고 분석했다. Physical Intelligence의 π0.7(50억 파라미터), ByteDance의 GR-3(40억 파라미터), NVIDIA의 DreamZero(140억 파라미터) 등 현재 범용 로봇 모델들은 수십억 파라미터 수준에 머물러 있다. DreamZero는 실시간 구동을 위해 로봇 외부의 GB200 GPU 2개가 필요하며, π0.7도 로봇 밖의 H100에서 구동된다. 매체는 로봇 제어를 계획-행동-서보 3개 계층으로 나누고, 수백 Hz로 동작하는 서보 계층은 네트워크 지연 때문에 로봇 내부에서 처리해야 하지만, 5Hz 수준의 계획 계층은 데이터센터로 오프로드할 여지가 있다고 설명했다.
시스템반도체·팹리스딥엑스 AI 추론 기술, 정부 녹색기술 인증 획득
초저전력 AI 반도체 기업 딥엑스는 자사의 저전력 엣지 컴퓨팅 가속용 AI 추론 기술이 정부의 녹색기술 인증을 받았다고 14일 밝혔다. 이 기술이 적용된 DX-M1·DX-H1 기반 AI 가속 모듈 4종도 녹색기술제품 확인을 받았다. 확인 대상은 소형 엣지 AI 기기용 DX-M1 기반 M.2 가속 모듈 2종(DX-M1 M.2 LPDDR5x2, DX-M1M M.2(2GB))과 고성능 AI 추론용 DX-H1 기반 PCIe 모듈 등이다.

네이버벤처스, 포지트론AI 시리즈C 투자 — AI 추론반도체 영역 확대
네이버벤처스가 미국 AI 추론 반도체 스타트업 포지트론 AI에 신규 투자했다. 네이버에 따르면 네이버벤처스는 이달 초 글로벌 투자자들과 함께 포지트론 AI의 시리즈C 투자 라운드에 참여했다. 포지트론 AI는 AI 모델의 추론 속도와 에너지 효율을 높이는 데 특화된 반도체 스타트업이다. 네이버벤처스는 앞서 트웰브랩스·일레븐랩스 등 성장 단계 스타트업에 투자하며 북미 AI 스타트업 투자를 확대해왔다.
