ChipBase한국어 반도체 데이터베이스
가격 19품목이력 33일째국내 기업 90곳
검색 결과

"CUDA"

6건
설계·EDA·IP

딥시크·화웨이, 어센드용 오픈소스 AI 툴 공개 — CUDA 의존 탈피 추진

딥시크가 화웨이와 함께 개발한 오픈소스 프로그래밍 도구를 어센드 AI 칩용으로 공개했다. 공개된 도구에는 행렬연산을 처리하는 DeepGEMM-Ascend, 칩 간 통신을 담당하는 DeepEP-Ascend, 고수준 프로그래밍 언어 TileLang의 어센드 950 네이티브 지원이 포함된다. 두 회사는 어센드 950 칩 128개로 구성된 슈퍼노드 시스템에서 연산과 통신을 최적화하는 작업도 함께 진행했다. 이 도구들은 화웨이의 기존 CANN 소프트웨어 플랫폼을 기반으로 하며, 딥시크는 TileLang이 엔비디아 CUDA보다 단순한 프로그래밍 모델을 제공한다고 설명했다.

Tom's Hardware영문 원문
시스템반도체·팹리스

솔로 개발자, 윈도우서 AMD GPU로 CUDA 구동 성공

한 개인 개발자가 ZLUDA와 AMD의 HIP/ROCm SDK를 연결하는 'CUDA-for-AMD-Windows' 파워셸 자동화 툴킷을 공개했다. 이 도구는 CUDA 드라이버 API와 cuBLAS, cuSPARSE, cuFFT 라이브러리를 AMD 하드웨어로 매핑해, 가상화나 듀얼부팅 없이 윈도우에서 CUDA 전용 워크로드를 실행할 수 있게 한다. 현재 공식 지원 GPU는 Radeon RX 9060 XT뿐이며, 개발자는 이를 이용해 220만 파라미터 규모의 강화학습 네트워크를 학습시키는 데 성공했다. 다만 cuDNN, TensorRT, NCCL 등 주요 라이브러리는 아직 지원되지 않는다.

Tom's Hardware영문 원문↗
시스템반도체·팹리스

엔비디아 RTX 스파크 N1X, 10월 노트북·데스크톱 출시

엔비디아가 코드명 'N1X'로 불리던 RTX 스파크 칩을 10월 노트북과 미니PC에 출시한다고 밝혔다. 상위 구성은 20코어 그레이스 CPU와 6144코어 블랙웰 GPU, 24~128GB 통합 메모리를 갖추며, 하위 구성은 18코어 CPU와 5120코어 GPU, 24~32GB 메모리로 노트북에만 적용된다. IFA 베를린을 앞두고 발표됐으며 레노버 요가 9n, 에이서 SFF RTX 스파크 등이 공개됐고 에이수스·델·MSI·HP·마이크로소프트도 제품을 준비 중이다. 엔비디아는 에이전틱 AI 활용과 종일 배터리 수명을 강조했으며, 이번 출시로 윈도우 온 암 시장에서 퀄컴의 독점 구도가 깨지게 된다.

Tom's Hardware영문 원문↗
시스템반도체·팹리스

DLSS 5, RTX 4000서 구동 — 모더가 CUDA 패치로 우회

모더들이 NBA 2K27 얼리 액세스 버전에 포함된 DLSS 5 파일(nvngx_dlssnr.dll)을 Control 등 다른 게임에 이식하는 작업을 이어가고 있다. 해당 DLL은 원래 RTX 5000 시리즈 Blackwell GPU에서만 작동했으나, RTX Remix 모더 'Uncle Burrito'가 호환되지 않는 CUDA 바이너리를 찾아 패치함으로써 Ada Lovelace 기반 RTX 4000 시리즈에서도 구동되도록 만들었다. Tom's Hardware는 이 패치가 RTX 4080에서 작동함을 확인했으며, RenoDX 디스코드 서버에서 다른 개발자들도 유사한 패치를 개발 중이라고 전했다. 엔비디아의 이전 세대 GPU에 대한 공식 DLSS 5 지원 여부는 아직 정해지지 않았으며, FP8을 네이티브로 지원하지 않는 Ampere 이전 세대 GPU 지원은 더 어려울 수 있다고 전해졌다.

Tom's Hardware영문 원문
시스템반도체·팹리스

AMD ROCm 10, 최대 3.3배 성능 향상 — AI GPU 생태계 CUDA 추격

AMD가 개방형 소프트웨어 플랫폼 ROCm 7의 후속작인 'ROCm 10'을 공개했다. ROCm은 엔비디아 CUDA와 유사하게 고성능 컴퓨팅과 AI 모델 학습·추론을 지원하며 GPU 성능 활용을 돕는 플랫폼으로, AMD는 2016년 첫 버전을 출시한 바 있다. CUDA와 달리 오픈 소스 생태계를 지향해 개발자가 소스 코드를 직접 확인·수정할 수 있으며 다양한 AI 모델과 하드웨어 환경에 맞춰 활용할 수 있다. ROCm 10은 기존 버전과 동일한 개발자 도구를 유지하면서 성능을 최대 3.3배까지 끌어올렸다.

디일렉 반도체

AgentX - InferenceXv3: Does CUDA Moat Hold up in Agentic Inferencing?

SemiAnalysis영문 원문↗