할라피뇨, HBM4 15.4TB/s로 블랙웰 추론 효율 도전

OpenAI가 Hot Chips 2026에서 브로드컴과 공동 개발한 AI 추론 가속기 '할라피뇨'의 아키텍처와 성능을 상세 공개했다. 이 칩은 216GB HBM4 메모리와 최대 15.4TB/s 대역폭을 갖췄으며, 700W에서 MXFP4 기준 최대 13.4페타플롭스 성능을 낸다. 64개의 코어 슬라이스가 각각 HBM 슬라이스와 짝을 이루는 NUMA 방식 구조를 채택했고, 2048개 프로세서로 구성된 전체 시스템은 27엑사플롭스 성능과 32PB/s의 총 메모리 대역폭을 지원한다. OpenAI는 프리필·드래프트·검증 3단계로 추론을 분해하는 방식이 엔비디아의 프리필·디코드 2단계 방식과 다르다고 설명했으며, 칩의 물리적 조립은 셀레스티카가 맡는다.
이 글에 나온 것
이 글은 원문을 요약한 큐레이션입니다. 제목은 요약에 맞춰 새로 붙였습니다. 수치와 단위는 원문 표기를 유지했습니다. 전체 내용은 원 매체에서 읽어 주세요.원문: Tom's Hardware 「Hot Chips 2026: OpenAI's Jalapeño AI ASIC unpacked — accelerator developed using AI achieves efficiency and throughput gains against power-hungry Blackwell」
Tom's Hardware 원문 보기 ↗
