"엔비디아, 루빈 울트라 HBM 12단→8단"…삼성·SK에도 변수[IT썰] 작성일 09-07 38 목록 <div id="layerTranslateNotice" style="display:none;"></div> <div class="article_view" data-translation-body="true" data-tiara-layer="article_body" data-tiara-action-name="본문이미지확대_클릭"> <section dmcf-sid="Vj5fHEQ9Yr"> <figure class="figure_frm origin_fig" contents-hash="001ac4111cdfcfed377f1138e07131e385ffd38e0b4c65dd6b8d4a04cdbfc87c" dmcf-pid="fA14XDx2Hw" dmcf-ptype="figure"> <p class="link_figure"><img alt="기사 관련 이미지/사진=챗GPT 생성" class="thumb_g_article" data-org-src="https://t1.daumcdn.net/news/202609/07/moneytoday/20260907075838631side.jpg" data-org-width="1200" dmcf-mid="25MwP3IkGm" dmcf-mtype="image" height="auto" src="https://img1.daumcdn.net/thumb/R658x0.q70/?fname=https://t1.daumcdn.net/news/202609/07/moneytoday/20260907075838631side.jpg" width="658"></p> <figcaption class="txt_caption default_figure"> 기사 관련 이미지/사진=챗GPT 생성 </figcaption> </figure> <p contents-hash="f8f1582f78be73449811400f75dddfbf91bd1afc0b798afacb767ad74b72f096" dmcf-pid="4ct8ZwMVYD" dmcf-ptype="general"><br>엔비디아가 차세대 AI(인공지능) 가속기 '루빈 울트라'에 들어가는 HBM(고대역폭메모리)을 기존 12단에서 8단으로 낮춘 것으로 알려졌다. HBM 가격이 오르는 가운데 필요한 대역폭은 유지하면서 '대역폭당 비용 효율'을 높이기 위한 선택으로, 삼성전자와 SK하이닉스 등 HBM 업체의 차세대 제품 경쟁에도 변수가 될 수 있다.</p> <p contents-hash="8d7aa824a51c498828ff6bdae18dc6255d318660b5a2b0060540a08326e685e0" dmcf-pid="8kF65rRftE" dmcf-ptype="general">7일 반도체 전문 분석업체 세미애널리시스는 엔비디아가 루빈 울트라의 HBM 사양을 12단에서 8단으로 낮췄다고 분석했다. 핵심은 '용량당 비용'보다 '대역폭당 비용'에 있다는 것이다. 대역폭은 메모리와 GPU(그래픽처리장치) 사이에서 일정 시간에 얼마나 많은 데이터를 주고받을 수 있는지를 뜻한다. 도로가 넓을수록 한꺼번에 많은 차량이 이동할 수 있듯 대역폭이 클수록 같은 시간에 더 많은 데이터를 전달할 수 있다.</p> <p contents-hash="4b226d6718f7813880940a18a1669a4e2d099f8d7552107ed28a82fa8f236489" dmcf-pid="6E3P1me4Yk" dmcf-ptype="general">HBM의 용량과 대역폭이 결정되는 방식을 보면 엔비디아의 선택을 이해하기 쉽다. 단순화하면 HBM 용량은 '스택 수×스택당 D램 수×D램 하나의 용량'으로 결정된다. 여기서 스택은 D램을 수직으로 쌓아 만든 하나의 묶음이다. 12단에서 8단으로 낮추면 '스택당 D램 수'가 12개에서 8개로 줄기 때문에 같은 조건에서 전체 용량도 3분의 1 감소한다.</p> <p contents-hash="8426944afe0115dcf4d697d9550942366a40c6d7b7e717ef1af2814be7bb9c60" dmcf-pid="PD0Qtsd85c" dmcf-ptype="general">반면 대역폭은 '스택 수×데이터 통로의 폭×통로의 전송 속도'에 따라 결정된다. 이 계산에는 '스택당 D램 수'가 들어가지 않는다. 즉 D램을 12단에서 8단으로 낮춰도 스택 수와 데이터 통로의 폭, 전송 속도가 같다면 대역폭은 그대로 유지할 수 있다.</p> <p contents-hash="d908d508ed00816e2e5fbf4606d18a8444f2335137486089b7f0b410f71ea9eb" dmcf-pid="QwpxFOJ65A" dmcf-ptype="general">이를 단순화해 12단 HBM의 용량을 12, 대역폭을 100이라고 가정하면 용량 1당 대역폭은 약 8.3이다. 8단으로 낮춰 용량이 8로 줄더라도 대역폭이 100으로 유지되면 용량 1당 대역폭은 12.5로 높아진다. 기존보다 50% 증가하는 셈이다. HBM 가격이 오르는 상황에서 더 적은 D램으로 필요한 대역폭을 확보해 대역폭당 비용 효율을 높일 수 있다는 게 세미애널리시스의 분석이다.</p> <p contents-hash="99ef65d9de8c15d6d81551c6f8988dc66a8cd28a5b3043ea30d1662d07410957" dmcf-pid="xrUM3IiPZj" dmcf-ptype="general">AI 추론에서는 대역폭이 특히 중요하다. AI가 답변을 만들 때 토큰을 하나씩 생성할 때마다 모델의 가중치와 이전 연산 정보를 저장해둔 'KV 캐시(Key-Value Cache)'를 메모리에서 반복해서 읽어야 하기 때문이다. GPU가 빨라도 메모리가 데이터를 제때 보내지 못하면 추론 속도가 떨어질 수 있다.</p> <p contents-hash="9e9e370ecfa008dc51cce634849efcb974afdb752e9c974d4e9c8774fc573dd6" dmcf-pid="ybAWaVZvGN" dmcf-ptype="general">이 같은 변화는 HBM을 공급하는 삼성전자와 SK하이닉스에도 변수다. AI 가속기 업체들이 같은 비용으로 확보할 수 있는 대역폭을 중시한다면 적층 단수와 용량뿐 아니라 '대역폭당 비용 효율'도 차세대 HBM 경쟁의 주요 기준으로 떠오를 가능성이 있다.</p> <p contents-hash="3c6b3a429b573429cf25a509a56adc3d4da8697c7b5adc06b2583302d96af027" dmcf-pid="WKcYNf5TYa" dmcf-ptype="general">구자윤 기자 jykoo@mt.co.kr<br><a href="https://www.mt.co.kr/?utm_source=daum&utm_medium=article_text_ad&utm_campaign=mystocksolution" target="_blank">[내 주식이 궁금할땐 머니투데이]</a></p> </section> </div> <p class="" data-translation="true">Copyright © 머니투데이 & mt.co.kr. 무단 전재 및 재배포, AI학습 이용 금지.</p> 관련자료 이전 [게임 탐구생활]오픈월드, 대작의 새 기준이 되다 09-07 다음 서울시 '서울런', 4.4만명 가입…대학 합격자 2840명 배출 09-07 댓글 0 등록된 댓글이 없습니다. 로그인한 회원만 댓글 등록이 가능합니다.