메모리, AI 칩 비용의 63% 차지: HBM 지출 320억 달러 돌파

Epoch AI의 최신 분석에 따르면 고대역폭 메모리(HBM)가 이제 AI 칩 구성 요소 비용의 거의 3분의 2를 차지합니다. 2024년 1분기부터 2025년 4분기까지 엔비디아, AMD, 구글, 아마존이 설계한 칩에서 HBM의 비중은 생산량 기준으로 52%에서 63%로 증가했습니다. AI 칩에 대한 총 구성 요소 지출은 2024년 220억 달러에서 2025년 520억 달러로 증가했으며, 이 중 HBM만 200억 달러 증가에 기여했습니다.
주요 수치
- 메모리(HBM): 52% → 63% 비중. 절대 지출은 2024년 약 120억 달러에서 2025년 320억 달러로 증가.
- 로직 다이: 약 13~14% 비중으로 거의 변화 없음.
- 고급 패키징(CoWoS): 19%에서 15%로 하락.
- 보조 구성 요소: 15%에서 9%로 하락.
중요한 이유
이제 메모리가 AI 가속기의 주요 비용 요인입니다. Epoch은 재무 공시, 공급업체 신고, 애널리스트 보고서를 통해 HBM 스택(HBM3, HBM3e), 고급 노드 로직 다이(3~5nm), TSMC CoWoS 패키징, 보조 구성 요소(기판, 전원 공급)의 네 가지 범주로 칩당 비용을 모델링합니다. 이러한 변화는 메모리 공급 부족과 HBM 가격 상승에 기인합니다. 하이퍼스케일러들은 이미 이를 자본 지출 가이던스에 반영하고 있습니다. 마이크로소프트의 2026 회계연도 1,900억 달러 자본 지출 전망에는 구성 요소 가격 상승으로 인한 약 250억 달러가 포함되어 있으며, 메타는 같은 요인을 이유로 2026년 자본 지출 범위를 100억 달러 상향 조정했습니다.
불확실성 범위
Epoch은 90% 신뢰 구간과 두 가지 경계 지표를 제공합니다.
- 메모리 비용만 고려한 범위: 2025년 4분기 60~67%.
- 모든 구성 요소가 극단값일 때 범위: 2025년 4분기 54~73%.
이 추세는 2026년에도 HBM 공급이 제한되면서 메모리의 비중이 더욱 증가할 것임을 시사합니다.
📖 전체 출처 읽기: HN AI Agents
👀 See Also

Claude Code v2.1.153 출시: Skip LFS, MCP 수정 및 에이전트 자동완성 포함
Claude Code v2.1.153은 Git LFS 회피를 위한 skipLfs 옵션을 추가하고, MCP 서버 재연결 루프를 수정하며, 슬래시 명령어 및 번들 스킬에 대한 에이전트 디스패치 자동 완성을 개선합니다.
Claude Agent SDK, 6월 15일부터 프로그래밍 방식 사용 전용 월간 크레딧 제공
6월 15일부터 유료 Claude 요금제는 프로그래매틱 사용(Agent SDK, claude-p, Claude Code GitHub Actions, 서드파티 도구)을 위한 별도의 월별 크레딧을 받습니다. Pro는 $20, Max 5x는 $100 등입니다. 크레딧이 소진되면 사용이 일시 중지되며 추가 사용 크레딧이 꺼져 있습니다.

레딧 사용자가 개발자들에게 AI 에이전트를 활용한 모델 아키텍처로 클린 코딩에서 전환해야 한다고 주장합니다
레딧 게시글에서 클로드와 같은 AI 코딩 에이전트를 사용하는 개발자들이 깨끗한 코드 작성에 집중하는 것을 멈추고 AI 시스템을 조율하는 '모델 아키텍트'가 되어야 한다고 주장합니다. 저자는 코딩 전 '로직 맵'을 만들고 프롬프트를 디자인 리뷰처럼 다루는 구체적인 기법을 공유합니다.

OpenRouter의 Healer Alpha 스텔스 모델은 아직 공개되지 않은 Qwen 3.5-Omni 변종으로 보입니다.
OpenRouter가 262,144 컨텍스트 윈도우와 멀티모달 기능을 갖춘 무료 익명 옴니모달 모델인 Healer Alpha를 배포했습니다. 포렌식 분석 결과, 이는 Alibaba의 공개되지 않은 Qwen 3.5-Omni 변종으로 추정됩니다.