AI가 메모리를 사간 게 아니라 같은 팹이 더 적은 비트를 만들고 있습니다. 웨이퍼 투입 비중과 비트 공급 비중을 나란히 놓으면 그 차이가 그대로 보입니다
태그: 반도체
27개의 게시물
-
메모리 값이 1년에 500% 올랐다 2026-08-20 -
8×MI355X 구성에서 노드당 952 tok/s, 달러당 48 tok/s가 나왔습니다. B300은 33 tok/s/$입니다. 갈림길은 연산 성능이 아니라 288GB VRAM으로 2.8T 모델이 단일 노드에 들어갔다는 사실입니다.
-
한국 AI 인프라 - NAVER·NVIDIA·Brookfield 200MW 확장 2026-07-29NAVER 각 세종 데이터센터의 NVIDIA DSX AI 팩토리를 현재 55MW에서 2028년 200MW로 확장하고 장기적으로 1GW를 목표합니다. NVIDIA가 NAVER에 10억 달러를 투자하고 Brookfield가 최대 90억 달러를 댑니다. 금액보다 전력과 계통이 실제 병목입니다.
-
NVIDIA의 OpenAI 오하이오 데이터센터 백스톱 2026-07-28NVIDIA가 SB Energy가 짓는 10GW 오하이오 캠퍼스의 리스와 건설 금융에 약 2,500억 달러 보증을 검토 중입니다. 칩 조달 금융 3,500억 달러는 별도 협상입니다.
-
딥시크 추론 칩 2026-07-13딥시크가 추론 특화 자체 칩을 개발 중이라고 로이터가 보도했습니다. 추론 하드웨어 자립이 AI 경쟁의 새 전선이 됐습니다.
-
Anthropic x Samsung 2nm AI 칩 협의 2026-07-08Anthropic이 자체 AI 칩 개발을 위해 삼성전자와 2nm 파운드리 계약 협의에 들어갔습니다. 탐색 초기 단계이지만 AI 랩의 실리콘 자립 흐름이 다시 주목받고 있습니다.
-
OpenAI와 Broadcom의 Jalapeño 칩 협력 2026-06-27OpenAI가 Broadcom과 공동 설계한 첫 번째 자체 AI 추론 칩 Jalapeño. TSMC 3nm 공정, 8개 HBM 스택, 9개월 개발 주기로 설계됐습니다. GPU 대비 추론 비용 약 50% 절감을 목표로 2026년 하반기 소규모 배포를 시작합니다.
-
Qualcomm, Modular 약 4조 원에 인수 - CUDA 대안 베팅 2026-06-26Qualcomm이 Chris Lattner의 Modular를 약 39억 달러에 인수했습니다. 핵심 자산은 CUDA 없이 NVIDIA, AMD, Apple Silicon 어떤 하드웨어에서도 동일 코드로 AI 추론을 실행하는 MAX 런타임입니다.
-
Qualcomm의 Tenstorrent 인수 협상 2026-06-21Qualcomm이 스타트업 Tenstorrent를 80억~100억 달러에 인수 협상 중. Jim Keller가 이끄는 RISC-V 기반 AI 가속기 스타트업으로, 성사 시 Qualcomm의 엣지·데이터센터 AI 가속기 전략에 중대한 전환점.
-
Flourish - 뇌를 역설계해 AI 전력 위기를 푸는 스타트업 2026-06-10베이조스와 GV, Lux가 5억 달러를 댄 브레인 인스파이어드 AI 스타트업 Flourish. 커넥토믹스로 뇌의 핵심 알고리즘을 찾아 20~50W로 돌아가는 AI를 만들겠다는, 스케일링 대신 뇌 모방이라는 베팅을 짚어봅니다.
-
연산 속도가 아니라 메모리에서 데이터를 옮겨오는 속도가 성능 상한을 정하는 상태. LLM 추론의 지배적 병목.
-
웨이퍼 스케일 AI 칩, 4조 트랜지스터, 접시 크기
-
SambaNova Reconfigurable Dataflow Unit, 엔터프라이즈 추론
-
High Bandwidth Memory. DRAM 다이를 수직으로 쌓아 인터포저로 프로세서에 붙이는 고대역폭 메모리. AI 가속기의 표준 부품.
-
GPU와 AI 가속기 시장을 주도하는 미국 반도체 기업
-
Microsoft 커스텀 AI 칩, TSMC 3nm, 216GB HBM3e
-
Tenstorrent 창업자이자 Taalas 공동창업자 겸 CEO. 유연한 AI 프로세서에서 모델 전용 하드와이어 칩으로 방향을 정반대로 튼 설계자.
-
AWS 커스텀 AI 칩, 128GB HBM3e, UltraServer 144칩
-
Groq Language Processing Unit, 초저지연 추론 특화
-
UC San Diego 교수. IEEE Fellow. 에너지 효율 컴퓨팅·하드웨어 ML 연구. SEElab 디렉터.
-
전설적인 반도체 설계자이자 Tenstorrent CEO. AMD Zen 아키텍처, Apple A4/A5, Tesla Autopilot 칩, Intel Silicon Engineering 등을 거친 CPU·AI 가속기 분야의 연쇄 혁신가.
-
미국 반도체 기업. EPYC CPU와 Instinct 가속기, ROCm 소프트웨어로 NVIDIA의 AI 데이터센터 점유율에 도전.
-
듀크대 전기컴퓨터공학과 교수, NSF AI Institute Athena 디렉터. 메모리·스토리지 시스템과 뉴로모픽 컴퓨팅 연구자로 ACM·IEEE·AAAS 펠로
-
Apple Silicon M5, 온디바이스 AI 추론, M4 대비 4배
-
캐나다 토론토의 AI 프로세서 기업. RISC-V 기반 유연한 AI 가속기를 만들며 IP 라이선싱 모델을 병행.
-
FuriosaAI 공동창업자 겸 CEO. AI 추론 가속기 RNGD 개발을 이끈 AI 반도체 기업가.
-
모델 가중치를 트랜지스터에 직접 배선하는 모델 전용 추론 칩 스타트업. 2026년 8월 AMD에 인수.