태그: #accelerator
GPU·LLM·MLOps·쿠버네티스, 그리고 마음가짐에 관한 글 · 3 편
Systolic Array와 Dataflow 아키텍처 — TPU의 심장 원리 ♪ 들을 수 있어요
AI 가속기의 핵심 연산인 행렬곱을 효율적으로 처리하는 systolic array의 동작 원리를 ASCII 다이어그램과 함께 깊이 파헤칩니다. weight-stationary와 output-stationary 같은 dataflow 전략, 데이터 재사용과 에너지, 텐서코어와의 비교, 컴파일러 매핑까지 TPU의 심장 원리를 정리합니다.
2026-06-16 · 38 분 읽기 #gpu-cuda#systolic-array#dataflow#tpu#ai-hardware2026 AI 가속기 지형 — Blackwell에서 Vera Rubin까지 ♪ 들을 수 있어요
2026년 AI 가속기 시장을 한눈에 정리합니다. NVIDIA Blackwell과 차세대 Vera Rubin, AMD MI350X, 추론 capex가 학습을 처음 추월한 변화, 그리고 워크로드별로 어떤 칩을 골라야 하는지 개발자 관점에서 살펴봅니다.
2026-06-16 · 40 분 읽기 #ai-hardware#nvidia-blackwell#vera-rubin#inference#gpuAI 하드웨어 가속기 2026 — NVIDIA Blackwell / AMD Instinct MI400 / Google TPU Trillium / Cerebras WSE-3 / Groq LPU / Tenstorrent / Etched Sohu / Furiosa / Rebellions 심층 가이드
2026년 AI 하드웨어는 더 이상 NVIDIA 한 곳의 이야기가 아니다. Blackwell(B100/B200/GB200 NVL72/B300)이 GTC 2024에서 등장하고, 2026년 9월 Rubin이 예고된 가운데 AMD Instinct는 MI300X에서 MI355X를 거쳐 MI400 Helios까지 진격했다. Intel Gaudi 3가 마지막 별도 라인으로 출하되고 Falcon Shor
2026-05-16 · 27 분 읽기 #ai-hardware#gpu#accelerator#nvidia-blackwell#b100