[문제] AI 반도체의 필요성을 설명하고, GPU, NPU(Neural Processing Unit), TPU(Tensor Processing Unit)의 구조적 특성과 활용 분야를 비교하시오.
1. AI 반도체의 필요성
딥러닝 모델의 행렬 연산(Matrix Multiplication)은 범용 CPU로 처리하기에 연산량이 방대하다. AI 반도체는 병렬 연산·낮은 메모리 대역폭 요구·전력 효율을 위해 특화 설계된 프로세서다.
2. GPU / NPU / TPU 비교
| 구분 | GPU | NPU | TPU |
|---|---|---|---|
| 개발사 | NVIDIA, AMD | Qualcomm, Apple, Samsung | |
| 구조 | 수천~수만 코어, SIMT 병렬 처리 | MAC(Multiply-Accumulate) 특화 회로 | Systolic Array (행렬 곱 전용) |
| 강점 | 범용 병렬 연산, 대형 모델 학습 | 저전력·엣지 디바이스 추론 | TensorFlow 워크로드 최적화, 빠른 행렬 연산 |
| 활용 | LLM 학습, HPC, 렌더링 | 스마트폰·IoT·차량 온디바이스 AI | Google Cloud AI 서비스, AlphaFold |
| 메모리 | HBM (고대역폭 메모리) | SRAM (초저전력) | HBM + 대용량 캐시 |
핵심 키워드: GPU, NPU, TPU, Systolic Array, HBM, CUDA, MAC Unit, 온디바이스 AI, 엣지 추론
GPU는 대형 AI 모델 학습의 표준, NPU는 모바일·엣지 온디바이스 추론, TPU는 Google 인프라 최적화에 강점이 있다. AI 반도체 패권 경쟁은 NVIDIA GPU 중심에서 NPU·PIM(Processing In Memory) 방향으로 진화 중이다.