AI 가속기는 AI 연산(특히 행렬 곱셈)을 빠르게 처리하도록 특화된 반도체로, 크게 세 가지로 나뉩니다. ①GPU(그래픽처리장치): 원래 그래픽 렌더링용이었으나 병렬연산에 강해 AI 학습의 사실상 표준이 됨(엔비디아 H100·B200 등). ②NPU(신경망처리장치): 처음부터 AI 연산만을 위해 설계된 전용 칩으로, 스마트폰·PC의 온디바이스 AI에 주로 탑재됨. ③ASIC(주문형반도체): 특정 회사의 특정 AI 모델에 맞춰 완전히 커스텀 설계한 칩(구글 TPU, 아마존 Trainium 등) — 범용성은 떨어지지만 전력 효율은 가장 뛰어남. 핵심 트레이드오프는 '범용성(GPU)과 전력효율(ASIC) 사이 어디에 둘 것인가'입니다.