GPU (Graphics Processing Unit) (Grafik İşlemci (Ekran Kartı))
Binlerce kucuk paralel cekirdekle matris ve tensor islemlerini hizlandiran, derin ogrenme egitimi icin standart donanim.
GPU (Graphics Processing Unit — Grafik Isleme Birimi), baslangiçta bilgisayar grafiklerini hesaplamak icin tasarlanmis; fakat binlerce kucuk cekirdekli paralel mimarisi sayesinde yapay zeka ve yuksek performansli hesaplama (HPC) alanında vazgecilmez hale gelmis bir işlemci türüdür. Gunumuzde derin ogrenme egitimi ve cikarsama islemlerinin buyuk cogunlugu GPU uzerinde gerceklesmektedir. GPU'ların paralel mimarisi, AI hesaplamalarında kritik oneme sahip matris cogaltma ve tensor islemlerine cok iyi uymaktadir. NVIDIA'nin CUDA (Compute Unified Device Architecture) platformu, gelistiricilere GPU uzerinde genel amacli hesaplama yapmayi mumkun kilan ilk genis kapsamli yazilim katmaniydi. 2007'de tanıtılan CUDA, bugün de derin ogrenme ekosisteminin temelini olusturmaktadir. NVIDIA'nın AI odakli GPU'lari GPU mimarisinin evrimini yonlendirmistir: Tesla (2008), Kepler, Maxwell, Pascal, Volta, Ampere ve son olarak Hopper mimarisi (H100). A100 ve H100, LLM egitiminde standart haline gelmistir. AMD ise ROCm platformu ve MI300X cipleriyle bu pazara rakip olarak girmektedir. Apple'in M serisi cipler ise unifikasyon bellek mimarisiyle AI cikarsama icin enerji verimli alternatif sunmaktadir. Derin ogrenme cerceveleri (TensorFlow, PyTorch) GPU destegini neredeyse tamamen CUDA/cuDNN (NVIDIA) uzerinden saglar. Tensor Core'lar, H100 gibi modern cipler uzerinde yari hassas (FP16/BF16) matris islemlerini 10-100 kat hızlandirir. GPU belleği (VRAM) model buyuklugunu dogrudan sınırlar; 80GB VRAM'e sahip H100, 70 milyar parameterli bir modeli tam hassasiyetle tutabilir.