Sistolik Dizi: TPU Mimarisinin Kalbi
Geleneksel CPU ve GPU mimarilerinde her hesaplama birimi, veriyi bellekten ayrı ayrı okur ve yazar; bu durum yüksek bant genişliği talebi yaratır. TPU'nun sistolik dizi (systolic array) yaklaşımı bu problemi kökten çözer. Sistemin adı, Yunan kökenli 'systole' (kalp atışı) sözcüğünden gelir; tıpkı kanın kalp ritmiyle pompalanması gibi, veri çipin içinden düzenli darbelerle akar. Sistolik dizide her çarpma-toplama birimi (MAC — multiply-accumulate), sıradaki birime hem sonucu hem de aktivasyon verisini doğrudan iletir. Böylece büyük bir matris çarpımı hesaplanırken veri yalnızca bir kez ana bellekten yüklenir ve binlerce birim boyunca hedefe ulaşana kadar yeniden kullanılır. Bu yaklaşım bellek erişimini minimize ederek güç verimliliğini ve işlem hızını aynı anda artırır. TPU v1 için bu, 65.536 MAC biriminin dalga halinde veriyi işlemesi anlamına gelir.
TPU Nesilleri: v1'den TPU 8'e
Google, 2016'da veri merkezi kullanımı için TPU v1'i hayata geçirdi; bu nesil yalnızca çıkarım (inference) işlemleri için tasarlanmıştı. 2017'de kamuoyuna açıklanan v2 hem eğitim hem çıkarımı destekler hale geldi ve HBM entegrasyonuyla bellek bant genişliği katlandı. v3 kuşağı flops kapasitesini yaklaşık iki katına çıkarırken soğutma sistemini sıvı soğutmaya taşıdı. TPU v4 (2021) ve v5 serileri özellikle büyük dil modeli eğitimi için optimize edildi; MXU boyutu 256×256'ya çıkarıldı. 2024'te Google TPU v6e (Trillium) ve yeni nesil TPU 8t/8i çiftini tanıttı: '8t' eğitim yükü için, '8i' çıkarım yükü için ayrı optimize edilmiş varyantlardır. TPU Pod adı verilen çok-çip yapılandırmalarında binlerce TPU çekirdeği yüksek hızlı ICI (Inter-Chip Interconnect) ağıyla birleştirilir ve petabayt ölçeğinde model eğitimi sağlanır.
TPU Nesilleri
TPU v1 (2016)
TPU v2/v3 (2017-2018)
TPU v4 (2021)
TPU v5e / v5p (2023)
GPU ile Karşılaştırma: Güçlü ve Zayıf Yönler
NVIDIA GPU'ları genel amaçlı paralel hesaplama yapabilen esnek hızlandırıcılardır; CUDA ekosistemi sayesinde neredeyse tüm yapay zeka çerçeveleriyle (PyTorch, TensorFlow, JAX) sorunsuz çalışır. TPU ise bu esnekliği kasıtlı olarak feda ederek matris hesaplamalarında çok daha yüksek işlem yoğunluğu (OPS/W) elde eder. Pratik avantajlar: TPU'lar, Google'ın kendi altyapısında ve Google Cloud üzerinden erişildiğinde büyük dil modeli eğitiminde maliyet/performans avantajı sunar. JAX framework'ü TPU ile özellikle verimli çalışacak şekilde tasarlanmıştır. Öte yandan CUDA kütüphanelerine bağımlı özel operasyon gerektiren kodlar TPU'ya taşınması zor olabilir. Genel çıkarım için (özellikle küçük/orta boy modeller), özel inference sunucusu ihtiyacı olan ASIC'ler veya NPU'lar daha maliyet-etkin seçenek olabilir.
cloud Google Cloud TPU Kullanım Rehberi
- check_circle :
- check_circle :
- check_circle :
- check_circle :
- check_circle :
Sık Sorulan Sorular (SSS)
- check_circle TPU mimarisi GPU'dan temelden ne farklıdır?: GPU'lar her biri kendi belleğinden okuyan binlerce küçük CUDA çekirdeğine sahipken, TPU'nun sistolik dizisi veriyi bellekten bir kez yükleyerek zincirleme iletir. Bu, bellek bant genişliği talebini dramatik biçimde düşürür ve güç başına hesaplama verimliliğini artırır.
- check_circle TPU Mimarisi sadece TensorFlow ile mi çalışır?: Hayır. Başlangıçta TensorFlow için optimize edilmiş olsa da günümüzde JAX, PyTorch (torch_xla üzerinden) ve birçok framework TPU'yu destekler. Google'ın Gemini ailesi JAX+TPU kombinasyonuyla eğitilmiştir.
- check_circle Sistolik dizi neden matris çarpımında verimlidir?: Matris çarpımı, aynı veriyi tekrar tekrar farklı ağırlıklarla çarpmayı gerektirir. Sistolik dizide aktivasyon verisi bir kez yüklenerek tüm ağırlık birimlerinden akarken aynı anda tüm çarpımlar gerçekleştirilir; veri hareketi ile hesaplama paralel yürür ve bellek erişim maliyeti paylaşılır.
- check_circle TPU Pod nedir?: TPU Pod, yüzlerce veya binlerce TPU çekirdeğini ICI (Inter-Chip Interconnect) adı verilen yüksek bant genişlikli ağla birbirine bağlayan çok-çip sistemidir. TPU v4 Pod, 4.096 çip içerir ve eksa-FLOPS ölçeğinde hesaplama kapasitesi sunar.
- check_circle TPU'yu kimler kullanabilir?: Google Cloud üzerinden TPU VM veya TPU Pod kiralayarak araştırmacılar, girişimler ve kurumsal kullanıcılar erişebilir. Google ayrıca TPU Research Cloud (TRC) programı kapsamında akademik araştırmacılara ücretsiz TPU erişimi sunmaktadır.