tag bellek

CXL (Compute Express Link) (Compute Express Link)

Bu sayfada bellek (CXL (Compute Express Link) (Compute Express Link)) etiketi ile işaretlenmiş 1 yapay zeka kavramını bulabilirsiniz.

CXL (Compute Express Link), PCIe (Peripheral Component Interconnect Express) fiziksel katmanı üzerine inşa edilmiş, açık endüstri standardı bir ara bağlantı (interconnect) protokolüdür. 2019 yılında Intel öncülüğünde duyurulan ve AMD, ARM, Google, Meta, Microsoft, Samsung ve SK Hynix gibi önde gelen teknoloji şirketlerinin desteğiyle büyüyen bu standart; CPU'lar, GPU'lar, FPGA'lar, yapay zeka hızlandırıcıları ve akıllı bellek modülleri arasında düşük gecikmeli, yüksek bant genişlikli ve tutarlı (coherent) veri alışverişi sağlar. Geleneksel bellek mimarilerinde her işlemci yalnızca kendi yerel DRAM veya HBM belleğine doğrudan erişebilir; bu durum özellikle yüz milyar parametreyi aşan büyük dil modellerinin (LLM) çıkarım (inference) aşamasında kritik bir bellek duvarı (memory wall) darboğazı yaratır. CXL, bu sorunu bellek havuzlama (memory pooling) ve bellek genişletme (memory expansion) yetenekleriyle aşar: DRAM veya CXL-Flash tabanlı harici bellek kartları, CXL bağlantısı üzerinden CPU ve GPU'ya sanki yerel bellek gibi düşük gecikmeyle sunulabilir; böylece her sunucu nodunun bellek kapasitesi, pahalı HBM yığınları gerektirmeksizin ekonomik biçimde artırılabilir. CXL standardı üç temel protokol alt katmanından oluşur: CXL.io, PCIe tabanlı I/O işlemlerini; CXL.cache, hızlandırıcıların host belleğine önbellek-tutarlı erişimini; CXL.mem ise host'un hızlandırıcı veya harici belleğine tutarlı erişimini yönetir. Standart hızla evrimleşmiş: CXL 1.0 (2019) temel bağlantı ve tutarlılık altyapısını; CXL 2.0 (2020) bellek havuzlamayı ve anahtarlama desteğini; CXL 3.0 (2022) ise çok-seviyeli fabric topolojisini ve gelişmiş eşler arası bellek paylaşımını getirmiştir. Yapay zeka altyapısı tasarımcıları açısından CXL'in önemi giderek artmaktadır. Özellikle büyük LLM'lerin KV önbelleği (key-value cache) için gereken terabayt seviyesindeki bellek gereksinimini karşılamak amacıyla CXL tabanlı bellek genişletme kartları veri merkezlerinde yaygınlaşmaktadır. Samsung, SK Hynix ve Micron gibi bellek üreticileri ticari CXL DRAM modülleri üretmekte; AWS, Google Cloud ve Microsoft Azure gibi büyük bulut hizmet sağlayıcıları bu teknolojiyi yeni nesil sunucu tasarımlarına entegre etmektedir.

hub

CXL (Compute Express Link) (Compute Express Link)

CXL (Compute Express Link), PCIe (Peripheral Component Interconnect Express) fiziksel katmanı üzerine inşa edilmiş, açık endüstri standardı bir ara bağlantı (interconnect) protokolüdür. 2019 yılında Intel öncülüğünde duyurulan ve AMD, ARM, Google, Meta, Microsoft, Samsung ve SK Hynix gibi önde gelen teknoloji şirketlerinin desteğiyle büyüyen bu standart; CPU'lar, GPU'lar, FPGA'lar, yapay zeka hızlandırıcıları ve akıllı bellek modülleri arasında düşük gecikmeli, yüksek bant genişlikli ve tutarlı (coherent) veri alışverişi sağlar. Geleneksel bellek mimarilerinde her işlemci yalnızca kendi yerel DRAM veya HBM belleğine doğrudan erişebilir; bu durum özellikle yüz milyar parametreyi aşan büyük dil modellerinin (LLM) çıkarım (inference) aşamasında kritik bir bellek duvarı (memory wall) darboğazı yaratır. CXL, bu sorunu bellek havuzlama (memory pooling) ve bellek genişletme (memory expansion) yetenekleriyle aşar: DRAM veya CXL-Flash tabanlı harici bellek kartları, CXL bağlantısı üzerinden CPU ve GPU'ya sanki yerel bellek gibi düşük gecikmeyle sunulabilir; böylece her sunucu nodunun bellek kapasitesi, pahalı HBM yığınları gerektirmeksizin ekonomik biçimde artırılabilir. CXL standardı üç temel protokol alt katmanından oluşur: CXL.io, PCIe tabanlı I/O işlemlerini; CXL.cache, hızlandırıcıların host belleğine önbellek-tutarlı erişimini; CXL.mem ise host'un hızlandırıcı veya harici belleğine tutarlı erişimini yönetir. Standart hızla evrimleşmiş: CXL 1.0 (2019) temel bağlantı ve tutarlılık altyapısını; CXL 2.0 (2020) bellek havuzlamayı ve anahtarlama desteğini; CXL 3.0 (2022) ise çok-seviyeli fabric topolojisini ve gelişmiş eşler arası bellek paylaşımını getirmiştir. Yapay zeka altyapısı tasarımcıları açısından CXL'in önemi giderek artmaktadır. Özellikle büyük LLM'lerin KV önbelleği (key-value cache) için gereken terabayt seviyesindeki bellek gereksinimini karşılamak amacıyla CXL tabanlı bellek genişletme kartları veri merkezlerinde yaygınlaşmaktadır. Samsung, SK Hynix ve Micron gibi bellek üreticileri ticari CXL DRAM modülleri üretmekte; AWS, Google Cloud ve Microsoft Azure gibi büyük bulut hizmet sağlayıcıları bu teknolojiyi yeni nesil sunucu tasarımlarına entegre etmektedir.

arrow_forward