tag ResNet

Residual Network (ResNet) (Artık Ağ (ResNet))

Bu sayfada ResNet (Residual Network (ResNet) (Artık Ağ (ResNet))) etiketi ile işaretlenmiş 3 yapay zeka kavramını bulabilirsiniz.

Residual Network (ResNet), derin sinir ağlarındaki gradyan kaybı problemini atlama bağlantıları (skip connections) ile çözen ve yüzlerce katmanlı ağların eğitimini mümkün kılan derin öğrenme mimarisidir. 2015 yılında Kaiming He, Xiangyu Zhang, Shaoqing Ren ve Jian Sun tarafından Microsoft Research'te geliştirildi; "Deep Residual Learning for Image Recognition" makalesi 250 binden fazla atıfla derin öğrenme tarihinin en çok referans verilen çalışmalarından biridir. ResNet-152, ILSVRC 2015 (ImageNet) yarışmasını yüzde 3,57 top-5 hata oranıyla kazandı ve insan seviyesi kabul edilen yüzde 5 sınırının altına indi. ResNet'ten önce ağ derinleştikçe doğruluk artacağına düşüyordu: 56 katmanlı düz bir ağ, 20 katmanlı olandan hem eğitim hem test setinde daha kötü sonuç veriyordu. Bu bozunma (degradation) sorununun kaynağı, geri yayılım sırasında hata sinyalinin katmanlar boyunca üstel olarak küçülmesi, yani gradyan kaybıydı. ResNet'in temel fikri artık öğrenmedir (residual learning). Klasik bir katman hedef dönüşüm H(x)'i doğrudan öğrenmeye çalışır; ResNet bloğu ise yalnızca artığı, F(x) = H(x) − x farkını öğrenir ve çıktıyı F(x) + x toplamıyla üretir. Eklenen kimlik kısayolu (identity shortcut) ek parametre getirmez, gradyanın alt katmanlara engelsiz akmasına izin verir ve bir katmanın işlevsiz kalması gerektiğinde F(x)'in sıfıra itilmesini yeterli kılar. Varyantlar katman sayısıyla anılır: ResNet-18, 34, 50, 101 ve 152. ResNet-50'den itibaren 1×1 → 3×3 → 1×1 konvolüsyonlu bottleneck bloklar hesap yükünü düşürür; ResNet-50 yaklaşık 25,6 milyon parametre ve 4,1 GFLOP ile hız-doğruluk dengesinin endüstri standardı olmuştur. Artık bağlantı fikri bilgisayarla görmenin ötesine taştı: Transformer mimarisinin her katmanı, dolayısıyla GPT-5, Claude Opus 4.5 ve Gemini 3 gibi 2026'nın büyük dil modelleri aynı prensiple çalışan bir residual stream üzerine kuruludur. Nesne tespiti (Faster R-CNN, YOLO ailesi), anlamsal bölütleme, tıbbi görüntü analizi ve uydu görüntüsü işleme alanlarında ResNet omurgaları hâlâ referans modeldir.

hub

Residual Network (ResNet) (Artık Ağ (ResNet))

Residual Network (ResNet), derin sinir ağlarındaki gradyan kaybı problemini atlama bağlantıları (skip connections) ile çözen ve yüzlerce katmanlı ağların eğitimini mümkün kılan derin öğrenme mimarisidir. 2015 yılında Kaiming He, Xiangyu Zhang, Shaoqing Ren ve Jian Sun tarafından Microsoft Research'te geliştirildi; "Deep Residual Learning for Image Recognition" makalesi 250 binden fazla atıfla derin öğrenme tarihinin en çok referans verilen çalışmalarından biridir. ResNet-152, ILSVRC 2015 (ImageNet) yarışmasını yüzde 3,57 top-5 hata oranıyla kazandı ve insan seviyesi kabul edilen yüzde 5 sınırının altına indi. ResNet'ten önce ağ derinleştikçe doğruluk artacağına düşüyordu: 56 katmanlı düz bir ağ, 20 katmanlı olandan hem eğitim hem test setinde daha kötü sonuç veriyordu. Bu bozunma (degradation) sorununun kaynağı, geri yayılım sırasında hata sinyalinin katmanlar boyunca üstel olarak küçülmesi, yani gradyan kaybıydı. ResNet'in temel fikri artık öğrenmedir (residual learning). Klasik bir katman hedef dönüşüm H(x)'i doğrudan öğrenmeye çalışır; ResNet bloğu ise yalnızca artığı, F(x) = H(x) − x farkını öğrenir ve çıktıyı F(x) + x toplamıyla üretir. Eklenen kimlik kısayolu (identity shortcut) ek parametre getirmez, gradyanın alt katmanlara engelsiz akmasına izin verir ve bir katmanın işlevsiz kalması gerektiğinde F(x)'in sıfıra itilmesini yeterli kılar. Varyantlar katman sayısıyla anılır: ResNet-18, 34, 50, 101 ve 152. ResNet-50'den itibaren 1×1 → 3×3 → 1×1 konvolüsyonlu bottleneck bloklar hesap yükünü düşürür; ResNet-50 yaklaşık 25,6 milyon parametre ve 4,1 GFLOP ile hız-doğruluk dengesinin endüstri standardı olmuştur. Artık bağlantı fikri bilgisayarla görmenin ötesine taştı: Transformer mimarisinin her katmanı, dolayısıyla GPT-5, Claude Opus 4.5 ve Gemini 3 gibi 2026'nın büyük dil modelleri aynı prensiple çalışan bir residual stream üzerine kuruludur. Nesne tespiti (Faster R-CNN, YOLO ailesi), anlamsal bölütleme, tıbbi görüntü analizi ve uydu görüntüsü işleme alanlarında ResNet omurgaları hâlâ referans modeldir.

arrow_forward
code_blocks

Skip Connection Nedir? Atlama Bağlantısı ve Derin Öğrenme (Atlama Bağlantısı)

Skip connection (atlama bağlantısı), derin sinir ağı mimarilerinde bir katmanın girdisinin bir veya daha fazla katman atlanarak ileriki bir katmana doğrudan iletilmesi tekniğidir. 2015 yılında Microsoft Research ekibinin ResNet (Residual Network) mimarisinde popüler hale getirdiği bu yapı, derin öğrenme tarihinin en etkili mimari yeniliklerinden biri olarak kabul edilmektedir. Derin sinir ağlarının temel sorunu, gradyan kaybı (vanishing gradient) problemidir: geri yayılım (backpropagation) sırasında hata sinyali katmanlar boyunca üstel biçimde küçülerek iletilir ve en alt katmanlar öğrenme sürecinden yetersiz yararlanır. 2015 öncesinde 20-30 katmanı aşan ağlar pratikte eğitilemiyordu. Skip connection bu sorunu köklü biçimde çözer. Mathematiksel olarak bir skip connection bloğu şu şekilde ifade edilir: çıktı = F(x) + x. Burada F(x) katmanların öğrendiği artık (residual) dönüşümü, x ise doğrudan iletilen kimlik terimidir. Bu toplama işlemi, gradyanın hem dönüşüm yolundan hem de kesintisiz kimlik yolundan geriye akabilmesini sağlar. Ağ artık hedef çıktıyı sıfırdan öğrenmek yerine yalnızca neyin değişmesi gerektiğini öğrenir; bu da eğitimi hem hızlandırır hem de stabilize eder. Skip connection, yalnızca bilgisayarla görme alanında değil, modern yapay zeka ekosisteminin tamamında kalıcı bir iz bırakmıştır. Transformer mimarisi her encoder ve decoder bloğunda skip connection ile katman normalizasyonunu (layer normalization) birleştiren yapıyı kullanır. GPT, BERT, ViT ve LLaMA gibi büyük dil modelleri ile görüntü dönüştürücülerinde bu tasarım ilkesi temel bir bileşen haline gelmiştir. U-Net medikal görüntülemede encoder-decoder bağlantıları için, DenseNet ise yoğun bağlantı blokları için farklı skip connection türleri kullanır. Skip connection'ın önemi, 2015 ImageNet yarışmasında ResNet-152'nin insan düzeyini aşan yüzde 3.57 hata oranıyla birinci gelmesiyle somutlaşmıştır. Bu sonuç, derin öğrenme topluluğunun ağ derinliğine bakışını kökten değiştirmiş ve yüzlerce hatta binlerce katmanlı modellerin eğitilmesinin önünü açmıştır.

arrow_forward
trending_down

Vanishing Gradient Problem (Kaybolan Gradyan Problemi)

Kaybolan Gradyan Problemi (İngilizce: Vanishing Gradient Problem), derin sinir ağlarını geri yayılım (backpropagation) algoritmasıyla eğitirken ortaya çıkan temel bir optimizasyon sorunudur. Ağdaki gradyanlar, geri yayılım sırasında çıkış katmanından girişe doğru ilerlerken her katmanda küçük değerlerle çarpılır. Sonuç olarak gradyanlar üstel biçimde küçülür ve ağın ilk katmanlarına ulaştığında pratikte sıfıra yaklaşır. Bu durum ilk katmanların güncellenmemesine yol açar; ağın bu erken katmanları neredeyse öğrenmez hale gelir. Sorunun ana nedeni, sigmoid ve tanh gibi aktivasyon fonksiyonlarının türevlerinin oldukça dar bir aralıkta (0 ile 0.25 arasında) kalmasıdır. Geri yayılım zincirinde her katman için bu küçük türev değerleriyle çarpma işlemi yapıldığından, 10 katmanlı bir ağda gradyan kolaylıkla (0.25)^10 ≈ 0.000001 gibi ihmal edilebilir bir değere düşebilir. Tarihsel açıdan bu problem, 1991 yılında Sepp Hochreiter'ın diplomasında kapsamlı biçimde analiz edildi. Bu analiz, özellikle RNN mimarilerinde uzun vadeli bağımlılıkların öğrenilememesi sorununu da açıklamaktaydı; bu nedenle Hochreiter ve Schmidhuber 1997'de LSTM mimarisini geliştirdi. Modern derin öğrenmede bu problemi hafifletmek için çeşitli yöntemler kullanılmaktadır. ReLU aktivasyon fonksiyonu, pozitif bölgede türevi 1 olduğundan gradyan akışını korur. Batch Normalization, katman çıktılarını normalleştirerek gradyanları dengeli tutar. ResNet'in temelini oluşturan Skip Connection (artık bağlantı), gradyanın katmanları atlayarak doğrudan iletilmesini sağlar. Xavier ve He başlatması gibi ağırlık başlatma stratejileri başlangıç gradyan dağılımını stabilize eder. LSTM ve GRU, özel geçit mekanizmalarıyla uzun vadeli gradyan akışını korur. Kaybolan Gradyan Problemi, Patlayan Gradyan Problemi (Exploding Gradient Problem) ile zıt bir çift oluşturur: birinde gradyanlar sıfıra çökerken diğerinde kontrolsüzce büyür. İkisi de derin ağ eğitiminin temel dinamiklerini etkiler ve modern mimari tasarım kararlarını doğrudan şekillendirir.

arrow_forward