tag BilgisayarlaGörme

Residual Network (ResNet) (Artık Ağ (ResNet))

Bu sayfada BilgisayarlaGörme (Residual Network (ResNet) (Artık Ağ (ResNet))) etiketi ile işaretlenmiş 2 yapay zeka kavramını bulabilirsiniz.

Residual Network (ResNet), derin sinir ağlarındaki gradyan kaybı problemini atlama bağlantıları (skip connections) ile çözen ve yüzlerce katmanlı ağların eğitimini mümkün kılan derin öğrenme mimarisidir. 2015 yılında Kaiming He, Xiangyu Zhang, Shaoqing Ren ve Jian Sun tarafından Microsoft Research'te geliştirildi; "Deep Residual Learning for Image Recognition" makalesi 250 binden fazla atıfla derin öğrenme tarihinin en çok referans verilen çalışmalarından biridir. ResNet-152, ILSVRC 2015 (ImageNet) yarışmasını yüzde 3,57 top-5 hata oranıyla kazandı ve insan seviyesi kabul edilen yüzde 5 sınırının altına indi. ResNet'ten önce ağ derinleştikçe doğruluk artacağına düşüyordu: 56 katmanlı düz bir ağ, 20 katmanlı olandan hem eğitim hem test setinde daha kötü sonuç veriyordu. Bu bozunma (degradation) sorununun kaynağı, geri yayılım sırasında hata sinyalinin katmanlar boyunca üstel olarak küçülmesi, yani gradyan kaybıydı. ResNet'in temel fikri artık öğrenmedir (residual learning). Klasik bir katman hedef dönüşüm H(x)'i doğrudan öğrenmeye çalışır; ResNet bloğu ise yalnızca artığı, F(x) = H(x) − x farkını öğrenir ve çıktıyı F(x) + x toplamıyla üretir. Eklenen kimlik kısayolu (identity shortcut) ek parametre getirmez, gradyanın alt katmanlara engelsiz akmasına izin verir ve bir katmanın işlevsiz kalması gerektiğinde F(x)'in sıfıra itilmesini yeterli kılar. Varyantlar katman sayısıyla anılır: ResNet-18, 34, 50, 101 ve 152. ResNet-50'den itibaren 1×1 → 3×3 → 1×1 konvolüsyonlu bottleneck bloklar hesap yükünü düşürür; ResNet-50 yaklaşık 25,6 milyon parametre ve 4,1 GFLOP ile hız-doğruluk dengesinin endüstri standardı olmuştur. Artık bağlantı fikri bilgisayarla görmenin ötesine taştı: Transformer mimarisinin her katmanı, dolayısıyla GPT-5, Claude Opus 4.5 ve Gemini 3 gibi 2026'nın büyük dil modelleri aynı prensiple çalışan bir residual stream üzerine kuruludur. Nesne tespiti (Faster R-CNN, YOLO ailesi), anlamsal bölütleme, tıbbi görüntü analizi ve uydu görüntüsü işleme alanlarında ResNet omurgaları hâlâ referans modeldir.

hub

Residual Network (ResNet) (Artık Ağ (ResNet))

Residual Network (ResNet), derin sinir ağlarındaki gradyan kaybı problemini atlama bağlantıları (skip connections) ile çözen ve yüzlerce katmanlı ağların eğitimini mümkün kılan derin öğrenme mimarisidir. 2015 yılında Kaiming He, Xiangyu Zhang, Shaoqing Ren ve Jian Sun tarafından Microsoft Research'te geliştirildi; "Deep Residual Learning for Image Recognition" makalesi 250 binden fazla atıfla derin öğrenme tarihinin en çok referans verilen çalışmalarından biridir. ResNet-152, ILSVRC 2015 (ImageNet) yarışmasını yüzde 3,57 top-5 hata oranıyla kazandı ve insan seviyesi kabul edilen yüzde 5 sınırının altına indi. ResNet'ten önce ağ derinleştikçe doğruluk artacağına düşüyordu: 56 katmanlı düz bir ağ, 20 katmanlı olandan hem eğitim hem test setinde daha kötü sonuç veriyordu. Bu bozunma (degradation) sorununun kaynağı, geri yayılım sırasında hata sinyalinin katmanlar boyunca üstel olarak küçülmesi, yani gradyan kaybıydı. ResNet'in temel fikri artık öğrenmedir (residual learning). Klasik bir katman hedef dönüşüm H(x)'i doğrudan öğrenmeye çalışır; ResNet bloğu ise yalnızca artığı, F(x) = H(x) − x farkını öğrenir ve çıktıyı F(x) + x toplamıyla üretir. Eklenen kimlik kısayolu (identity shortcut) ek parametre getirmez, gradyanın alt katmanlara engelsiz akmasına izin verir ve bir katmanın işlevsiz kalması gerektiğinde F(x)'in sıfıra itilmesini yeterli kılar. Varyantlar katman sayısıyla anılır: ResNet-18, 34, 50, 101 ve 152. ResNet-50'den itibaren 1×1 → 3×3 → 1×1 konvolüsyonlu bottleneck bloklar hesap yükünü düşürür; ResNet-50 yaklaşık 25,6 milyon parametre ve 4,1 GFLOP ile hız-doğruluk dengesinin endüstri standardı olmuştur. Artık bağlantı fikri bilgisayarla görmenin ötesine taştı: Transformer mimarisinin her katmanı, dolayısıyla GPT-5, Claude Opus 4.5 ve Gemini 3 gibi 2026'nın büyük dil modelleri aynı prensiple çalışan bir residual stream üzerine kuruludur. Nesne tespiti (Faster R-CNN, YOLO ailesi), anlamsal bölütleme, tıbbi görüntü analizi ve uydu görüntüsü işleme alanlarında ResNet omurgaları hâlâ referans modeldir.

arrow_forward
layers

Semantic Segmentation (Semantik Bölütleme)

Semantik bölütleme (semantic segmentation), bir görüntüdeki her pikseli belirli bir anlam kategorisiyle etiketleyen bilgisayarla görme görevidir. Nesne tespitinin sınırlayıcı kutular ürettiği ve örnek bölütlemenin aynı sınıftaki nesneleri birbirinden ayırt ettiği aksine; semantik bölütleme pikselleri sınıf düzeyinde sınıflandırır. Çıktı, her piksel için atanmış bir sınıf etiketinden oluşan yoğun bir haritadır. Bu görev, 2014 yılında UC Berkeley'den Long ve arkadaşları tarafından önerilen Tamamen Evrişimli Ağlar (FCN) ile derin öğrenme ekosisteminde köklü bir dönüşüm yaşadı. FCN, kesin piksel tahminlerini üretebilen ilk uçtan uca eğitilebilir mimari olarak tarihe geçti. Ardından U-Net (2015, biyomedikal görüntüleme) ve Google Brain'in DeepLab serisi (atrous evrişim ile çok ölçekli bağlam yakalama) bu alanın temel mimarileri arasına girdi. Transformatör tabanlı modeller de semantik bölütlemeye entegre olmuştur. SegFormer ve Mask2Former gibi mimariler, dikkat mekanizmaları sayesinde hem doğruluğu artırıyor hem de semantik, örnek ve panoramik bölütleme görevlerini tek çerçevede birleştiriyor. Meta'nın SAM 2 (Segment Anything Model 2) modeli, sıfır-atışlı segmentasyon kapasitesiyle temel model paradigmasını bu alana taşıdı. Başarım değerlendirmesinde en yaygın metrik, her sınıf için Birlik-Üzeri-Kesişim (IoU) değerinin ortalamasını alan mIoU'dur. PASCAL VOC, Cityscapes ve ADE20K veri kümeleri standart kıyaslama ortamları olarak kullanılır. Uygulama alanları geniştir: özerk araçlarda yol, araç ve yaya tespiti; tıbbi görüntü analizinde tümör belirleme ve organ sınırlama; uydu görüntüsü sınıflandırması; artırılmış gerçeklik ortamlarında sahne anlama bunların başında gelmektedir. Piksel düzeyinde etiketlemenin yüksek maliyeti, temel modellerin ve transfer öğrenmenin bu alandaki önemini artırmıştır.

arrow_forward