tag ESRGAN
Süper Çözünürlük (Süper Çözünürlük)
Bu sayfada ESRGAN (Süper Çözünürlük (Süper Çözünürlük)) etiketi ile işaretlenmiş 1 yapay zeka kavramını bulabilirsiniz.
Süper çözünürlük (super-resolution), düşük çözünürlüklü (Low-Resolution / LR) bir görüntüden yüksek çözünürlüklü (High-Resolution / HR) bir görüntü elde etme işlemidir. Geleneksel bicubic enterpolasyon yöntemi yalnızca komşu piksel değerlerinin ağırlıklı ortalamasını alarak görüntüyü büyütür; bu süreç var olan bilginin yeniden dağıtılmasından ibarettir ve kenarları yumuşatıp bulanık bir sonuç üretir. Derin öğrenme tabanlı süper çözünürlük modelleri ise farklı bir strateji izler: milyonlarca LR–HR görüntü çiftinden öğrendikleri istatistiksel örüntüleri kullanarak görüntüde var olmayan piksel bilgisini halüsinasyon yoluyla üretirler. Bu 'halüsinasyon', kontrollü ve istatistiksel açıdan tutarlı olduğunda gerçek bir görsel zenginleşme yaratır; ancak yanlış öğrenilmiş bir modelde asıl görüntüde bulunmayan yapılar da eklenebilir. SRCNN (2014) alanın ilk derin öğrenme modelidir; üç konvolüsyon katmanıyla bile bicubic yöntemini PSNR metriğinde net biçimde geride bırakmıştır. SRGAN (2017) ise GAN çerçevesini devreye sokarak perceptual kaliteyi matematiksel metriklerden ayırdı: model daha düşük PSNR üretmesine rağmen insan gözüne çok daha doğal göründü. ESRGAN ve Real-ESRGAN gerçek dünya bozulmalarına (JPEG artefaktı, film tanesi, odak bulanıklığı) dayanıklı hale gelirken, SwinIR (2021) Swin Transformer mimarisiyle uzun menzilli bağımlılıkları yakalayarak referans model konumuna yükseldi. 2023'ten itibaren StableSR ve DiffBIR gibi difüzyon tabanlı modeller, gürültüyü kademeli olarak gidererek son derece gerçekçi dokular ve yüz detayları üretmeyi başardı. Uygulama alanları son derece geniştir: tıbbi görüntülemede MRI ve BT kesitlerinin netliği artırılırken, uydu görüntülerinde bina veya arazi örtüsü tespiti iyileştirilir. Dijital arşivlerde bozulmuş fotoğraflar restore edilir, video akışında düşük bant genişliği için sıkıştırılmış içerik yüksek çözünürlükte yeniden yapılandırılır. PSNR ve SSIM uzun süre temel metrikler olarak kullanılmış; ancak LPIPS ve DISTS gibi perceptual metrikler, insan algısıyla çok daha iyi örtüşen ölçümler sunmaktadır. Video süper çözünürlükte kareler arası tutarlılık ek bir zorluk oluşturur: optik akış hizalaması veya temporal attention mekanizmaları bu titreme (flickering) sorununu gidermek için kullanılır.