tag MaskRCNN

Instance Segmentation (Örnek Bölütleme)

Bu sayfada MaskRCNN (Instance Segmentation (Örnek Bölütleme)) etiketi ile işaretlenmiş 1 yapay zeka kavramını bulabilirsiniz.

Instance Segmentation (Örnek Bölütleme), bilgisayarlı görünün en gelişmiş görevlerinden biridir. Bir görüntüdeki her nesne örneğini piksel düzeyinde tespit edip birbirinden bağımsız olarak maskeleyen bu yöntem, nesne tespitinin (object detection) konumsal doğruluğunu ile semantik bölütlemenin (semantic segmentation) piksel hassasiyetini tek çatı altında birleştirir. Semantik Bölütlemeden Farkı: Semantik bölütleme "bu piksel araba sınıfına ait" der; ancak görüntüdeki iki arabayı tek bir kütle olarak ele alır. Örnek bölütleme ise her nesneye ayrı bir piksel maskesi atar: "bu Araba #1, şu Araba #2." Bu ayrım gerçek dünya uygulamalarında kritik önem taşır; otonom araçların birden fazla yayayı bağımsız takip etmesi, cerrahi robotların doku katmanlarını ayırt etmesi veya depo otomasyonunun üst üste yığılmış kutuları tek tek kavraması bu farkı gerektirir. Temel Mimariler: Mask R-CNN (He et al., 2017) bu alanın dönüm noktasıdır. Faster R-CNN'in bölgesel öneri mekanizmasına piksel maskesi çıkaran bir maske başlığı (mask head) ekleyerek her nesne için ayrı ikili maske üretir. YOLOv8-seg ve YOLOv9-seg gibi tek aşamalı (one-stage) modeller gerçek zamanlı uygulamalar için Mask R-CNN'e kıyasla çok daha hızlı bir alternatif sunar. Meta AI'ın 2023'te tanıttığı Segment Anything Model (SAM), nokta, kutu veya metin ipuçlarıyla sıfır atış (zero-shot) bölütleme yapabilen evrensel bir temel modeldir; fine-tuning gerektirmeksizin hemen her nesneyi maskeler. Mask2Former (2022) ise sorgu tabanlı (query-based) Transformer mimarisini benimseyerek panoptik, semantik ve örnek bölütlemeyi tek bir çerçevede birleştirir. Panoptik Bölütleme: Örnek bölütlemenin uzantısı olan panoptik bölütleme (panoptic segmentation), sayılabilir nesneleri (things: araba, kişi) ve sayılamaz bölgeleri (stuff: gökyüzü, zemin) eş zamanlı olarak maskeler. Değerlendirme Metrikleri: COCO veri kümesinde AP (Average Precision) farklı IoU eşiklerinde ölçülür: AP50, AP75 ve AP50:95 en yaygın kriterlerdir. Panoptik görevlerde Panoptic Quality (PQ) metriği hem tanıma hem bölütleme başarısını birlikte değerlendirir. Yüksek doğruluk için güçlü GPU gereklidir; ancak YOLOv8-seg ve SAM'ın mobil versiyonları edge cihazlarda çalışabilmektedir.

format_shapes

Instance Segmentation (Örnek Bölütleme)

Instance Segmentation (Örnek Bölütleme), bilgisayarlı görünün en gelişmiş görevlerinden biridir. Bir görüntüdeki her nesne örneğini piksel düzeyinde tespit edip birbirinden bağımsız olarak maskeleyen bu yöntem, nesne tespitinin (object detection) konumsal doğruluğunu ile semantik bölütlemenin (semantic segmentation) piksel hassasiyetini tek çatı altında birleştirir. Semantik Bölütlemeden Farkı: Semantik bölütleme "bu piksel araba sınıfına ait" der; ancak görüntüdeki iki arabayı tek bir kütle olarak ele alır. Örnek bölütleme ise her nesneye ayrı bir piksel maskesi atar: "bu Araba #1, şu Araba #2." Bu ayrım gerçek dünya uygulamalarında kritik önem taşır; otonom araçların birden fazla yayayı bağımsız takip etmesi, cerrahi robotların doku katmanlarını ayırt etmesi veya depo otomasyonunun üst üste yığılmış kutuları tek tek kavraması bu farkı gerektirir. Temel Mimariler: Mask R-CNN (He et al., 2017) bu alanın dönüm noktasıdır. Faster R-CNN'in bölgesel öneri mekanizmasına piksel maskesi çıkaran bir maske başlığı (mask head) ekleyerek her nesne için ayrı ikili maske üretir. YOLOv8-seg ve YOLOv9-seg gibi tek aşamalı (one-stage) modeller gerçek zamanlı uygulamalar için Mask R-CNN'e kıyasla çok daha hızlı bir alternatif sunar. Meta AI'ın 2023'te tanıttığı Segment Anything Model (SAM), nokta, kutu veya metin ipuçlarıyla sıfır atış (zero-shot) bölütleme yapabilen evrensel bir temel modeldir; fine-tuning gerektirmeksizin hemen her nesneyi maskeler. Mask2Former (2022) ise sorgu tabanlı (query-based) Transformer mimarisini benimseyerek panoptik, semantik ve örnek bölütlemeyi tek bir çerçevede birleştirir. Panoptik Bölütleme: Örnek bölütlemenin uzantısı olan panoptik bölütleme (panoptic segmentation), sayılabilir nesneleri (things: araba, kişi) ve sayılamaz bölgeleri (stuff: gökyüzü, zemin) eş zamanlı olarak maskeler. Değerlendirme Metrikleri: COCO veri kümesinde AP (Average Precision) farklı IoU eşiklerinde ölçülür: AP50, AP75 ve AP50:95 en yaygın kriterlerdir. Panoptik görevlerde Panoptic Quality (PQ) metriği hem tanıma hem bölütleme başarısını birlikte değerlendirir. Yüksek doğruluk için güçlü GPU gereklidir; ancak YOLOv8-seg ve SAM'ın mobil versiyonları edge cihazlarda çalışabilmektedir.

arrow_forward