tag Segmentasyon

Bu sayfada Segmentasyon etiketi ile işaretlenmiş 3 yapay zeka kavramını bulabilirsiniz.

Kümeleme (clustering), bir veri setindeki örnekleri önceden tanımlanmış etiketler kullanmadan, yalnızca verinin iç yapısına dayalı benzerlik ölçütlerine göre gruplara ayıran denetimsiz öğrenme tekniğidir. Her küme, üyeleri arasındaki mesafenin (veya başka bir benzerlik metriğinin) küme dışı noktalara göre daha küçük olduğu, homojen bir veri alt kümesidir. Kümeleme algoritmaları farklı geometrik varsayımlara dayanır; bu nedenle algoritma seçimi verinin şekline ve yoğunluğuna bağlıdır. K-Means, veriyi önceden belirtilen k merkeze (centroid) yakınlığa göre böler; kümelerin yaklaşık küresel ve eşit büyüklükte olduğu varsayımıyla çalışır. Hierarchical Clustering (hiyerarşik kümeleme), dendogram adı verilen ağaç yapısı üzerinden küme sayısına önceden karar vermeye gerek duymadan farklı granülerlikte kümeler sunar. DBSCAN (Density-Based Spatial Clustering of Applications with Noise) ise yoğunluk tabanlı çalışır; keyfi şekilli kümeleri bulabilir ve gürültü noktalarını aykırı değer olarak etiketler — bu özellik K-Means'e kıyasla önemli bir avantajdır. Küme kalitesini değerlendirmek için gerçek etiketler olmadan da kullanılabilen iç metrikler mevcuttur. Silhouette skoru, her noktanın kendi kümesine ne kadar yakın, komşu kümelere ne kadar uzak olduğunu -1 ile +1 arasında ölçer; yüksek skor iyi ayrışmış kümelere işaret eder. Davies-Bouldin indeksi ve Calinski-Harabasz skoru da benzer amaçla kullanılan yaygın metriklerdir. K-Means için en uygun k değerini bulmak amacıyla "dirsek yöntemi" (elbow method) ve silhouette analizi birlikte kullanılır. Pratik uygulamaları arasında müşteri segmentasyonu, belge sınıflandırma, anomali tespiti, görüntü renk nicemleme (color quantization), gen ifadesi analizi ve sosyal ağ topluluğu tespiti sayılabilir. Makine öğrenmesinde kümeleme ayrıca özellik mühendisliği aşamasında yeni değişkenler türetmek veya yarı-denetimli öğrenme için etiketleme maliyetini düşürmek amacıyla da kullanılır. Python'da scikit-learn kütüphanesi KMeans, DBSCAN, AgglomerativeClustering gibi tüm temel algoritmaları standart arayüzle sunar.

code_blocks

Clustering (Kümeleme (Clustering))

Kümeleme (clustering), bir veri setindeki örnekleri önceden tanımlanmış etiketler kullanmadan, yalnızca verinin iç yapısına dayalı benzerlik ölçütlerine göre gruplara ayıran denetimsiz öğrenme tekniğidir. Her küme, üyeleri arasındaki mesafenin (veya başka bir benzerlik metriğinin) küme dışı noktalara göre daha küçük olduğu, homojen bir veri alt kümesidir. Kümeleme algoritmaları farklı geometrik varsayımlara dayanır; bu nedenle algoritma seçimi verinin şekline ve yoğunluğuna bağlıdır. K-Means, veriyi önceden belirtilen k merkeze (centroid) yakınlığa göre böler; kümelerin yaklaşık küresel ve eşit büyüklükte olduğu varsayımıyla çalışır. Hierarchical Clustering (hiyerarşik kümeleme), dendogram adı verilen ağaç yapısı üzerinden küme sayısına önceden karar vermeye gerek duymadan farklı granülerlikte kümeler sunar. DBSCAN (Density-Based Spatial Clustering of Applications with Noise) ise yoğunluk tabanlı çalışır; keyfi şekilli kümeleri bulabilir ve gürültü noktalarını aykırı değer olarak etiketler — bu özellik K-Means'e kıyasla önemli bir avantajdır. Küme kalitesini değerlendirmek için gerçek etiketler olmadan da kullanılabilen iç metrikler mevcuttur. Silhouette skoru, her noktanın kendi kümesine ne kadar yakın, komşu kümelere ne kadar uzak olduğunu -1 ile +1 arasında ölçer; yüksek skor iyi ayrışmış kümelere işaret eder. Davies-Bouldin indeksi ve Calinski-Harabasz skoru da benzer amaçla kullanılan yaygın metriklerdir. K-Means için en uygun k değerini bulmak amacıyla "dirsek yöntemi" (elbow method) ve silhouette analizi birlikte kullanılır. Pratik uygulamaları arasında müşteri segmentasyonu, belge sınıflandırma, anomali tespiti, görüntü renk nicemleme (color quantization), gen ifadesi analizi ve sosyal ağ topluluğu tespiti sayılabilir. Makine öğrenmesinde kümeleme ayrıca özellik mühendisliği aşamasında yeni değişkenler türetmek veya yarı-denetimli öğrenme için etiketleme maliyetini düşürmek amacıyla da kullanılır. Python'da scikit-learn kütüphanesi KMeans, DBSCAN, AgglomerativeClustering gibi tüm temel algoritmaları standart arayüzle sunar.

arrow_forward
code_blocks

Görüntü Segmentasyonu (Görüntü Segmentasyonu)

Görüntü segmentasyonu, bir dijital görseli anlamlı bölgelere veya nesnelere ayıran, yapay zeka ve bilgisayarlı görü alanının temel işlemlerinden biridir. Ham piksel verisi üzerinde çalışan bu işlem, her pikseli belirli bir sınıfa ya da nesne örneğine atar; böylece bir görüntü içindeki farklı nesne ve yüzeylerin sınırları hassas biçimde belirlenir. Segmentasyon, yalnızca nesne tespitinin (object detection) ötesine geçer: sınırlayıcı kutu (bounding box) yerine nesnenin tam piksel maskesini üretir. Üç ana segmentasyon türü mevcuttur. Semantik segmentasyon, her pikseli bir sınıf etiketiyle işaretler; aynı sınıftaki tüm nesneler tek bir bölge olarak ele alınır. Örneğin bir sokak sahnesinde tüm arabalar tek renk, tüm yayalar başka bir renk ile gösterilir. Instance segmentasyon ise bu yaklaşımı bir adım ileri taşır: aynı sınıftan her nesneyi ayrı bir örnek olarak ayırt eder. İki araba yan yana dursa bile her biri kendi maskesine sahip olur. Panoptik segmentasyon ise semantik ve instance segmentasyonu birleştirerek hem sayılabilen nesnelere (araba, insan) hem de arka plan bölgelerine (yol, gökyüzü) piksel düzeyinde etiket atar. Modern segmentasyon mimarileri derin öğrenmeye dayanır. FCN (Fully Convolutional Network) ile başlayan süreç, U-Net ve SegNet gibi encoder-decoder mimarileriyle olgunlaşmıştır. Transformer tabanlı SegFormer ve Mask2Former, dikkat mekanizmalarını kullanarak küresel bağlamı daha iyi modelleyerek önceki CNN yaklaşımlarını geride bırakmıştır. Meta tarafından geliştirilen SAM (Segment Anything Model) ise herhangi bir nesneyi sıfır görüntüyle (zero-shot) segmente edebilen evrensel bir model olarak alanda çığır açmıştır. Görüntü segmentasyonu; tıbbi görüntülemede tümör ve organ sınırlarının tespiti, otonom araçlarda yol ve engel ayrımı, uydu görüntülerinde arazi örtüsü sınıflandırması, artırılmış gerçeklikte arka plan kaldırma ve endüstriyel kalite kontrolünde kusur tespiti gibi kritik uygulamalarda kullanılmaktadır. Performans ölçütü olarak mIoU (mean Intersection over Union) ve Dice katsayısı yaygın şekilde benimsenmektedir.

arrow_forward
code_blocks

SAM (SAM (Her Şeyi Segmentleyen Model))

SAM (Segment Anything Model — Her Şeyi Segmentleyen Model), Meta AI Research tarafından 2023'te yayımlanan ve görüntü segmentasyonunda sıfır-atış (zero-shot) genelleştirme yeteneği sunan temel bir bilgisayarlı görü modelidir. Geleneksel segmentasyon modelleri belirli nesne kategorileri için özel olarak eğitilirken SAM, yalnızca bir nokta, sınır kutusu veya metin istemi ile görüntüdeki herhangi bir nesneyi anında segmentleyebilir. Model, 11 milyondan fazla görüntü ve 1,1 milyardan fazla maske içeren SA-1B veri kümesiyle eğitilmiştir — segmentasyon alanındaki en büyük veri setlerinden biridir. SAM üç ana bileşenden oluşur: MAE ile önceden eğitilmiş ViT tabanlı bir görüntü kodlayıcısı, nokta, kutu veya metin girdileri için bir istem kodlayıcısı ve çakışan potansiyel maskeler üreten hafif bir maske dekoderi. Bu mimari, modelin bir görüntüdeki her nesneyi hiçbir kategori bilgisine gerek duymadan ayrıştırmasına imkân tanır. Meta, 2024'te SAM 2'yi yayımladı. SAM 2, SAM'ın video segmentasyonuna genişletilmiş versiyonudur; gerçek zamanlı nesne izleme ve kareler arası tutarlı maske üretimi sunar. Streaming memory mimarisi, daha önce görülmüş karelerin bilgisini saklar ve modelin nesneyi yeniden bulmasına olanak tanır. SAM ile klasik segmentasyon modelleri arasındaki temel ayrım zero-shot kapasitesidir: Mask R-CNN gibi modeller yalnızca eğitildikleri kategorileri tanırken SAM, hiç görmediği nesneleri bile isteme göre ayrıştırır. Bu özellik araştırmacılara ve geliştiricilere büyük esneklik kazandırır; özel veri etiketleme maliyeti olmadan yeni alanlara hızla uyum sağlanabilir. Kullanım alanları oldukça geniştir: tıbbi görüntülemede organ ve lezyon tespiti (MedSAM), otonom araçlarda sahne analizi, AR/VR içerik üretimi, uydu görüntülerinde arazi örtüsü haritalamas ve e-ticaret ürün görsellerinde arka plan kaldırma. Apache 2.0 lisansıyla açık kaynak olarak yayımlanan SAM, MobileSAM ve EfficientSAM gibi hafifletilmiş versiyonlarıyla kenar cihazlara da taşınabilir durumdadır.

arrow_forward