tag Segmentasyon

Bu sayfada Segmentasyon etiketi ile işaretlenmiş 3 yapay zeka kavramını bulabilirsiniz.

Kümeleme (clustering), bir veri setindeki örnekleri önceden tanımlanmış etiketler kullanmadan, yalnızca verinin iç yapısına dayalı benzerlik ölçütlerine göre gruplara ayıran denetimsiz öğrenme tekniğidir. Her küme, üyeleri arasındaki mesafenin (veya başka bir benzerlik metriğinin) küme dışı noktalara göre daha küçük olduğu, homojen bir veri alt kümesidir. Kümeleme algoritmaları farklı geometrik varsayımlara dayanır; bu nedenle algoritma seçimi verinin şekline ve yoğunluğuna bağlıdır. K-Means, veriyi önceden belirtilen k merkeze (centroid) yakınlığa göre böler; kümelerin yaklaşık küresel ve eşit büyüklükte olduğu varsayımıyla çalışır. Hierarchical Clustering (hiyerarşik kümeleme), dendogram adı verilen ağaç yapısı üzerinden küme sayısına önceden karar vermeye gerek duymadan farklı granülerlikte kümeler sunar. DBSCAN (Density-Based Spatial Clustering of Applications with Noise) ise yoğunluk tabanlı çalışır; keyfi şekilli kümeleri bulabilir ve gürültü noktalarını aykırı değer olarak etiketler — bu özellik K-Means'e kıyasla önemli bir avantajdır. Küme kalitesini değerlendirmek için gerçek etiketler olmadan da kullanılabilen iç metrikler mevcuttur. Silhouette skoru, her noktanın kendi kümesine ne kadar yakın, komşu kümelere ne kadar uzak olduğunu -1 ile +1 arasında ölçer; yüksek skor iyi ayrışmış kümelere işaret eder. Davies-Bouldin indeksi ve Calinski-Harabasz skoru da benzer amaçla kullanılan yaygın metriklerdir. K-Means için en uygun k değerini bulmak amacıyla "dirsek yöntemi" (elbow method) ve silhouette analizi birlikte kullanılır. Pratik uygulamaları arasında müşteri segmentasyonu, belge sınıflandırma, anomali tespiti, görüntü renk nicemleme (color quantization), gen ifadesi analizi ve sosyal ağ topluluğu tespiti sayılabilir. Makine öğrenmesinde kümeleme ayrıca özellik mühendisliği aşamasında yeni değişkenler türetmek veya yarı-denetimli öğrenme için etiketleme maliyetini düşürmek amacıyla da kullanılır. Python'da scikit-learn kütüphanesi KMeans, DBSCAN, AgglomerativeClustering gibi tüm temel algoritmaları standart arayüzle sunar.

code_blocks

Clustering (Kümeleme (Clustering))

Kümeleme (clustering), bir veri setindeki örnekleri önceden tanımlanmış etiketler kullanmadan, yalnızca verinin iç yapısına dayalı benzerlik ölçütlerine göre gruplara ayıran denetimsiz öğrenme tekniğidir. Her küme, üyeleri arasındaki mesafenin (veya başka bir benzerlik metriğinin) küme dışı noktalara göre daha küçük olduğu, homojen bir veri alt kümesidir. Kümeleme algoritmaları farklı geometrik varsayımlara dayanır; bu nedenle algoritma seçimi verinin şekline ve yoğunluğuna bağlıdır. K-Means, veriyi önceden belirtilen k merkeze (centroid) yakınlığa göre böler; kümelerin yaklaşık küresel ve eşit büyüklükte olduğu varsayımıyla çalışır. Hierarchical Clustering (hiyerarşik kümeleme), dendogram adı verilen ağaç yapısı üzerinden küme sayısına önceden karar vermeye gerek duymadan farklı granülerlikte kümeler sunar. DBSCAN (Density-Based Spatial Clustering of Applications with Noise) ise yoğunluk tabanlı çalışır; keyfi şekilli kümeleri bulabilir ve gürültü noktalarını aykırı değer olarak etiketler — bu özellik K-Means'e kıyasla önemli bir avantajdır. Küme kalitesini değerlendirmek için gerçek etiketler olmadan da kullanılabilen iç metrikler mevcuttur. Silhouette skoru, her noktanın kendi kümesine ne kadar yakın, komşu kümelere ne kadar uzak olduğunu -1 ile +1 arasında ölçer; yüksek skor iyi ayrışmış kümelere işaret eder. Davies-Bouldin indeksi ve Calinski-Harabasz skoru da benzer amaçla kullanılan yaygın metriklerdir. K-Means için en uygun k değerini bulmak amacıyla "dirsek yöntemi" (elbow method) ve silhouette analizi birlikte kullanılır. Pratik uygulamaları arasında müşteri segmentasyonu, belge sınıflandırma, anomali tespiti, görüntü renk nicemleme (color quantization), gen ifadesi analizi ve sosyal ağ topluluğu tespiti sayılabilir. Makine öğrenmesinde kümeleme ayrıca özellik mühendisliği aşamasında yeni değişkenler türetmek veya yarı-denetimli öğrenme için etiketleme maliyetini düşürmek amacıyla da kullanılır. Python'da scikit-learn kütüphanesi KMeans, DBSCAN, AgglomerativeClustering gibi tüm temel algoritmaları standart arayüzle sunar.

arrow_forward
code_blocks

Görüntü Segmentasyonu (Görüntü Segmentasyonu)

Görüntü segmentasyonu (Image Segmentation), bir görüntüdeki her pikseli anlamlı kategorilere veya nesne sınıflarına atayarak görüntüyü bölgelere ayıran derin öğrenme tekniğidir. Nesne tespitinin yalnızca sınırlayıcı dikdörtgen üretmesinin aksine, segmentasyon piksel düzeyinde hassasiyet sağlar ve sahnenin ayrıntılı bir haritasını çıkarır. Üç temel alt görev öne çıkar: Semantik Segmentasyon, her pikseli bir sınıfa atar — örneğin "yol", "araç", "yaya" — ancak aynı sınıftaki birden fazla nesne birbirinden ayrılmaz. FCN (Fully Convolutional Network, 2015) ve DeepLab ailesi bu yaklaşımın öncülerindendir. İnstans Segmentasyon ise aynı sınıftaki farklı nesne örneklerini ayrı maskelerle işaretler; Mask R-CNN (He et al., 2017) her nesne için sınırlayıcı kutu ve piksel maskesi üretir ve bu alanın de facto standardı olmuştur. Panoptik Segmentasyon, semantik ve instans segmentasyonunu tek bir çıktıda birleştirerek hem sayılamayan arka plan bölgelerini hem de sayılabilir nesneleri kapsar. 2023'te Meta AI'ın tanıttığı SAM (Segment Anything Model), 1 milyardan fazla maskeyle ön eğitilmiş bir temel modeldir. Kullanıcı nokta, sınırlayıcı kutu ya da metin ipuçlarıyla herhangi bir bölgeyi sıfır-atış segmentasyonla ayırabilir; bu da onu son derece çok yönlü bir araç haline getirir. Uygulama alanları geniştir: tıbbi görüntülemede tümör sınırlarının piksel hassasiyetiyle belirlenmesi, otonom araçlarda yol ve engel ayrımı, uydu fotoğraflarında arazi örtüsü sınıflandırması, endüstriyel üretimde yüzey kusuru tespiti ve artırılmış gerçeklik uygulamalarında arka plan değiştirme bunların başında gelir.

arrow_forward
code_blocks

SAM (SAM (Her Şeyi Segmentleyen Model))

SAM (Segment Anything Model — Her Şeyi Segmentleyen Model), Meta AI Research tarafından 2023'te yayımlanan ve görüntü segmentasyonunda sıfır-atış (zero-shot) genelleştirme yeteneği sunan temel bir bilgisayarlı görü modelidir. Geleneksel segmentasyon modelleri belirli nesne kategorileri için özel olarak eğitilirken SAM, yalnızca bir nokta, sınır kutusu veya metin istemi ile görüntüdeki herhangi bir nesneyi anında segmentleyebilir. Model, 11 milyondan fazla görüntü ve 1,1 milyardan fazla maske içeren SA-1B veri kümesiyle eğitilmiştir — segmentasyon alanındaki en büyük veri setlerinden biridir. SAM üç ana bileşenden oluşur: MAE ile önceden eğitilmiş ViT tabanlı bir görüntü kodlayıcısı, nokta, kutu veya metin girdileri için bir istem kodlayıcısı ve çakışan potansiyel maskeler üreten hafif bir maske dekoderi. Bu mimari, modelin bir görüntüdeki her nesneyi hiçbir kategori bilgisine gerek duymadan ayrıştırmasına imkân tanır. Meta, 2024'te SAM 2'yi yayımladı. SAM 2, SAM'ın video segmentasyonuna genişletilmiş versiyonudur; gerçek zamanlı nesne izleme ve kareler arası tutarlı maske üretimi sunar. Streaming memory mimarisi, daha önce görülmüş karelerin bilgisini saklar ve böylece modelin nesneyi kaybolduğunda yeniden bulmasına olanak tanır. Kullanım alanları oldukça geniştir: tıbbi görüntülemede organ ve lezyon tespiti, otonom araçlarda sahne analizi, AR/VR içerik üretimi, uydu görüntülerinde arazi örtüsü haritalaması ve e-ticaret ürün görsellerinde arka plan kaldırma. Türkiye'de akıllı tarım sistemleri, endüstriyel kalite kontrol ve mobil uygulama geliştirmede benimsenmektedir.

arrow_forward