Karşıtlıklı Öğrenme Nasıl Çalışır?
Karşıtlıklı öğrenme, bir veri noktasının iki farklı dönüşümünü (kırpma, renk değiştirme, bulanıklaştırma gibi augmentasyon teknikleri ile üretilen) pozitif çift olarak alır. Model, bu iki görünümün gömme vektörlerini birbirine yaklaştıracak şekilde eğitilir. Aynı zamanda, mini-batch içindeki diğer tüm örnekler negatif çift olarak kabul edilir ve bunların gömme vektörleri uzaklaştırılır. Bu süreç, modelin veri içindeki değişmez özellikleri — yani hangi dönüşümler yapılsa da değişmeyen semantik bilgiyi — öğrenmesini sağlar. Kayıp fonksiyonu olarak çoğunlukla InfoNCE kullanılır: bu fonksiyon, pozitif çiftin dot-product benzerliğini tüm negatiflerle karşılaştıran bir softmax cross-entropy kaybıdır.
Temel Çerçeveler ve Mimariler
- check_circle SimCLR: Google Brain'in geliştirdiği basit ama güçlü çerçeve. Büyük batch boyutu ve projeksiyon başlığı ile yüksek performans elde eder.
- check_circle MoCo: Facebook AI'ın momentum kontrast yöntemi. Hafıza kuyruğu (memory queue) ile daha küçük batch boyutlarında çalışır.
- check_circle BYOL: Bootstrap Your Own Latent — negatif örneklere gerek duymadan çalışan yenilikçi çerçeve. Online ve target ağ mimarisi kullanır.
- check_circle CLIP: OpenAI'ın görüntü-metin çiftleriyle eğittiği model. Sıfır-atımlı transfer öğrenmede çığır açtı.
Uygulama Alanları
- check_circle Görüntü sınıflandırma ve nesne tanıma ön-eğitimi
- check_circle Metin ve cümle benzerliği (semantic textual similarity)
- check_circle Çok modlu öğrenme: görüntü-metin, ses-metin eşleştirme
- check_circle Tıbbi görüntüleme: az etiketli veriyle hastalık tespiti
- check_circle Öneri sistemleri: kullanıcı-ürün gömme öğrenimi
- check_circle Grafik verileri üzerinde düğüm sınıflandırma
Öne Çıkan Çerçeveler
SimCLR (Google, 2020)
Görsel gömme; veri artırma çiftleri; büyük batch boyutu ve projeksiyon kafası; kendi kendine denetimli öğrenmenin mihenk taşı
MoCo (Facebook, 2020)
Momentum Contrast; büyük negatif anahtar havuzu; küçük batch'te SimCLR'dan daha verimli
CLIP (OpenAI, 2021)
Metin-görsel çapraz modal; 400M çift; sıfır-atış görüntü sınıflandırma; modern multimodal AI'nın temel taşı
BYOL / SimSiam
Negatif örnek gerektirmeden contrastive; öğretmen-öğrenci ağı; yüksek kaliteli temsil öğrenimi
Contrastive Learning ile Supervised Learning Karşılaştırması
- check_circle Etiket İhtiyacı: Supervised learning milyonlarca etiketli örnek gerektirir; contrastive learning etiket olmadan veri örüntülerini öğrenir
- check_circle Genel Temsil: Contrastive öğrenilen temsiller birden fazla aşağı görev için kullanılabilir; supervised model göreve özelleşir
- check_circle Veri Verimliliği: Az etiketli veriyle ince ayar (semi-supervised); ImageNet'te %1 etiketle %70+ top-1 doğruluğa ulaşılabiliyor
- check_circle Hesaplama Maliyeti: Büyük batch veya negatif havuzu gerektirir; tek GPU'da SimCLR eğitimi pratik değil — MoCo / BYOL alternatif
- check_circle Modalite Esnekliği: Herhangi bir veri türüne uygulanabilir; metin, ses, görsel, moleküler veri için farklı artırma stratejileri
Sık Sorulan Sorular
- check_circle Karşıtlıklı öğrenme ile denetimli öğrenme arasındaki temel fark nedir? Denetimli öğrenme etiketli veriye ihtiyaç duyarken, karşıtlıklı öğrenme etiketsiz veriden kendi kendine eğitim sinyali üretir. Model, veri augmentasyonları aracılığıyla pozitif ve negatif çiftler oluşturur.
- check_circle Negatif çift sayısı neden önemlidir? Daha fazla negatif çift, modelin daha ayırt edici özellikler öğrenmesini sağlar. SimCLR'de büyük batch boyutu, MoCo'da ise memory queue bu ihtiyacı karşılar.
- check_circle BYOL neden negatif örnek kullanmadan çalışır? BYOL, online ve target olmak üzere iki ağ kullanır. Target ağ momentum ile güncellenir ve collapse riski batch normalization ve predictor başlığı ile önlenir.
- check_circle Karşıtlıklı öğrenme hangi veri tiplerinde kullanılabilir? Görüntü, metin, ses, zaman serisi ve grafik verileri dahil hemen hemen her veri tipinde uygulanabilir. Veri tipine özgü augmentasyon stratejileri gerektirir.