Makine Öğrenmesi Nasıl Çalışır?
Süreç dört adımda ilerler: veri toplama, model eğitimi, değerlendirme ve dağıtım. Eğitim aşamasında model, tahminleri ile gerçek değerler arasındaki farkı ölçen bir kayıp fonksiyonunu minimize etmeye çalışır. Gradyan inişi (gradient descent) algoritması, bu kaybı azaltacak yönde parametreleri adım adım günceller; sinir ağlarında bu güncellemeyi geri yayılım (backpropagation) hesaplar. Örneğin ev fiyatı tahmin eden bir model, 10.000 satış kaydındaki metrekare, konum ve oda sayısı gibi özelliklerden fiyatla ilişkiyi katsayılar halinde öğrenir. Eğitim bittikten sonra model, hiç görmediği test verisiyle sınanır; buradaki başarı genelleme yeteneğini gösterir. Eğitim verisinde yüzde 99, test verisinde yüzde 70 doğruluk alan bir model ezber yapmış (aşırı uyum) demektir. Çapraz doğrulama (k-fold cross validation), sınırlı veriyle çalışırken bu ölçümü güvenilir kılan standart tekniktir.
Öğrenme Paradigmaları
- check_circle Denetimli Öğrenme (Supervised): Etiketli girdi-çıktı çiftleriyle eğitim; sınıflandırma ve regresyon görevlerinin temelidir. Spam filtresi, kredi skoru ve hastalık teşhisi tipik örneklerdir.
- check_circle Denetimsiz Öğrenme (Unsupervised): Etiketsiz verideki gizli yapıyı keşfeder; k-means kümeleme ve PCA boyut indirgeme en bilinen yöntemlerdir. Müşteri segmentasyonunda yaygındır.
- check_circle Pekiştirmeli Öğrenme (Reinforcement): Ajan, çevreyle etkileşerek ödülü maksimize eden politikayı deneme-yanılma ile bulur. AlphaGo, robotik kontrol ve LLM'lerin RLHF ince ayarı bu paradigmayı kullanır.
- check_circle Öz-Denetimli Öğrenme (Self-Supervised): Etiket verinin kendisinden üretilir; GPT ve Claude gibi büyük dil modellerinin ön eğitimi sonraki kelimeyi tahmin ederek bu yöntemle yapılır.
- check_circle Yarı Denetimli Öğrenme (Semi-Supervised): Az etiketli ve bol etiketsiz veriyi birlikte kullanır; tıbbi görüntüleme gibi etiketlemenin pahalı olduğu alanlarda maliyeti düşürür.
Makine Öğrenmesi Algoritma Türleri
regresyon Doğrusal / Lojistik Regresyon
Sayısal tahmin ve ikili sınıflandırmanın temel taşı; hızlı, yorumlanabilir ve çoğu projede ilk denenen başlangıç modelidir.
karar-agaci Karar Ağaçları
Veriyi evet/hayır sorularıyla dallara ayırır; kararın gerekçesi insan tarafından okunabilir, bu yüzden bankacılıkta tercih edilir.
orman Rastgele Orman
Yüzlerce karar ağacının oylamasını birleştiren topluluk yöntemi; tek ağacın ezber riskini düşürür, tablo verisinde güçlüdür.
gradyan Gradyan Artırma (XGBoost, LightGBM)
Ağaçları hataları düzelte düzelte sırayla ekler; Kaggle yarışmalarında tablo verisi için 2026'da hâlâ en çok kazanan aile.
svm Destek Vektör Makineleri
Sınıfları maksimum marjlı hiper düzlemle ayırır; küçük ama yüksek boyutlu veri setlerinde etkilidir.
sinir-agi Yapay Sinir Ağları
Çok katmanlı yapılarıyla derin öğrenmenin temelidir; görüntü, ses ve metin gibi yapılandırılmamış veride rakipsizdir.
Makine Öğrenmesi ile Derin Öğrenme Arasındaki Fark
Derin öğrenme, makine öğrenmesinin çok katmanlı yapay sinir ağları kullanan alt kümesidir; yani her derin öğrenme modeli bir ML modelidir, tersi doğru değildir. Pratik fark üç noktada toplanır. Birincisi özellik mühendisliği: klasik ML'de mühendis, ham veriden anlamlı öznitelikleri (örneğin bir görüntüdeki kenar sayısını) elle çıkarır; derin öğrenme bu temsilleri katmanları içinde kendisi öğrenir. İkincisi veri ve donanım iştahı: XGBoost birkaç bin satırla iyi sonuç verirken, GPT ölçeğindeki modeller trilyonlarca token ve binlerce GPU ister. Üçüncüsü yorumlanabilirlik: lojistik regresyonun katsayıları okunabilirken, milyarlarca parametreli bir transformer kara kutuya yakındır. Seçim veri tipine bağlıdır: tablo halindeki müşteri verisi için gradyan artırma çoğu zaman hem daha ucuz hem daha isabetlidir; görüntü, ses ve doğal dil işlemede ise derin öğrenme 2012'deki AlexNet'ten bu yana açık ara liderdir.
Makine Öğrenmesi Örnekleri: Günlük Hayattan Uygulamalar
- check_circle Öneri sistemleri: Netflix izlenme verisinden, Spotify dinleme geçmişinden kişisel öneri üretir; Netflix izlenen içeriğin yaklaşık yüzde 80'inin öneri motorundan geldiğini raporlar.
- check_circle Dolandırıcılık tespiti: Bankalar kart işlemlerini milisaniyeler içinde puanlar; alışılmadık konum-tutar kombinasyonları anomali modeliyle yakalanıp işlem bloklanır.
- check_circle Sağlık ve teşhis: Retina taramasından diyabetik retinopati, mamografiden meme kanseri tespiti gibi görevlerde derin öğrenme modelleri uzman radyolog düzeyinde doğruluğa ulaştı.
- check_circle Otonom sürüş ve sürüş destek: Tesla ve Waymo araçları; şerit, yaya ve trafik işaretini kamera görüntüsünden gerçek zamanlı tanıyan sinir ağlarıyla yol alır.
- check_circle Dil teknolojileri: Google Çeviri'nin nöral çevirisi, telefonlardaki konuşma tanıma ve ChatGPT benzeri sohbet botları tamamen makine öğrenmesi ürünüdür.
- check_circle E-ticaret ve fiyatlama: Trendyol ve Hepsiburada gibi platformlar talep tahmini, dinamik fiyatlama ve stok optimizasyonunda ML modellerini üretimde çalıştırır.
Sık Sorulan Sorular
- check_circle Makine öğrenmesi nedir, kısaca nasıl tanımlanır?: Makine öğrenmesi, bilgisayarların açık kural programlanmadan verilerden örüntü öğrenerek tahmin ve karar üretmesini mümkün kılan yapay zeka dalıdır; sistem örneklerden öğrenir, kuralları kendisi çıkarır.
- check_circle Makine öğrenmesi ile yapay zeka aynı şey mi?: Hayır. Yapay zeka şemsiye kavramdır; makine öğrenmesi onun veri odaklı alt dalı, derin öğrenme ise ML'in sinir ağı tabanlı alt kümesidir: YZ ⊃ ML ⊃ DL.
- check_circle Makine öğrenmesi ile derin öğrenme arasındaki fark nedir?: Derin öğrenme çok katmanlı sinir ağları kullanır ve özellik çıkarımını otomatikleştirir; klasik ML el ile özellik mühendisliği ister, daha az veri ve donanımla çalışır.
- check_circle Makine öğrenmesi öğrenmek için hangi dil ve kütüphaneler gerekir?: Fiili standart Python'dur; klasik ML için scikit-learn ve XGBoost, derin öğrenme için PyTorch veya TensorFlow/Keras öğrenilir. Temel istatistik ve lineer cebir bilgisi işi kolaylaştırır.
- check_circle Model eğitmek için ne kadar veri gerekir?: Klasik algoritmalar birkaç bin örnekle isabetli sonuç verebilir; derin öğrenme milyonlarca örnekten beslenir. Az veriyle transfer öğrenme veya veri artırma teknikleri kullanılır.
- check_circle Aşırı uyum (overfitting) nasıl önlenir?: Çapraz doğrulama, L1/L2 düzenlileştirme, dropout, erken durdurma ve daha fazla eğitim verisi temel çözümlerdir; amaç modelin ezber yerine genelleme yapmasıdır.