Generative AI (Üretken (Generatif) Yapay Zeka)

Var olan verilerden öğrenerek metin, görüntü, ses, video ve kod gibi özgün içerikler üretebilen yapay zeka modelleri ailesi.

Generatif yapay zeka (Generative AI), metin, görüntü, ses, video veya kod gibi orijinal içerik üretebilen yapay zeka sistemlerini tanımlar. Geleneksel yapay zeka sınıflandırma veya tahmin yaparken, generatif modeller eğitim verilerindeki örüntülerden yola çıkarak yeni ve özgün çıktılar oluşturur. Temel mimari aileler şunlardır: **Büyük Dil Modelleri (LLM)**, Transformer mimarisine dayanan ve metin üretiminde baskın olan modellerdir; ChatGPT, Claude ve Gemini bu kategoridedir. **Difüzyon modelleri**, gürültülü bir başlangıç noktasından başlayarak iteratif gürültü giderme işlemiyle yüksek kaliteli görüntü üretir; Stable Diffusion, DALL-E 3 ve Midjourney bu teknolojiyi kullanır. **GAN (Üretici Çekişmeli Ağ)**, bir üretici ve bir ayrıştırıcı ağın rekabetine dayanan eski nesil mimaridir; özellikle yüz sentezi ve stil transferinde kullanılmıştır. **VAE (Değişken Otoenkoder)**, latent uzayda yoğunluk tahmini yaparak yeni veri noktaları üretir. Uygulama alanları son derece geniştir: içerik üretimi (makale, pazarlama metni, kod), görsel üretim ve düzenleme, ses ve müzik sentezi, video üretimi, ilaç molekülü tasarımı, oyun varlık üretimi ve veri artırma. GitHub Copilot ve Cursor gibi araçlar generatif yapay zekayla yazılım geliştirmeyi dönüştürmektedir. Etik kaygılar da bu alanın ayrılmaz parçasıdır: telif hakkı ihlalleri (eğitim verilerinde izinsiz kullanılan içerikler), deepfake ve dezenformasyon üretimi, sanatçı ve içerik üreticilerinin geçim kaynakları üzerindeki baskı. AB AI Act kapsamında yüksek riskli olarak değerlendirilen bazı generatif AI uygulamaları düzenleyici denetim altına girmektedir. Piyasa ekosistemi hızla olgunlaşmaktadır: OpenAI (GPT-4o, DALL-E, Sora), Anthropic (Claude), Google (Gemini, Imagen), Meta (Llama, Make-A-Video), Stability AI ve Midjourney gibi oyuncular hem kapalı hem açık kaynak modeller sunmaktadır. 2024-2026 döneminde çok modlu (metin + görüntü + ses + video) modeller ön plana çıkmış; küçük ama güçlü modeller (SLM) sınırlı kaynaklarda yerel çalıştırma imkânı sunmaktadır.