tag Gizlilik
Bu sayfada Gizlilik etiketi ile işaretlenmiş 6 yapay zeka kavramını bulabilirsiniz.
GDPR (General Data Protection Regulation — Genel Veri Koruma Tüzüğü), 25 Mayıs 2018'de yürürlüğe giren Avrupa Birliği veri koruma yasasıdır. AB'de yerleşik bireylerden veri toplayan ya da onlarla ilgili kararlar veren her kuruluşu — coğrafi konum fark etmeksizin — kapsamaktadır. Yapay zeka sistemleri için özel bir düzenleme olmasa da, kişisel veri işleyen her AI uygulamasını doğrudan etkiler. Madde 22, kişileri yalnızca otomatik işleme dayanan ve önemli sonuçlar doğuran kararlardan korur; bu, kredi skorlama, iş başvurusu değerlendirmesi veya sigorta fiyatlandırması yapan AI sistemlerinin insan denetimine açık olmasını zorunlu kılar. GDPR yedi temel ilke üzerine kuruludur: hukuka uygunluk ve şeffaflık, amaç sınırlılığı, veri minimizasyonu, doğruluk, depolama sınırlılığı, bütünlük ve gizlilik, hesap verebilirlik. İhlaller durumunda yıllık küresel ciron yüzde dördüne veya 20 milyon Euro'ya — hangisi yüksekse — kadar para cezası uygulanabilir. Türkiye'nin 2016'da çıkardığı KVKK (Kişisel Verilerin Korunması Kanunu) GDPR'a büyük ölçüde paralel bir yapıya sahiptir.
GDPR (Genel Veri Koruma Tüzüğü)
GDPR (General Data Protection Regulation — Genel Veri Koruma Tüzüğü), 25 Mayıs 2018'de yürürlüğe giren Avrupa Birliği veri koruma yasasıdır. AB'de yerleşik bireylerden veri toplayan ya da onlarla ilgili kararlar veren her kuruluşu — coğrafi konum fark etmeksizin — kapsamaktadır. Yapay zeka sistemleri için özel bir düzenleme olmasa da, kişisel veri işleyen her AI uygulamasını doğrudan etkiler. Madde 22, kişileri yalnızca otomatik işleme dayanan ve önemli sonuçlar doğuran kararlardan korur; bu, kredi skorlama, iş başvurusu değerlendirmesi veya sigorta fiyatlandırması yapan AI sistemlerinin insan denetimine açık olmasını zorunlu kılar. GDPR yedi temel ilke üzerine kuruludur: hukuka uygunluk ve şeffaflık, amaç sınırlılığı, veri minimizasyonu, doğruluk, depolama sınırlılığı, bütünlük ve gizlilik, hesap verebilirlik. İhlaller durumunda yıllık küresel ciron yüzde dördüne veya 20 milyon Euro'ya — hangisi yüksekse — kadar para cezası uygulanabilir. Türkiye'nin 2016'da çıkardığı KVKK (Kişisel Verilerin Korunması Kanunu) GDPR'a büyük ölçüde paralel bir yapıya sahiptir.
Machine Unlearning (Makine Unutturma)
Machine Unlearning, bir yapay zeka modelinin belirli eğitim verilerini, tüm modeli sıfırdan eğitmek zorunda kalmaksızın 'unutmasını' sağlayan yöntemler bütünüdür. Kavram, GDPR'nin 17. Maddesi olarak bilinen 'Silinme Hakkı' (Right to Erasure) ile doğrudan örtüşmektedir: bir kullanıcı verilerinin silinmesini talep ettiğinde, bu verinin model parametrelerine ne ölçüde işlendiği ve nasıl çıkarılacağı kritik bir uyum sorununa dönüşmektedir. Geleneksel yaklaşımda tek çözüm modeli baştan eğitmektir. GPT-4 veya Gemini gibi büyük dil modellerini sıfırdan eğitmek haftalar ve milyonlarca dolar gerektirdiğinden bu yol pratikte imkânsızdır. Machine Unlearning bu boşluğu kapatmaya çalışır. Teknik olarak iki ana yaklaşım mevcuttur: Exact Unlearning (Kesin Unutturma) ve Approximate Unlearning (Yaklaşık Unutturma). Exact Unlearning'in en tanınan yöntemi SISA Training'dir (Sharded, Isolated, Sliced, Aggregated). Bu teknikte eğitim verisi bağımsız parçalara bölünür; her parçanın kendi alt modeli olduğundan yalnızca ilgili parça yeniden eğitilir ve istenen veri kesin biçimde dışarıda bırakılabilir. Approximate Unlearning ise hedeflenen parametreleri gradyan güncellemeleriyle değiştirerek daha hızlı bir çözüm sunar; ancak verinin gerçekten unutulup unutulmadığının doğrulanması güçtür. 2024 yılında İtalyan Veri Koruma Kurumu, GDPR ihlalleri gerekçesiyle OpenAI'a 15 milyon Euro para cezası keserken Avrupa Veri Koruma Kurulu (EDPB) 2025'te silinme hakkına odaklanan Koordineli Uygulama Çerçevesi'ni başlattı. Bu düzenleyici baskılar Machine Unlearning'i yalnızca akademik bir araştırma konusu olmaktan çıkarıp kurumsal uyum için zorunlu bir araç hâline getirdi. 2025 yılında UC Riverside araştırmacıları, orijinal eğitim verisine gerek duymadan çalışan 'kaynak serbest unutturma' (source-free unlearning) yöntemini geliştirdi. Bu yaklaşım özellikle büyük ölçekli modeller için umut vericidir. Bununla birlikte, büyük dil modellerinde bilginin milyarlarca parametreye dağıtılmış biçimde depolanması nedeniyle tam ve doğrulanabilir unutturma sağlamak hâlâ açık bir araştırma problemi olmayı sürdürmektedir.
Ollama (Yerel LLM Çalıştırıcı)
Ollama, büyük dil modellerini yerel bilgisayarda tek komutla indirip çalıştırmayı sağlayan açık kaynaklı bir araçtır. Docker'ın konteyner mantığını yapay zeka modellerine uyarlayan Ollama, karmaşık Python ortamı veya GPU sürücüsü kurulumu gerektirmeksizin `ollama run llama3` gibi sade bir komutla model çıkarımını başlatır. Ollama, GGUF formatını birincil model formatı olarak benimseyerek CPU ve Apple Silicon (Metal API) üzerinde optimize çalışma sağlar. Llama 3, Mistral, Phi-3, Qwen 2.5, Gemma 2 ve DeepSeek-R1 dahil onlarca modelin resmi ve topluluk sürümleri Ollama model kütüphanesinde mevcuttur. `ollama pull` komutuyla istenen model otomatik olarak indirilir ve çalışmaya hazır hale gelir. Ollama'nın önemli özelliklerinden biri yerel OpenAI uyumlu REST API sunmasıdır. `http://localhost:11434/v1/chat/completions` adresi üzerinden OpenAI istemci kütüphaneleri, LangChain ve Open WebUI gibi araçlar doğrudan yerel modele yönlendirilebilir; bu da mevcut uygulamaların bulut AI'dan yerel AI'ya minimum kod değişikliğiyle geçişini mümkün kılar. Gizlilik açısından Ollama, verilerin hiçbir zaman dış sunuculara gönderilmediği garantisini sağlar. Tıbbi kayıtlar, hukuki belgeler veya şirket içi hassas verilerle çalışan kullanıcılar için bu özellik kritik bir avantajdır. Ayrıca internet bağlantısı kesildiğinde bile model çalışmaya devam eder. Modelfile sistemi ile modeller özelleştirilebilir: sistem promptu, sıcaklık ve bağlam penceresi gibi parametreler Dockerfile benzeri bir sözdizimle tanımlanır ve özel ağırlık setleriyle birleştirilerek paylaşılabilir özel modeller oluşturulur.
Data Masking Nedir? Veri Maskeleme Teknikleri ve Kullanım Alanları (Veri Maskeleme)
Veri maskeleme (data masking ya da veri gizleme), hassas ya da kişisel nitelikteki gerçek verilerin yerine işlevsel ama tanımlanamaz sahte veriler koyma tekniğidir. Amaç, veri setinin yapısal, istatistiksel ve biçimsel özelliklerini korurken bireysel kayıtların gerçek kişi ya da kurumlarla ilişkilendirilmesini olanaksız kılmaktır. Test ve geliştirme ekipleri, verinin gerçekliğini korumak zorunda kalmadan üretim ortamına yakın bir veri kümesiyle çalışabilir; böylece gizlilik sızıntısı riski büyük ölçüde azalır. GDPR ve Türkiye KVKK gibi veri koruma mevzuatları, kişisel verinin üçüncü taraflarla paylaşılmasını ya da farklı amaçlarla işlenmesini kısıtlar. Veri maskeleme, bu yasal gerekliliklerin karşılanmasında teknik bir araç olarak öne çıkar: düzgün maskelenmiş veri, artık kişisel veri sayılmayabileceğinden GDPR kapsamındaki koruyucu yükümlülükler hafifler. Nitekim AB Veri Koruma Kurulları, veri maskelemeyi anonimleştirme veya takma adlandırma (pseudonymisation) tekniklerinden biri olarak değerlendirir. Yapay zeka ve makine öğrenmesi alanında veri maskeleme, model eğitim süreçlerinde kritik bir rol üstlenir. Sağlık, finans ve perakende sektörlerinde gerçek müşteri ya da hasta verisinin üçüncü taraf araştırmacılara veya ML mühendislerine açılması yasal olarak mümkün olmayabilir. Bu durumda maskeli veri setleri, modellerin gerçekçi desenleri öğrenmesini sağlarken gizlilik riskini ortadan kaldırır. Büyük dil modellerinin fine-tuning süreçlerinde de hassas kurumsal veriler maskelenerek model, kurumun yazım stili veya domain bilgisini öğrenir; ancak gerçek PII (kişiyi tanımlayan bilgi) asla modele dahil edilmez.
Data Minimization (Veri Minimizasyonu)
Veri Minimizasyonu (Data Minimization), bir sistem veya uygulamanın yalnızca belirtilen amacı gerçekleştirmek için zorunlu olan minimum miktarda kişisel veriyi toplaması, işlemesi ve saklaması ilkesidir. Mahremiyet tasarımının (Privacy by Design) temel taşlarından biri olan bu ilke, "ne kadar fazla veri o kadar iyi" anlayışının tam tersidir: fazladan toplanan her veri hem bir güvenlik riski hem de etik bir sorumluluktur. GDPR (Genel Veri Koruma Yönetmeliği) Madde 5(1)(c) veri minimizasyonunu açıkça zorunlu kılar: veriler "amaca uygun, alakalı ve gerekli olanla sınırlı" olmalıdır. Türkiye'deki KVKK (Kişisel Verilerin Korunması Kanunu) da ölçülülük ilkesiyle aynı yükümlülüğü getirir. Bu yasal çerçeveler, amaca fazladan veri toplayan şirketler için ciddi para cezaları öngörür. Yapay zeka sistemleri için veri minimizasyonu özellikle kritiktir. Büyük dil modelleri ve öneri sistemleri varsayılan olarak her şeyi toplamaya eğilimlidir; bu eğilim hem amaç sapması (purpose creep) hem de mahremiyet ihlali riskini artırır. **Amaç sınırlama (purpose limitation)** ile birlikte çalışır: veriler yalnızca toplandığı amaç için kullanılabilir; başka bir model için yeniden işlenemez. Teknik uygulamada veri minimizasyonu birkaç stratejiyle hayata geçirilir. **Özellik seçimi (feature selection)**: makine öğrenimi modelini eğitmek için gerekli olmayan özellikler eğitim verisine dahil edilmez. **Veri anonimleştirme ve takma adlandırma (pseudonymization)**: tanımlayıcı alanlar hash veya token ile değiştirilerek kişiyle bağ koparılır. **Diferansiyel gizlilik (differential privacy)**: toplam istatistikler gürültü eklenerek paylaşılır; bireysel kayıtlar çıkarılamaz. **Saklama süresi sınırlaması**: gereksiz hale gelen veriler otomatik olarak silinir. Veri minimizasyonuna karşı çıkan yaygın argüman "veri değerlidir, ileride işe yarayabilir"dir. Ancak bilinmeyen gelecekteki değer için bugünkü gizlilik riski ve depolama maliyeti üstlenmek rasyonel değildir. Gerçek değer, iyi tanımlanmış amaçlara odaklanmış yüksek kaliteli veriden gelir — hacimden değil.
Open WebUI (Open WebUI)
Open WebUI, Ollama ve OpenAI uyumlu API'ler aracılığıyla yerel büyük dil modellerine erişmek için kendi sunucunuzda barındırabileceğiniz açık kaynaklı bir web arayüzüdür. ChatGPT benzeri bir deneyimi tamamen özel ortamda sunan Open WebUI; konuşma geçmişi, model yönetimi, RAG pipeline desteği ve çoklu kullanıcı özellikleriyle öne çıkar. Açık kaynak yapay zeka araçlarının popülerleşmesiyle birlikte kullanıcılar, verilerini üçüncü taraf bulut servislerine göndermeden güçlü dil modellerinden yararlanmak istemeye başladı. Open WebUI bu ihtiyaca yanıt veren en kapsamlı self-hosted çözümlerden biridir. Proje, 2023 yılında başlayarak kısa sürede GitHub'da on binlerce yıldız topladı ve aktif bir topluluk desteğiyle gelişmeye devam etmektedir. Teknik açıdan Open WebUI; Docker konteyneri olarak çalışır ve Ollama aracılığıyla Llama, Mistral, Gemma gibi yerel modellere; OpenAI API anahtarıyla da GPT serilerine bağlanabilir. Arayüz; sohbet geçmişini yerel veritabanında saklar, farklı modeller arasında anlık geçiş yapılmasına izin verir ve kullanıcı başına ayrı profil yönetimi sunar. Bunlara ek olarak, PDF ve web sayfalarını bilgi tabanına ekleyerek model yanıtlarını zenginleştiren bir RAG (Retrieval-Augmented Generation) motoru da yerleşik olarak gelir. Veri gizliliği açısından Open WebUI kritik bir avantaj taşır: tüm sohbet içerikleri ve belgeler kullanıcının kendi altyapısında kalır. Türkiye'deki şirketler, KVKK kapsamında kişisel veri içeren sorguları bulut tabanlı yapay zeka servislerine göndermekten kaçınmak için Open WebUI gibi yerel çözümlere yönelmektedir. Özellikle hukuk, sağlık ve finans sektöründe bu tür gizlilik gereksinimleri belirleyici olmaktadır. Kurulum açısından bakıldığında, Docker yüklü herhangi bir Linux sunucusu veya macOS makinesi üzerinde tek bir komutla çalıştırılabilmesi Open WebUI'yi erişilebilir kılar. GPU desteği isteğe bağlıdır; CPU üzerinde çalışan küçük modeller düşük donanımlı ortamlarda da kullanılabilir. Bu esneklik, bireylerin kişisel bilgisayarlarından kurumsal veri merkezlerine kadar geniş bir dağıtım yelpazesini kapsar.