tag veri güvenliği

Bu sayfada veri güvenliği etiketi ile işaretlenmiş 18 yapay zeka kavramını bulabilirsiniz.

Veri güvenliği, yapay zeka sistemlerinin eğitim, çıkarım ve dağıtım süreçlerinde kullanılan verilerin yetkisiz erişim, sızıntı, bozulma veya kötüye kullanıma karşı korunmasına yönelik teknik ve organizasyonel önlemlerin bütünüdür. Geleneksel siber güvenlik kapsamından farklı olarak AI veri güvenliği, modele özgü saldırı yüzeyleri, eğitim verisi zehirleme ve model çıkarım saldırıları gibi ek tehdit vektörlerini de kapsamaktadır. AI sistemlerinde veri güvenliği üç temel katmanda incelenir. Birinci katman veri toplama ve depolamadır: hassas kişisel veriler, ticari sırlar veya kritik altyapı bilgileri içeren eğitim veri setleri şifreleme, erişim kontrolleri ve anonimleştirme teknikleriyle korunmalıdır. GDPR, KVKK ve CCPA gibi veri koruma düzenlemeleri bu katmanda uygulanır. İkinci katman model eğitimi sürecidir: eğitim verisi zehirleme (data poisoning) saldırılarında kötü niyetli aktörler eğitim setine zararlı örnekler ekleyerek modelin davranışını manipüle edebilir. Federe öğrenme (federated learning), diferansiyel gizlilik (differential privacy) ve güvenli çok taraflı hesaplama (secure multi-party computation) bu tehdide karşı geliştirilmiş teknik çözümlerdir. Üçüncü katman model çıkarımıdır: üye çıkarım saldırıları (membership inference attacks), bir veri noktasının eğitim setinde yer alıp almadığını tahmin etmeye çalışırken model kopyalama (model extraction) saldırıları modelin ağırlıklarını reverse-engineer etmeyi hedefler. Özellikle tıbbi ve finansal veri içeren modellerde bu saldırılar ciddi gizlilik ihlallerine yol açabilir. Homomorfik şifreleme (homomorphic encryption), verilerin şifreli halde işlenmesine olanak tanıyan ileri düzey bir tekniktir; bu sayede model sağlayıcı ham veriyi hiçbir zaman görmez. Federe öğrenme ise ham verinin merkezi bir sunucuya gönderilmesini engelleyerek yerel cihazlarda model güncelleme hesaplamalarının yapılmasına izin verir. AB Yapay Zeka Yasası (EU AI Act), yüksek riskli AI sistemleri için sıkı veri yönetişimi gereklilikleri öngörmektedir. Bu düzenleme, 2026 itibarıyla eğitim verisi kalitesi, belgeleme ve denetim izlerine yönelik zorunluluklar getirmektedir.

security

Data Loss Prevention (DLP) (Veri Kaybı Önleme)

Data Loss Prevention (DLP), bir kuruluşun hassas, gizli veya kritik verilerinin yetkisiz kişilerce ele geçirilmesini, dışarıya sızdırılmasını veya yanlışlıkla ifşa edilmesini engelleyen güvenlik teknolojileri ve süreçleri bütünüdür. DLP sistemleri, kişisel tanımlayıcı bilgiler (PII), finansal kayıtlar, ticari sırlar ve sağlık verileri gibi korunan verileri gerçek zamanlı olarak tespit eder, izler ve gerektiğinde bloke eder. Bir DLP çözümü tipik olarak üç katmanda çalışır: Ağ DLP (network DLP), e-posta ve web trafiği gibi veri akışlarını uçta denetler. Uç nokta DLP (endpoint DLP), kullanıcının bilgisayar, dizüstü bilgisayar veya mobil cihazındaki veri hareketlerini takip eder. Bulut DLP ise SaaS uygulamaları ve bulut depolama ortamlarındaki veriyi korur. Modern DLP çözümleri makine öğrenimi ve doğal dil işleme teknolojilerini entegre ederek içerik analizi doğruluğunu önemli ölçüde artırmıştır. Geleneksel kural tabanlı yaklaşımlar yalnızca belirli kalıpları (kredi kartı numarası gibi) tanırken, yapay zeka destekli DLP sistemleri bağlamı anlayarak bağlamsal anomalileri, içeriden tehdit belirtilerini ve gizlenmiş veri sızdırma girişimlerini de tespit edebilmektedir. DLP kullanım amacına göre üç ana kategoriye ayrılır: Uyumluluk odaklı DLP (GDPR, HIPAA, PCI-DSS, SOX gibi yasal zorunlulukları karşılamak için), fikri mülkiyet koruma odaklı DLP (kaynak kod, tasarım dosyaları ve Ar-Ge belgelerini korumak için) ve içeriden tehdit yönetimi odaklı DLP (kazara veya kasıtlı çalışan kaynaklı sızdırmaları engellemek için). DLP politikaları genellikle veri sınıflandırması (data classification) ile birlikte çalışır: veriler hassasiyet düzeyine göre etiketlenir (gizli, kısıtlı, kamuya açık), DLP motor bu etiketlere ve içerik kurallarına göre izin ver / uyar / engelle kararı verir. Yapay zeka destekli DLP çözümleri, kullanıcı davranışı analitiği (UBA/UEBA) ile entegre edilerek normal sapma örüntülerini de tespit edebilmektedir.

arrow_forward
pest_control

Data Poisoning (Veri Zehirlenmesi)

Veri zehirlenmesi (data poisoning), kotu niyetli bir aktoru tarafindan bir makine ogrenimi modelinin egitim verisine yaniltici, manipule edilmis veya kasitli olarak hataligandi ornekler enjekte ederek modelin istenen davranisinin bozulmaya calisilmasi saldirisidur. Saldiri, model egitilmeden once veri toplama veya veri isleme asamasinda gerceklesebilir; bu nedenle tespit etmesi diger saldiri turlerine kiyasla daha zordur. Veri zehirlenmesi saldirisi iki temel hedeften birine yonelir. Genel performans degradasyonu saldirilarinda model, yuksek hata oranina sahip veya guvensiz bir sekle getirilir; rakip bir sirket veya devlet aktoru buna tesviklenebilir. Arka kapi (backdoor) saldirisinda ise model genel olarak dogru calisir ancak kotu niyetli aktoru tarafindan kontrol edilen belirli bir tetikleyici pattern goruldugunde belirli bir ciktiya zorunlu olarak yonlenir. Ornegin bir yuz tanima sistemine belirli renkteki gozluk takilan kisinin sistematik olarak yetkili gosterilmesi icin zehirli egitim ornekleri eklenebilir. Etiket manipulasyonu, saldirinin en basit bicimidir: dogru veri orneklerinin kasitli olarak yanlis etiketle egitim kumesine eklenmesidir. Saldiri kapalacak kadar az ornek bile etkili olabilir; arastirmalar egitim verisinin yuzde ucte birinin dahi bozulmasinin model davranisini kritik sekilde etkileyebildigini gostermistir. Federe ogrenme ortamlari ozel bir risk tasir. Merkezi bir sunucu yerine pek cok istemcinin model guncellemelerini gonderdigi bu ortamda kotu niyetli bir istemci, zehirli gradyanlar gondererek toplu modeli bozabilir. Byzantine-fault tolerant aggregation yontemleri bu riski azaltmak icin gelistirilmistir. Savunma perspektifinden bakildiginda, egitim veri kaynaklarinin dogrulanmasi ve veri temizleme (sanitization) birincil onlemlerdir. Diferansiyel gizlilik, bireysek orneklerin model uzerindeki etkisini sinirladigi icin zehirleme etkisini de azaltir. Model izleme ve anomali tespiti, egitimden sonra gercek zamanli davranissal anomalileri yakalamayi saglar. **Sik Sorulan Sorular** **Veri zehirlenmesi ile adversarial saldiri arasindaki fark nedir?** Veri zehirlenmesi egitim asamasini etkiler; adversarial saldiri ise cikarim asamasinda modele ozeltilmis yaniltici girdi gonderir. Ikisi farkli savunma mekanizmalari gerektirir. **Veri zehirlenmesi gercek dunyada kullanilmis midir?** Evet. Spam filtrelerinin zehirlenmesi, web tarama verisi manipulasyonu ve biyometrik sistemlere yonelik akademik gosterimler yayinlanmistir. Kritik altyapiya yonelik vakalar ise cogunlukla gizli kalir. **Kucuk veri kumeleri mi buyuk veri kumeleri mi daha savunmasizdir?** Kucuk veri kumeleri orantili olarak daha az ornek gerektirdiginden zehirlemeye daha duyarlidir. Buyuk veri kumeleri daha direnclidir; ancak izole egitim ve veri dogrulamak olmaksizin tam koruma saglamaz. **Acik kaynak veri setleri guvenli midir?** Dogrulanmamis acik kaynak veri setleri risk tasir; bu nedenle veri provenance (koken izleme) ve veri temizleme kritik onem tasir. ImageNet gibi genisletilmis dogrulamaya tabi veri setleri daha guvenilirdir.

arrow_forward
badge

Dijital Kişilik (Dijital Kişilik)

Dijital kişilik (İng. digital personhood), bir bireyin ya da yapay zeka sisteminin dijital ortamdaki kimlik, haklar ve sorumluluklar bağlamında nasıl tanımlandığını inceleyen hukuki ve felsefi kavramdır. İnternetin ve yapay zekanın gündelik yaşamı dönüştürdüğü bu dönemde, fiziksel dünyaya ait "kişilik" kavramı dijital uzama taşınmakta ve yeni sorular doğurmaktadır. Dijital kişilik iki temel boyutu kapsar. Birincisi, gerçek insanların dijital temsilleri — kullanıcı profilleri, çevrimiçi kimlikler, dijital ayak izi ve sosyal medya hesapları aracılığıyla oluşan "dijital benlik." Bu boyut; ölüm sonrası dijital miras (digital legacy), veri sahipliği ve kişisel verilerin silinme hakkı gibi pratik meseleleri de içerir. İkincisi, yapay zeka ajanları, sanal asistanlar ve otonom dijital varlıkların hukuki statüsü — "elektronik kişilik" (electronic personhood) olarak da bilinen bu alan, yapay zeka sistemlerinin haklara, sorumluluklara ya da hukuki statüye sahip olup olamayacağını sorgular. Avrupa Parlamentosu 2017 yılında robotlar ve yapay zeka sistemleri için "elektronik kişilik" statüsü önerisinde bulunarak bu tartışmayı hukuk arenasına taşıdı. Suudi Arabistan aynı yıl Sophia adlı robota vatandaşlık vererek konuyu uluslararası gündemin önüne çıkardı. Avrupa Birliği Yapay Zeka Yasası (EU AI Act) henüz yapay zekaya kişilik tanımasa da yüksek riskli sistemler için sorumluluk çerçevesi öngörerek dijital kişilik tartışmasına yasal zemin hazırlamaktadır. Dijital kişilik kavramı; algoritmik hesap verebilirlik, veri gizliliği, yapay zeka güvenliği ve etik tasarım gibi alanlarla doğrudan kesişmektedir. Önümüzdeki on yıllarda, yapay zekanın özerk karar alma kapasitesinin artmasıyla birlikte, dijital kişilik kavramının hukuki ve ahlaki anlamda somutlaşması beklenmektedir.

arrow_forward
vpn_lock

Federated Learning (Birleştirilmiş Öğrenme)

Federated learning (federe öğrenme), makine öğrenmesi modellerinin ham verileri merkezi bir sunucuya göndermek yerine, verilerin bulunduğu cihazlar üzerinde doğrudan eğitilmesini mümkün kılan gizlilik odaklı bir dağıtık öğrenme paradigmasıdır. Google tarafından 2017'de tanıtılan bu yaklaşım, her istemci cihazın kendi yerel verisiyle bir model güncellemesi (gradient veya model ağırlığı değişikliği) hesaplamasını ve yalnızca bu güncellemeyi merkezi bir koordinatöre göndermesini esas alır. Geleneksel makine öğrenmesinde tüm eğitim verisi tek bir merkezi sunucuda toplanır; bu durum hem gizlilik hem de veri sızıntısı riskleri doğurur. Federated learning ise bu problemi yapısal olarak çözer: ham veri hiçbir zaman cihazı terk etmez. Koordinatör sunucu yalnızca anonim gradyanları veya model parametrelerini alır, bunları FedAvg (Federated Averaging) gibi bir toplama algoritmasıyla birleştirir ve güncellenmiş global modeli tüm istemcilere dağıtır. Federated learning'in iki temel çeşidi vardır: yatay federated learning (aynı özellik uzayı, farklı veri örnekleri — örneğin farklı hastanelerden gelen aynı formattaki hasta kayıtları) ve dikey federated learning (farklı özellik uzayları, aynı kullanıcılar — örneğin bir bankanın işlem geçmişi ile bir e-ticaret sitesinin satın alma geçmişinin birleştirilmesi). Bu yapı, GDPR ve HIPAA gibi veri koruma düzenlemelerine uyumu kolaylaştırır. Pratik uygulamalar arasında Google'ın Android klavye tahmini (Gboard), Apple'ın Siri ses tanıma kalitesi iyileştirmesi ve hastane ağlarında tıbbi görüntü analizi öne çıkar. İletişim verimliliği, heterojenik cihaz kapasiteleri (sistem heterojenliği) ve model zehirleme (model poisoning) saldırılarına karşı dayanıklılık, alanın aktif araştırma konularıdır. Diferansiyel gizlilik ve güvenli çok taraflı hesaplama teknikleri ile federated learning'in gizlilik garantisi daha da güçlendirilebilir. Bu kombinasyon, hassas sektörlerde (finans, sağlık, savunma) veri paylaşımı gerektirmeden yüksek kaliteli ortak modeller geliştirmeyi olanaklı kılmakta ve merkezileşme olmaksızın ölçeklenebilir yapay zeka ekosistemlerinin temelini atmaktadır.

arrow_forward
landscape

Grounding (Temellendirme)

Groundning (temellendirme), yapay zeka modellerinin ciktisini dogrulanabilir, gercek dunyayla uyumlu ve guvenilir bilgiye baglama surecidir. Buyuk dil modellerinin uretebilecegi yanlis, uydurma veya baskaliksiz bilgileri (halusinasyonlari) azaltmak icin uygulanan teknik ve mimarilerin genel adidir. Temel grounding yaklasımlari iki kategoride incelenir. Veri temelli grounding'da model, yanit uretirken harici bilgi kaynagina (belge, veri tabani, web araması) erisir ve yaniti bu kaynaklara dayandirır. RAG (Retrieval-Augmented Generation) bu kategorinin en yaygin ornekidir. Agis temelli grounding'da ise modele yanit olustururken kullanilacak referans belgeler veya baglam dogrudan saglanir. Yer ismi ve olgular bağlaminda grounding, adlarin gercek nesnelere veya kavramlara baglınmasıdır. Ornegin 'Paris' ifadesi, soyut bir karakter yerine gercekten Fransa'nin baskentine baglanmalidir. Bu tur grounding, entity linking ve bilgi grafigi entegrasyonu araciligiyla gerceklestirilir. Google gibi arama motorlari, Gemini modeline arama sonuçlarına erisim vererek grounding saglar. Bing Chat, sonuclari sitemize gonullu baglantılarla referans gostererek kaynak temelli dogrulama saglamaktadir. Azure AI Grounding API, kurumsal uygulamalarda modele spesifik belge kümelerine erisim saglanarak denetimli grounding gerceklestirilmesine olanak tanir. Grounding, oz-tutarlilik ile cakisir: model, birbiriyle cakisan iki yanit verdigi zaman ikisi de tutarli kabul edilemez. Grounding metrikleri arasinda RARR (Retrieval Augmented Revision and Rephrasing), QAGS ve Attribution Score gibi yontemler bulunmaktadir.

arrow_forward
delete_forever

Machine Unlearning (Makine Unutturma)

Machine Unlearning, bir yapay zeka modelinin belirli eğitim verilerini, tüm modeli sıfırdan eğitmek zorunda kalmaksızın 'unutmasını' sağlayan yöntemler bütünüdür. Kavram, GDPR'nin 17. Maddesi olarak bilinen 'Silinme Hakkı' (Right to Erasure) ile doğrudan örtüşmektedir: bir kullanıcı verilerinin silinmesini talep ettiğinde, bu verinin model parametrelerine ne ölçüde işlendiği ve nasıl çıkarılacağı kritik bir uyum sorununa dönüşmektedir. Geleneksel yaklaşımda tek çözüm modeli baştan eğitmektir. GPT-4 veya Gemini gibi büyük dil modellerini sıfırdan eğitmek haftalar ve milyonlarca dolar gerektirdiğinden bu yol pratikte imkânsızdır. Machine Unlearning bu boşluğu kapatmaya çalışır. Teknik olarak iki ana yaklaşım mevcuttur: Exact Unlearning (Kesin Unutturma) ve Approximate Unlearning (Yaklaşık Unutturma). Exact Unlearning'in en tanınan yöntemi SISA Training'dir (Sharded, Isolated, Sliced, Aggregated). Bu teknikte eğitim verisi bağımsız parçalara bölünür; her parçanın kendi alt modeli olduğundan yalnızca ilgili parça yeniden eğitilir ve istenen veri kesin biçimde dışarıda bırakılabilir. Approximate Unlearning ise hedeflenen parametreleri gradyan güncellemeleriyle değiştirerek daha hızlı bir çözüm sunar; ancak verinin gerçekten unutulup unutulmadığının doğrulanması güçtür. 2024 yılında İtalyan Veri Koruma Kurumu, GDPR ihlalleri gerekçesiyle OpenAI'a 15 milyon Euro para cezası keserken Avrupa Veri Koruma Kurulu (EDPB) 2025'te silinme hakkına odaklanan Koordineli Uygulama Çerçevesi'ni başlattı. Bu düzenleyici baskılar Machine Unlearning'i yalnızca akademik bir araştırma konusu olmaktan çıkarıp kurumsal uyum için zorunlu bir araç hâline getirdi. 2025 yılında UC Riverside araştırmacıları, orijinal eğitim verisine gerek duymadan çalışan 'kaynak serbest unutturma' (source-free unlearning) yöntemini geliştirdi. Bu yaklaşım özellikle büyük ölçekli modeller için umut vericidir. Bununla birlikte, büyük dil modellerinde bilginin milyarlarca parametreye dağıtılmış biçimde depolanması nedeniyle tam ve doğrulanabilir unutturma sağlamak hâlâ açık bir araştırma problemi olmayı sürdürmektedir.

arrow_forward
code_blocks

Model İnversion (Model İnversion Saldırısı)

Model inversion (model ters mühendisliği), bir makine öğrenimi modelinin çıktılarını analiz ederek orijinal eğitim verilerini yeniden oluşturmayı hedefleyen bir mahremiyet saldırısıdır. Saldırgan, güven skorlarını, sınıflandırma olasılıklarını veya gradyanları yinelemeli sorgu stratejileriyle işleyerek eğitim kümesindeki hassas bilgilere yaklaşır. İlk sistematik tanımı 2015 yılında Fredrikson ve ekibi tarafından gerçekleştirilmiştir. Araştırmacılar, bir farmakokinetik modeli tekrar tekrar sorgulayarak hastaya özgü genetik verileri başarıyla yeniden üretmiştir; aynı yöntemle yüz tanıma sistemlerinden bireylerin fotoğrafları sentezlenmiştir. Saldırının iki ana varyantı bulunur. Beyaz kutu (white-box) saldırısında saldırgan model ağırlıklarına ve mimarisine tam erişime sahiptir; gradyan tabanlı optimizasyon doğrudan uygulanarak eğitim verisine en yakın örnekler üretilir. Siyah kutu (black-box) saldırısında ise yalnızca API çıktısı kullanılır; Mirror Attack ve GAN destekli yöntemler yinelemeli sorgu yanıtlarını işleyerek veri dağılımını öğrenir. Yüksek riskli uygulama alanları arasında tıbbi görüntüleme sistemleri, biyometrik tanıma yazılımları ve kredi risk modelleri öne çıkmaktadır. Bu sistemlerde başarılı bir saldırı KVKK ve GDPR kapsamında ciddi ihlallere yol açabilir. Savunma stratejileri dört ana yöntemle özetlenir: (1) Diferansiyel gizlilik — model çıktılarına kalibreli Gaussian gürültüsü eklenerek hassas olasılık değerleri gizlenir; (2) Çıktı kısıtlama — yalnızca en yüksek olasılıklı etiket döndürülür, güven skoru paylaşılmaz; (3) Bilgi damıtma (knowledge distillation) — ham model yerine daha az bilgi sızdıran damıtılmış model servis edilir; (4) Adversarial regularization — eğitim sürecine ters mühendislik direnci eklenebilir. Avrupa Birliği Yapay Zeka Yasası, yüksek riskli AI sistemlerinde model inversion testini düzenleyici çerçeve içine dahil etmiştir.

arrow_forward
security

Model Inversion Attack (Model Tersine Mühendislik Saldırısı)

Model tersine mühendislik saldırısı (model inversion attack), bir makine öğrenimi modelinin eğitim verilerindeki hassas bilgileri, modelin tahminleri veya güven puanları aracılığıyla yeniden oluşturmayı hedefleyen bir gizlilik saldırısıdır. Saldırgan, modele sistematik sorgular göndererek elde ettiği çıktıları analiz eder ve bu çıktılardan geriye doğru çalışarak orijinal eğitim verilerini yaklaşık olarak tahmin etmeye çalışır. Bu saldırı türü, 2015 yılında Matthew Fredrikson ve ekibinin yayımladığı araştırmayla gündeme gelmiştir. Fredrikson, bir ilaç tavsiye sistemini hedef alan çalışmasında hastaların genomik profillerini yalnızca model çıktılarını gözlemleyerek kısmen yeniden oluşturabilmiştir. Aynı ekip daha sonraki çalışmalarında yüz tanıma modellerinden gerçek yüz görüntülerini geri kazanmayı başarmıştır. Saldırılar iki ana kategoride değerlendirilir. Beyaz-kutu (white-box) saldırılarında saldırgan model ağırlıklarına ve gradyanlarına doğrudan erişebilir; bu durum saldırıyı çok daha etkili kılar. Siyah-kutu (black-box) saldırılarında ise saldırgan yalnızca modele sorgu atabilir ve tahmin ile güven skoru alabilir; bu senaryo gerçek dünya koşullarını daha iyi yansıtır. Saldırının temel mekanizması gradyan bazlı optimizasyona dayanır: Saldırgan, modelin hedef sınıfa en yüksek güveni vermesini sağlayan girdiyi arayarak adım adım yaklaşık bir eğitim örneği oluşturur. Generative model inversion olarak adlandırılan gelişmiş varyantlarda ise GAN veya diffusion modeller yardımıyla daha gerçekçi gizli veriler üretilmektedir. Savunma yöntemleri arasında diferansiyel gizlilik (model çıktılarına istatistiksel gürültü ekleme), çıktı kısıtlama (yalnızca ham güven skoru yerine sınıf etiketi döndürme), bilgi damıtma ve gizlilik farkında eğitim sayılabilir. Sağlık, finans ve biyometrik kimlik doğrulama alanlarında bu saldırılara karşı sistematik savunma mekanizmaları oluşturmak kritik önem taşımaktadır.

arrow_forward
security_update_warning

Zero-Trust AI (Sıfır Güven Yapay Zeka)

Sıfır Güven Yapay Zeka (Zero-Trust AI), siber güvenlikteki "Hiçbir şeye güvenme, daima doğrula" (Zero Trust) felsefesinin yapay zeka modelleri, ajanlar ve veri hatları için uyarlanmış halidir. Temel ilke, bir AI sisteminin kullandığı verilere, aldığı komutlara ve hatta kendi ürettiği yanıtlara bile şüpheyle yaklaşmasıdır. Geleneksel güvenlik modelleri kurumsal ağın içindeki trafiğe güvenir; "iç ağ = güvenli" varsayımı üzerine kurulur. Zero Trust bu denklemi tamamen reddeder. Bulut ortamlarının, uzak çalışma modellerinin ve LLM tabanlı yapay zeka ajanlarının yaygınlaşmasıyla saldırı yüzeyi dramatik biçimde genişlemiş ve Zero Trust prensiplerini AI bağlamında zorunlu kılmıştır. Zero-Trust AI mimarisi dört temel katmandan oluşur. Girdi doğrulama, modelin aldığı her prompt'u kötü niyetli enjeksiyon girişimlerine karşı tarayan bir güvenlik duvarı modeli içerir. Yetkilendirme ve kimlik doğrulama, AI bileşenlerine yalnızca görev için gereken minimum izni verir; bu en az ayrıcalık prensibi prompt injection saldırılarının hasarını sınırlar. Çıktı denetimi ise modelin ürettiği yanıtı halüsinasyon, telif hakkı ihlali veya zararlı içerik açısından ikinci bir denetçi model tarafından kontrol eder. Sürekli izleme; her API çağrısını, araç kullanımını ve kullanıcı etkileşimini denetim izi oluşturmak için kaydeder ve anormal davranışları gerçek zamanlı olarak tespit eder. LLM güvenliği açısından Zero-Trust şunları kapsar: prompt injection ve jailbreak girişimlerine karşı giriş filtresi, ajan eylemlerinin kısıtlandığı mikro yetki sınırları, eğitim verisi bütünlüğünü kriptografik imzalarla kanıtlayan veri provenansı ve AI tedarik zincirindeki açık kaynak model ağırlıklarının doğrulanması. NIST AI Risk Management Framework (AI RMF 1.0) ve AB Yapay Zeka Yasası (EU AI Act), kurumsal AI sistemlerinde bu prensiplerin uygulanmasını yasal çerçevede destekler. Zero-Trust AI, tek başına bir ürün değil; risk odaklı tasarım felsefesidir. Özellikle finansal hizmetler, sağlık ve kritik altyapı gibi yüksek riskli sektörlerde AI sistemleri için vazgeçilmez güvenlik katmanını oluşturur.

arrow_forward
shield

Adversarial Examples (Düşmanca Örnekler)

Adversarial Examples (Düşmanca Örnekler), derin öğrenme modellerinin karar sınırlarındaki kırılgan noktaları istismar etmek amacıyla orijinal giriş verisine matematiksel olarak hesaplanmış küçük ama kasıtlı pertürbasyonlar eklenerek oluşturulan ve modelin yanlış sınıflandırma yapmasına ya da beklenmedik çıktı üretmesine yol açan özel saldırı girdileridir. Pertürbasyonlar çoğunlukla insan algı eşiğinin altında kalır; başka bir deyişle değiştirilmiş görüntü ya da metin insana özgün ile özdeş görünür, ancak model bunu tamamen farklı bir sınıf olarak sınıflandırır. Ian Goodfellow, Jonathon Shlens ve Christian Szegedy 2014 yılında yayımladıkları 'Explaining and Harnessing Adversarial Examples' başlıklı seminal çalışmada, Fast Gradient Sign Method (FGSM) ile herhangi bir görüntü üzerinde modelin kaybının gradyanı yönünde epsilon büyüklüğünde tek adımlık bir güncellemenin modeli yanıltmaya yettiğini gösterdi. Bu keşif, saldırı-savunma silahlanma yarışının fitilini ateşledi. Saldırı türleri iki temel eksende ayrılır. Gradient tabanlı beyaz kutu (white-box) saldırılar modelin ağırlıklarına tam erişimle çalışır: FGSM tek adımlı ve hızlıdır; Projected Gradient Descent (PGD) yinelemeli ve çok daha güçlüdür; Carlini & Wagner (C&W) en küçük pertürbasyon normuyla en yüksek yanıltma başarısını hedefler. Siyah kutu (black-box) saldırılar ise yalnızca model çıktısına erişimle tahmin saldırısı yapar; adversarial pertürbasyonların modeller arasında aktarılabilirliği (transferability) bu saldırıları pratikte tehlikeli kılar. Savunma yöntemlerinin başında adversarial training gelir: modeli adversarial örnekler de dahil edilerek yeniden eğitmek, bilinen saldırılara karşı dayanıklılığı artırır, ancak daha güçlü yeni saldırılara karşı yeterli olmayabilir. Certified defense yaklaşımları (Randomized Smoothing, interval bound propagation) matematiksel olarak kanıtlanmış dayanıklılık garantisi sunar; input preprocessing, feature squeezing ve detection-based yöntemler de kullanılan katmanlı savunma stratejileri arasındadır. Adversarial Examples artık sadece görüntü sınıflandırmasında değil, LLM jailbreak'inde, konuşma tanıma sistemlerinde, nesne tespitinde ve otonom araç algı sistemlerinde doğrudan güvenlik tehdidi oluşturmaktadır. NIST AI RMF ve AB Yapay Zeka Kanunu bu tür saldırılara karşı dayanıklılık gerekliliklerini çerçeveleyen düzenleyici belgeler arasındadır.

arrow_forward
security

Differential Privacy (Diferansiyel Gizlilik)

Diferansiyel Gizlilik (Differential Privacy), bir veri kümesi üzerinde yapılan sorguların veya istatistiksel hesaplamaların sonuçlarının, veri kümesindeki herhangi bir bireyin varlığından veya yokluğundan istatistiksel olarak ayırt edilemez hale gelmesini sağlayan matematiksel bir gizlilik çerçevesidir. 2006 yılında Cynthia Dwork tarafından formüle edilen bu yöntem, bireysel gizlilik güvencesi ile veri kullanışlılığını matematiksel olarak dengeler. Temel fikir, bir mekanizmanın çıktısına kontrollü miktarda rastgele gürültü ekleyerek bireysel veri noktalarının sorgularda iz bırakmasını önlemektir. Epsilon (ε) parametresi gizlilik bütçesini temsil eder: ε değeri küçüldükçe gizlilik artar ancak yanıtın doğruluğu azalır; ε büyüdükçe ise yanıtın doğruluğu artar ancak gizlilik zayıflar. Bu ödünleşim, uygulamanın gereksinimlerine göre dikkatle ayarlanmak zorundadır. İki ana varyant mevcuttur: Merkezi Diferansiyel Gizlilik (Central DP), güvenilir bir koordinatörün ham veriyi toplayıp gürültüyü merkezi olarak eklediği modeli kullanırken; Yerel Diferansiyel Gizlilik (Local DP) gürültünün her kullanıcının cihazında verisi sunucuya gönderilmeden önce eklendiği modeli benimser. Local DP, özellikle güvenilir bir merkezi tarafın bulunmadığı mobil ve IoT senaryolarında tercih edilir. Apple ve Google, iOS klavye ve Android telemetri verilerinde yerel diferansiyel gizliliği uygulamaktadır. ABD Nüfus Sayımı Bürosu, 2020 sayımında merkezi diferansiyel gizlilik kullandı. Yapay zeka dünyasında ise diferansiyel gizlilik, özellikle derin öğrenme modellerinin eğitiminde gizlilik koruyucu bir teknik olarak yerini sağlamlaştırmıştır; bu yaklaşım DP-SGD (Differentially Private Stochastic Gradient Descent) olarak bilinmektedir.

arrow_forward
privacy_tip

Membership Inference Attack (Üyelik Çıkarım Saldırısı)

Üyelik Çıkarım Saldırısı (Membership Inference Attack), bir saldırganın belirli bir veri noktasının makine öğrenimi modelinin eğitim kümesine dahil edilip edilmediğini tahmin etmeye çalıştığı gizlilik saldırısı türüdür. Bu saldırı yöntemi, ilk kez 2017 yılında Shokri ve arkadaşları tarafından IEEE Güvenlik ve Gizlilik sempozyumunda kapsamlı biçimde incelenmiş ve makine öğrenimi gizlilik araştırmalarının temel taşlarından biri haline gelmiştir. Saldırının temel çalışma prensibi, eğitim kümesine ait örneklerin modelin çıktılarında görülmemiş örneklerden farklı davranış sergilemesine dayanır. Aşırı öğrenme (overfitting) eğilimindeki modeller, eğitimde gördükleri verilere karşı çok daha yüksek güven skorları üretirken görmedikleri verilere karşı daha düşük ve dağınık olasılıklar verir. Saldırgan bu davranış farkını kullanarak bir 'gölge model' (shadow model) eğitir; bu model, hedef modeli taklit edecek şekilde halka açık verilerle oluşturulur ve ardından eğitim/test verilerini ayırt eden ikili bir sınıflandırıcı (üye/üye değil) eğitilir. Saldırının başarı oranı, hedef modelin aşırı öğrenme derecesiyle doğru orantılıdır. İyi düzenleştirilmiş (regularized) modellerde saldırı başarısı rastgele tahminin (%50) üzerine zar zor çıkarken, aşırı öğrenmiş modellerde %90'a ulaşabilir. Üyelik çıkarım saldırıları özellikle hassas kişisel verilerin eğitimde kullanıldığı senaryolarda kritik gizlilik tehditleri oluşturur. Tıbbi kayıtlar, finansal veriler veya kişisel iletişim verileriyle eğitilen modeller saldırıya maruz kaldığında bireysel sağlık bilgileri veya mali geçmiş deşifre olabilir. GDPR ve Türkiye'nin KVKK düzenlemeleri kapsamında bu tür gizlilik ihlalleri ciddi yasal yaptırımlarla sonuçlanabilir. Savunma yöntemleri arasında en güçlüsü diferansiyel gizlilik (differential privacy) tekniğidir; bu yöntem, model çıktılarına kontrollü gürültü ekleyerek bireysel veri noktalarını gizler. Bunun yanı sıra erken durdurma, L2 düzenlileştirme, etiket yumuşatma ve bilgi damıtma yöntemleri de model belleğini azaltarak saldırı yüzeyini önemli ölçüde daraltır. Bu saldırı türü, yapay zeka sistemlerinin uyumluluk denetiminde de önemli bir araç olarak kullanılmaktadır: denetçiler, sistemin eğitim verilerini ne kadar 'hatırladığını' ölçmek için üyelik çıkarım testleri uygulayarak hem model performansını hem de kişisel veri güvenliğini eş zamanlı olarak değerlendirebilir.

arrow_forward
security

Veri Güvenliği (AI Bağlamında)

Veri güvenliği, yapay zeka sistemlerinin eğitim, çıkarım ve dağıtım süreçlerinde kullanılan verilerin yetkisiz erişim, sızıntı, bozulma veya kötüye kullanıma karşı korunmasına yönelik teknik ve organizasyonel önlemlerin bütünüdür. Geleneksel siber güvenlik kapsamından farklı olarak AI veri güvenliği, modele özgü saldırı yüzeyleri, eğitim verisi zehirleme ve model çıkarım saldırıları gibi ek tehdit vektörlerini de kapsamaktadır. AI sistemlerinde veri güvenliği üç temel katmanda incelenir. Birinci katman veri toplama ve depolamadır: hassas kişisel veriler, ticari sırlar veya kritik altyapı bilgileri içeren eğitim veri setleri şifreleme, erişim kontrolleri ve anonimleştirme teknikleriyle korunmalıdır. GDPR, KVKK ve CCPA gibi veri koruma düzenlemeleri bu katmanda uygulanır. İkinci katman model eğitimi sürecidir: eğitim verisi zehirleme (data poisoning) saldırılarında kötü niyetli aktörler eğitim setine zararlı örnekler ekleyerek modelin davranışını manipüle edebilir. Federe öğrenme (federated learning), diferansiyel gizlilik (differential privacy) ve güvenli çok taraflı hesaplama (secure multi-party computation) bu tehdide karşı geliştirilmiş teknik çözümlerdir. Üçüncü katman model çıkarımıdır: üye çıkarım saldırıları (membership inference attacks), bir veri noktasının eğitim setinde yer alıp almadığını tahmin etmeye çalışırken model kopyalama (model extraction) saldırıları modelin ağırlıklarını reverse-engineer etmeyi hedefler. Özellikle tıbbi ve finansal veri içeren modellerde bu saldırılar ciddi gizlilik ihlallerine yol açabilir. Homomorfik şifreleme (homomorphic encryption), verilerin şifreli halde işlenmesine olanak tanıyan ileri düzey bir tekniktir; bu sayede model sağlayıcı ham veriyi hiçbir zaman görmez. Federe öğrenme ise ham verinin merkezi bir sunucuya gönderilmesini engelleyerek yerel cihazlarda model güncelleme hesaplamalarının yapılmasına izin verir. AB Yapay Zeka Yasası (EU AI Act), yüksek riskli AI sistemleri için sıkı veri yönetişimi gereklilikleri öngörmektedir. Bu düzenleme, 2026 itibarıyla eğitim verisi kalitesi, belgeleme ve denetim izlerine yönelik zorunluluklar getirmektedir.

arrow_forward
verified_user

Zero Trust Nedir? Sıfır Güven Güvenlik Mimarisi (Sıfır Güven Mimarisi)

Zero Trust (Sıfır Güven), "hiçbir zaman güvenme, her zaman doğrula" ilkesine dayanan modern bir siber güvenlik mimarisidir. Geleneksel güvenlik modelleri kurumsal ağ sınırlarının güvenli olduğunu varsayar ve iç trafiğe otomatik güvenirdi; ancak Zero Trust bu anlayışı kökten reddeder. Bu mimari, kullanıcıların, cihazların ve hizmetlerin ağ konumuna bakılmaksızın her erişim talebinin kimlik doğrulamasını ve yetkilendirilmesini zorunlu kılar. 2010 yılında Forrester Research analistlerinden John Kindervag tarafından kavramsallaştırılan Zero Trust, özellikle bulut bilişim, uzaktan çalışma ve yapay zeka sistemlerinin yaygınlaşmasıyla birlikte kritik bir güvenlik paradigması hâline gelmiştir. ABD federal hükümeti 2021 yılında Biden yönetiminin EO 14028 direktifiyle Zero Trust'ı ulusal siber güvenlik stratejisinin temeli olarak benimsemiştir. NIST SP 800-207 standardı mimarinin teknik gerekliliklerini belgelemektedir. Zero Trust'ın üç temel ilkesi şunlardır: birincisi, her kullanıcının, cihazın ve servisin kimliğini her seferinde açıkça doğrulama (Verify Explicitly); ikincisi, kullanıcılara yalnızca anlık görevleri için gereken minimum yetkileri verme (Least Privilege Access); üçüncüsü, ihlallerin kaçınılmaz olduğunu kabul edip bu görüşe göre mikrosegmentasyon ve sürekli izleme stratejileri geliştirme (Assume Breach). Yapay zeka sistemleri ve veri boru hatları açısından Zero Trust, model eğitimi verilerine erişimi kontrol etmek, inference API'larını güvence altına almak ve otomatik ajanların yetkisiz kaynaklara ulaşmasını önlemek için giderek daha fazla uygulanmaktadır. Çok faktörlü kimlik doğrulama (MFA), mikrosegmentasyon, sürekli izleme, şifreli iletişim ve kimlik tabanlı erişim denetimi (IAM/RBAC) bu mimarinin temel bileşenlerini oluşturur.

arrow_forward
security

Güvenlik Testi (AI) Nedir? Yapay Zeka Sistemlerinde Saldırı Testi (Güvenlik Testi (AI))

Güvenlik Testi (AI), makine öğrenmesi modelleri, büyük dil modelleri (LLM) ve yapay zeka ajanları gibi sistemlerin güvenlik açıklarını keşfetmeye yönelik yapılandırılmış bir test disiplinidir. Geleneksel yazılım güvenlik testinin aksine, AI güvenlik testi yalnızca ağ ve uygulama katmanlarını değil; eğitim verisini, çıkarım süreçlerini, model davranışını ve istem (prompt) yönetimini de kapsar. Bu alan iki temel bileşenden oluşur: güvenlik testi, yani AI sisteminin kötü niyetli saldırılara karşı korunması; ve emniyet testi, yani AI sisteminin istemeden zarar vermesinin önlenmesi. Her iki boyut da modern AI dağıtımları için zorunlu hâle gelmiştir. Temel test yöntemleri arasında prompt injection (modelin talimatlarını ele geçirme), veri zehirlenmesi (eğitim setini manipüle etme), model çıkarma (ağırlıkları kopyalama girişimi), tersine mühendislik ve üyeye ait çıkarım saldırıları yer alır. Kırmızı takım tatbikatları (red teaming), bu saldırı senaryolarını düşmansal bir perspektiften sistematik biçimde test eder. Endüstri standartları açısından MITRE ATLAS çerçevesi AI'ye özgü saldırı tekniklerini kataloglarken, OWASP LLM Top 10 (2025) büyük dil modelleri için kritik riskleri önceliklendirir. NIST AI 100-2e2025 belgesi ise standartlaştırılmış saldırı taksonomisi sunar. Düzenleyici baskılar da bu alanı hızlandırmaktadır: AB Yapay Zeka Yasası, yüksek riskli AI sistemleri için düzenli güvenlik değerlendirmesini zorunlu kılar. Bu durum, güvenlik testini teknik bir uygulama olmanın ötesinde yasal bir gereklilik hâline getirmektedir. AI güvenlik testi pazarı 2025'te 2,74 milyar dolar değerindeydi ve 2033'e kadar 6 milyar doları aşması beklenmektedir.

arrow_forward
🎭

Data Masking Nedir? Veri Maskeleme Teknikleri ve Kullanım Alanları (Veri Maskeleme)

Veri maskeleme (data masking ya da veri gizleme), hassas ya da kişisel nitelikteki gerçek verilerin yerine işlevsel ama tanımlanamaz sahte veriler koyma tekniğidir. Amaç, veri setinin yapısal, istatistiksel ve biçimsel özelliklerini korurken bireysel kayıtların gerçek kişi ya da kurumlarla ilişkilendirilmesini olanaksız kılmaktır. Test ve geliştirme ekipleri, verinin gerçekliğini korumak zorunda kalmadan üretim ortamına yakın bir veri kümesiyle çalışabilir; böylece gizlilik sızıntısı riski büyük ölçüde azalır. GDPR ve Türkiye KVKK gibi veri koruma mevzuatları, kişisel verinin üçüncü taraflarla paylaşılmasını ya da farklı amaçlarla işlenmesini kısıtlar. Veri maskeleme, bu yasal gerekliliklerin karşılanmasında teknik bir araç olarak öne çıkar: düzgün maskelenmiş veri, artık kişisel veri sayılmayabileceğinden GDPR kapsamındaki koruyucu yükümlülükler hafifler. Nitekim AB Veri Koruma Kurulları, veri maskelemeyi anonimleştirme veya takma adlandırma (pseudonymisation) tekniklerinden biri olarak değerlendirir. Yapay zeka ve makine öğrenmesi alanında veri maskeleme, model eğitim süreçlerinde kritik bir rol üstlenir. Sağlık, finans ve perakende sektörlerinde gerçek müşteri ya da hasta verisinin üçüncü taraf araştırmacılara veya ML mühendislerine açılması yasal olarak mümkün olmayabilir. Bu durumda maskeli veri setleri, modellerin gerçekçi desenleri öğrenmesini sağlarken gizlilik riskini ortadan kaldırır. Büyük dil modellerinin fine-tuning süreçlerinde de hassas kurumsal veriler maskelenerek model, kurumun yazım stili veya domain bilgisini öğrenir; ancak gerçek PII (kişiyi tanımlayan bilgi) asla modele dahil edilmez.

arrow_forward
code_blocks

Data Sovereignty (Veri Egemenliği)

Veri egemenliği (data sovereignty), verilerin toplandığı, depolandığı veya işlendiği coğrafi bölgenin yasal yetki alanına tabi olmasını ifade eder. Bu kavram; hangi ülkenin yasalarının veriye uygulandığını, kimin bu veriye erişebileceğini ve verilerin nasıl işlenebileceğini belirler. Yalnızca fiziksel depolama konumunu kapsayan veri yerleşikliği (data residency) kavramından farklı olarak veri egemenliği, hukuki denetim boyutunu da içerir. Yapay zeka modelleri milyarlarca veri noktasına dayandığından bu verilerin nerede barındırıldığı kritik önem taşır. Bir şirket ya da devlet verilerini yabancı bir sunucuda depoluyorsa, o sunucunun bulunduğu ülkenin yasal erişim hakları devreye girebilir. Bu durum ulusal güvenlik, ticari sır ve bireysel mahremiyet açısından ciddi riskler doğurabilir. ABD merkezli büyük bulut sağlayıcılarının küresel egemenliği, pek çok hükümetin yerel altyapı kurma çabalarının temel motivasyonunu oluşturmaktadır. Veri egemenliği, ülkelerin yapay zeka altyapısını yerel olarak inşa etme çabası olan Sovereign AI hareketi ile doğrudan ilişkilidir. Türkiye, Avrupa Birliği, Japonya ve pek çok ülke; kritik verilerin sınır dışına çıkmaması için yerel veri merkezleri kurmakta, özel yapay zeka altyapıları geliştirmekte ve bulut sağlayıcılarına yönelik düzenlemeler oluşturmaktadır. Türkiye'de KVKK ve Cumhurbaşkanlığı Dijital Dönüşüm Ofisi'nin politikaları bu çerçevede belirleyici rol oynamaktadır. Teknik açıdan federated learning (federe öğrenme), veri egemenliğini korurken makine öğrenimi modelleri eğitmek için kullanılan başlıca yöntemdir. Bu yaklaşımda ham veriler merkezi sunucuya gönderilmez; yalnızca model güncellemeleri paylaşılır. Homomorphic encryption ise şifreli veriler üzerinde hesaplama yapılmasına olanak tanıyarak ham verinin açık halde işlenmesini engeller. Veri egemenliği, küresel ölçekte giderek artan bir jeopolitik mesele haline gelmektedir. ABD'nin CLOUD Act yasası Amerikan şirketlerinin yurt dışındaki verilerine erişim talep etmesine olanak tanırken, Avrupa'nın Gaia-X girişimi bölgesel dijital altyapı bağımsızlığını hedeflemektedir. Yapay zeka çağında verinin en stratejik kaynak olarak konumlanması bu tartışmayı daha da derinleştirmekte; hangi modellerin hangi verilerle eğitildiği sorusu artık teknolojik değil, siyasi bir soru haline dönüşmektedir.

arrow_forward
code_blocks

Model Stealing (Model Çalma Saldırısı)

Model çalma saldırısı (model stealing attack veya model extraction), bir saldırganın hedef yapay zeka modeline sorgular göndererek modelin işlevselliğini, ağırlıklarını veya davranışını çıkarmayı amaçladığı bir makine öğrenmesi güvenlik saldırısıdır. Saldırgan genellikle modele doğrudan erişim olmaksızın, yalnızca API üzerinden girdi-çıktı çiftleri toplayarak kendi modelini hedef modeli taklit edecek biçimde eğitir. Model çalma saldırıları farklı hedeflerle gerçekleştirilir. Fonksiyon çıkarma (function extraction) saldırısında saldırgan, hedef modelin karar sınırlarını yeniden oluşturmaya çalışır. Hiperparametre çıkarma saldırısında ise modelin mimarisi ve eğitim parametreleri hakkında bilgi edinilmeye çalışılır. Eğitim verisi çıkarma saldırıları ise modelin ezberlenmiş eğitim örneklerini geri üretmeyi amaçlar. Savunma tarafında çeşitli teknikler geliştirilmiştir: sorgu hız sınırlama (rate limiting), olasılık vektörü yerine yalnızca en yüksek sınıf etiketini döndürme, sorgu örüntüsü anomali tespiti ve çıktılara hafif gürültü ekleme (output perturbation). Diferansiyel gizlilik eğitim sürecinde de bu saldırılara karşı ek koruma sunar. Ticari yapay zeka API'larına yönelik gerçek model çalma örnekleri belgelenmiştir: araştırmacılar GPT-3 benzeri modellerin düşük maliyetli yaklaşık kopyalarının çıkarılabildiğini göstermiştir. Bu durum model sağlayıcıları için hem ticari hem de güvenlik riski oluşturmaktadır. AB Yapay Zeka Yasası kapsamında yüksek riskli sistemlerin bu tür saldırılara karşı teknik savunmalar içermesi zorunlu kılınmaktadır. Türkiye'de BDDK ve KVKK çerçevesinde model güvenliği kurumsal risk yönetiminin bir parçası haline gelmektedir.

arrow_forward