tag SaldirganAI

Data Poisoning Defense (Veri Zehirleme Savunması)

Bu sayfada SaldirganAI (Data Poisoning Defense (Veri Zehirleme Savunması)) etiketi ile işaretlenmiş 1 yapay zeka kavramını bulabilirsiniz.

Veri zehirleme savunması (data poisoning defense), makine öğrenimi sistemlerini eğitim verilerinin kasıtlı olarak bozulmasına karşı korumaya yönelik teknik yöntem ve stratejiler bütünüdür. Saldırganlar, bir modelin karar sınırlarını bozmak veya gizli bir arka kapı (backdoor) eklemek amacıyla eğitim kümesine zararlı örnekler yerleştirdiğinde bu savunma katmanları devreye girer. Söz konusu tehdit özellikle federe öğrenme (federated learning), açık kaynaklı veri kümeleri ve web kazımasıyla derlenen büyük eğitim setleri için kritik önem taşır. Savunma stratejileri dört ana başlıkta incelenir. İlk katman olan veri temizleme ve anomali tespitinde, eğitim öncesinde istatistiksel analizler ve sinir temizleme (Neural Cleanse) algoritmaları kullanılarak şüpheli örnekler tespit edilir. SPECTRE ve Deep-kNN yöntemleri, modelin etkinleştirilme uzayındaki anomalileri yakalayarak zehirli örnekleri izole eder. İkinci katman olan sağlamlaştırılmış eğitimde, rastgele düzeltme (randomized smoothing), diferansiyel gizlilik (DP-SGD) ve bilgi damıtma (knowledge distillation) teknikleri modelin bozulmuş örneklere aşırı uyum sağlamasını kısıtlar. Veri büyütme (data augmentation) politikaları da zehirli gürültünün etkisini azaltmada etkili bulunmuştur. Üçüncü katman olan veri kökeni ve filigran yaklaşımında, radioactive data tekniği meşru sahibi dışında eğitim verisi kullananları saptamak için filigranlı örnekler kullanır. Bu yöntem eğitim veri zincirinin izlenebilirliğini (provenance) güvence altına alır. Dördüncü katman olan sertifikalı savunmalarda, randomized smoothing teorik bir ε-pertürbasyon garantisi sunarak sınırlı sayıda zehirli örneğe rağmen model tahminlerinin değişmeyeceğini matematiksel olarak ispat eder. DPA (Differentially Private Aggregation) bu yaklaşımın federe öğrenme senaryolarına uyarlanmış biçimidir. Gerçek dünya dağıtımlarında savunma derinliği (defense-in-depth) prensibi benimsendiğinden tek bir teknik yerine birden fazla katman birlikte kullanılır. NIST AI RMF ve MITRE ATLAS çerçeveleri, bu savunma katmanlarını kurumsal güvenlik politikasıyla bütünleştirmek için kapsamlı rehberlik sunar.

code_blocks

Data Poisoning Defense (Veri Zehirleme Savunması)

Veri zehirleme savunması (data poisoning defense), makine öğrenimi sistemlerini eğitim verilerinin kasıtlı olarak bozulmasına karşı korumaya yönelik teknik yöntem ve stratejiler bütünüdür. Saldırganlar, bir modelin karar sınırlarını bozmak veya gizli bir arka kapı (backdoor) eklemek amacıyla eğitim kümesine zararlı örnekler yerleştirdiğinde bu savunma katmanları devreye girer. Söz konusu tehdit özellikle federe öğrenme (federated learning), açık kaynaklı veri kümeleri ve web kazımasıyla derlenen büyük eğitim setleri için kritik önem taşır. Savunma stratejileri dört ana başlıkta incelenir. İlk katman olan veri temizleme ve anomali tespitinde, eğitim öncesinde istatistiksel analizler ve sinir temizleme (Neural Cleanse) algoritmaları kullanılarak şüpheli örnekler tespit edilir. SPECTRE ve Deep-kNN yöntemleri, modelin etkinleştirilme uzayındaki anomalileri yakalayarak zehirli örnekleri izole eder. İkinci katman olan sağlamlaştırılmış eğitimde, rastgele düzeltme (randomized smoothing), diferansiyel gizlilik (DP-SGD) ve bilgi damıtma (knowledge distillation) teknikleri modelin bozulmuş örneklere aşırı uyum sağlamasını kısıtlar. Veri büyütme (data augmentation) politikaları da zehirli gürültünün etkisini azaltmada etkili bulunmuştur. Üçüncü katman olan veri kökeni ve filigran yaklaşımında, radioactive data tekniği meşru sahibi dışında eğitim verisi kullananları saptamak için filigranlı örnekler kullanır. Bu yöntem eğitim veri zincirinin izlenebilirliğini (provenance) güvence altına alır. Dördüncü katman olan sertifikalı savunmalarda, randomized smoothing teorik bir ε-pertürbasyon garantisi sunarak sınırlı sayıda zehirli örneğe rağmen model tahminlerinin değişmeyeceğini matematiksel olarak ispat eder. DPA (Differentially Private Aggregation) bu yaklaşımın federe öğrenme senaryolarına uyarlanmış biçimidir. Gerçek dünya dağıtımlarında savunma derinliği (defense-in-depth) prensibi benimsendiğinden tek bir teknik yerine birden fazla katman birlikte kullanılır. NIST AI RMF ve MITRE ATLAS çerçeveleri, bu savunma katmanlarını kurumsal güvenlik politikasıyla bütünleştirmek için kapsamlı rehberlik sunar.

arrow_forward