AI Watermarking (Yapay Zeka İçerik Damgalama)

Yapay zeka üretimi içeriklere kaynağını kanıtlamak için görünmez dijital işaretler gömme tekniği.

AI Watermarking (Yapay Zeka İçerik Damgalama), yapay zeka tarafından üretilen görüntü, ses, video veya metin içeriklerine insan gözüyle fark edilemeyen ya da kolayca çıkarılamayan dijital işaret gömme işlemidir. Bu teknik, sentetik medyanın kaynağını kanıtlamayı, sahte içerikleri tespit etmeyi ve üretici modelin kimliğini doğrulamayı hedefler. Watermarking iki temel kategoride incelenir. Görünür watermarking, içeriğin üzerine açıkça yerleştirilen logo veya metin biçimindedir; telif hakkı iddiası için kolaydır ancak kolayca kaldırılabilir. Görünmez (steganografik) watermarking ise piksel değerleri, frekans uzayı (DCT/DWT) veya anlambilimsel katman üzerinde işaret gömme yaparak içeriği görsel kalitesini bozmadan işaretler; tespit için özel decoder gerekmektedir. Büyük dil modellerinde watermarking çok daha karmaşık bir hal alır. Metin watermarking için en yaygın yaklaşım token-level istatistiksel yöntemdir: model, çıktı oluştururken belirli token gruplarını (örneğin "yeşil liste" token'lar) istatistiksel olarak fazla seçecek biçimde yönlendirilir. Bu önyargı tespit algoritmaları tarafından tespit edilebilirken insan okuyucu için fark edilmez. Maryland Üniversitesi (2023) ve Google'ın SynthID metin watermark yöntemi bu yaklaşımı benimser. Görsel yapay zeka watermarking alanında Adobe ve Microsoft C2PA (Coalition for Content Provenance and Authenticity) standardını oluşturdu. C2PA, içeriğe üretim zamanı, model kimliği ve düzenleme geçmişi gibi meta veriler ekleyen kriptografik olarak imzalanmış bir manifesto kullanır. İçerik Kimlik Bilgileri (Content Credentials) olarak da bilinen bu sistem, 2024 itibarıyla Adobe Firefly, DALL-E 3 ve Google Imagen tarafından desteklenmektedir. Watermarking'in sınırlılıkları da mevcuttur. Ekran görüntüsü almak, yeniden boyutlandırmak veya farklı bir modelle yeniden işlemek görünmez işaretleri silebilir. Dil modeli çıktılarında parafraz saldırıları metnin yapısını değiştirerek watermark'ı bozabilir. Türkiye'de Bilgi Teknolojileri ve İletişim Kurumu (BTK) düzenlemeleri kapsamında yapay zeka üretimi içeriklerin kaynak belirtmesi yükümlülüğü tartışmaları sürmektedir.