list_altİçindekilerexpand_more
- 01Tespitin Neden Zor Olduğu
- 02GPTZero
- 03Nasıl Çalışır?
- 04Doğruluk ve Sınırlılıklar
- 05Turnitin AI
- 06Akademik Entegrasyon
- 07AI Raporu Nasıl Okunur?
- 08Copyleaks
- 09Çok Dilli Destek ve API
- 10Karşılaştırma Tablosu
- 11Hangi Aracı Seçmeli?
- 12Tespiti Etkileyen Faktörler
- 13Peki Neden Bu Araçların Hiçbiri Kesin Değil?
- 14Araç Tek Başına Yetmez
2022 sonunda ChatGPT kullanıma açıldığında üniversiteler, yayın kurumları ve içerik departmanları aynı soruyla karşı karşıya kaldı: Bu metin insan mı yazdı, makine mi? Bu soruyu yanıtlamaya çalışan araçlar kısa sürede çoğaldı. GPTZero, Turnitin AI ve Copyleaks bu alanda en sık karşılaşılan üç seçenek. Yaklaşımları, güçlü oldukları noktalar ve boşlukları birbirinden ayrışıyor.
Tespitin Neden Zor Olduğu
AI çıktısını metin düzeyinde ayırt etmek düşündüğünden zor. Modern LLM modelleri artık yalnızca düz, kalıp cümleler üretmiyor; bağlama uygun, tutarlı paragraflar yazabiliyor. Araçlar genellikle iki sinyale bakıyor:
Perplexity: Metnin tahmin edilebilirlik ölçüsü. AI çıktısı olasılık dağılımı açısından öngörülebilir davranır; perplexity değeri düşük çıkar. İnsan yazısında beklenmedik sözcük seçimleri, deyimler ve sözdizimsel çeşitlilik daha fazla görülür.
Burstiness: Cümle uzunluğundaki dalgalanma. İnsan yazısı çok kısa ve çok uzun cümleleri karıştırır. AI çıktısı bu ritmi tutturmakta zorlanır; uzunluklar genellikle benzer kalır.
Zorlu olan nokta: ağır biçimde düzenlenmiş, paraphrase edilmiş ya da hibrit yazılar bu sinyalleri bulanıklaştırıyor. Prompt engineering tekniklerini bilen yazarlar metni dedektörden kaçırmak için bu yöntemleri bilinçli kullanabiliyor. Tespit araçları için asıl açık yara burası.
GPTZero
GPTZero, Princeton öğrencisi Edward Tian tarafından 2023 başında çıktı. Başlangıçta öğretmenler ve akademisyenler için tasarlanmıştı; şu anda hem ücretsiz hem de ücretli planlar sunuluyor.
Nasıl Çalışır?
GPTZero her metin bölümüne perplexity ve burstiness skorları atar. Belge genelinde bir “AI olasılığı” yüzdesi üretir; hangi paragrafların yapay zeka çıktısına benzediğini de ayrıca işaretler. 2024’teki güncellemede model yeniden eğitildi; GPT-4, Claude ve Gemini çıktılarını kapsayan daha geniş bir veri kümesi kullanıldı.
API desteği var; geliştiriciler belge akışını doğrudan sisteme iletebilir. Toplu analiz planları da mevcut.
Doğruluk ve Sınırlılıklar
GPTZero, kendi yayımladığı verilere göre saf ChatGPT çıktısında %88-90 doğruluk bildiriyor (kaynak: GPTZero Accuracy Hub). Bu oran şu koşullarda önemli ölçüde düşüyor:
- Metin üretim sonrası elle düzenlendiyse
- Quillbot gibi paraphrase araçları devreye girdiyse
- Hibrit çalışmalarda (insan ve AI birlikte yazdı)
Yanlış pozitif sorunu da gerçek. GPTZero zaman zaman özgün insan yazılarını AI çıktısı olarak işaretledi; ikinci dilde yazan kullanıcılarda bu daha sık görülüyor. “Explain” butonu bu yüzden eklendi; kullanıcı işaretlenen bölümün neden hata olduğunu sorgulayabiliyor.
Bir diğer önemli nokta: GPTZero’nun raporunu okurken yüzdelik skoru mutlak bir kural gibi kullanmamak gerekiyor. %75 AI skoru alan bir metin, gerçekten AI ile yazılmış olabilir; ama aynı zamanda teknik, formüle dayalı bir yazı tarzını tercih eden bir akademisyenin eseri de olabilir. Bu yüzden GPTZero raporu tek başına bir kanıt değil, araştırmanın başlangıcı.
Fiyatlandırma: Ücretsiz katman ayda 10.000 kelimeye kadar tarama sunar. Educator planı 14,99 $/ay (5 kullanıcıya kadar); Professional plan 19,99 $/ay (kaynak: GPTZero Pricing). API erişimi Pro ve üstü planlarda açık.
Turnitin AI
Turnitin, 2023 sonunda “AI Writing Detection” özelliğini kurumsal müşterilerine açtı. On yılı aşkın süredir akademik bütünlük alanında faaliyet gösteren platform, bu özelliği mevcut intihal kontrol altyapısının üstüne bindirdi.
Akademik Entegrasyon
Turnitin’in başlıca avantajı zaten orada olması. Canvas, Moodle ve Blackboard ile entegre çalışıyor; AI tespit özelliği aynı akışın içinde geliyor. Öğretim üyesi tek arayüzden hem intihal hem AI skoru alıyor. Ek bir araç kurulumu ya da ayrı hesap yönetimi yok.
Turnitin AI olasılığını 0-100 arasında skorluyor; rapor insan yazısından sapan segmentleri de ayrıca gösteriyor. Şirketin kendi kılavuzu 80 üzeri skor alan metinlere tek başına yaptırım uygulanmamasını öneriyor: bu bir ipucu, kanıt değil.
AI Raporu Nasıl Okunur?
Rapor üç renkle kodlanmış: yeşil (insan benzeri), sarı (karma), kırmızı (yüksek AI ihtimali). İşaretlenen segmentler öğrenciye gösterilebilir biçimde belgeleniyor. Kurumlar bu çıktıyı öğrenci görüşmelerinde kullanıyor.
Doğruluk: Turnitin’in açıkladığı bağımsız değerlendirme sonuçlarına göre saf AI çıktısında %98 hassasiyet ve %1’in altında yanlış pozitif (kaynak: Turnitin AI Detection Confidence Study). Bu rakamlar tartışmalı; bazı araştırmacılar karma metinlerde daha yüksek hata oranları bildiriyor.
Kurumlar Turnitin’in AI tespitini etkinleştirmek için sisteme ayrıca kayıt olması gerekmiyor; mevcut Turnitin hesabıyla doğrudan erişilebilir. Bununla birlikte özellik bazı ülkelerde GDPR uyumluluğu ve veri işleme nedeniyle kurumsal onay gerektiriyor.
Fiyatlandırma: Turnitin yalnızca kurumsal lisans satıyor. Bireysel ya da küçük ekip planı yok; fiyat kuruma ve kullanıcı sayısına göre belirleniyor (kaynak: Turnitin İletişim).
Copyleaks
Copyleaks, intihal tespiti alanından gelen ve 2023’te AI tespit özelliğini piyasaya süren bir platform. API odaklı yapısıyla özellikle iş dünyasına yönelik konumlanıyor.
Çok Dilli Destek ve API
Copyleaks’in fark yarattığı nokta dil kapsamı. 30’dan fazla dili destekliyor; Türkçe, Arapça ve Farsça da buna dahil. GPTZero ve Turnitin’in Türkçe desteği kısıtlı ya da dolaylı; Copyleaks bu konuda öne çıkıyor.
API belgelenmiş ve kapsamlı: toplu belge gönderme, webhook tabanlı bildirimler, kural bazlı filtreler. İçerik ajansları ve yayın evleri bu API’yi yazı işleme akışına doğrudan bağlayabiliyor. Yapay zeka kaynaklı sahte içerikleri izleyen ve politika geliştiren ekipler için bu entegrasyon işe yarıyor.
Doğruluk: Copyleaks, saf AI metinlerinde %99.1’in üzerinde doğruluk bildiriyor (kaynak: Copyleaks AI Content Detector). Bu rakam şirketin kendi testlerine dayanıyor; bağımsız değerlendirmeler daha temkinli sonuçlar ortaya koyuyor. Karma metinler ve paraphrase senaryolarında performans düşüşü gözlemleniyor.
Fiyatlandırma: Bireysel kullanım için yıllık faturalandırmada 10,99 $/ay. Ekip ve kurumsal planlar fiyat görüşmesine açık (kaynak: Copyleaks Pricing). 10 sayfa ücretsiz deneme mevcut.
Karşılaştırma Tablosu
| Özellik | GPTZero | Turnitin AI | Copyleaks |
|---|---|---|---|
| Ücretsiz plan | Evet (10.000 kelime/ay) | Hayır | Evet (10 sayfa deneme) |
| Raporlanan doğruluk (saf AI) | ~%88-90 (kaynak) | ~%98 (kaynak) | ~%99 (kaynak) |
| API desteği | Evet (Pro+) | Evet | Evet |
| Türkçe dil desteği | Kısmi | Kısmi | Evet |
| LMS entegrasyonu | Hayır | Evet (Canvas, Moodle, Blackboard) | Kısmi |
| Başlangıç fiyatı | 14,99 $/ay (kaynak) | Kurumsal teklif (kaynak) | 10,99 $/ay (kaynak) |
| Yanlış pozitif riski | Orta (ikinci dil yazıda yüksek) | Düşük (firma iddiası) | Orta |
| Toplu analiz | Evet | Evet | Evet |
Hangi Aracı Seçmeli?
Üniversite ve öğretim üyeleri için en pratik yol Turnitin; kurumunuz büyük olasılıkla zaten lisanslıdır ve yeni bir araç satın almak yerine aynı sistemin içindeki AI özelliği yeterli. Dezavantaj: bireysel hesap açılamıyor, kurumsal erişim zorunlu.
Küçük okullar ve bağımsız eğitmenler için GPTZero makul bir başlangıç. Ücretsiz katman düşük hacimli değerlendirmelerde yeterli; Educator planı 14,99 $/ay ile ölçekleniyor.
İçerik ajansları ve Türkçe içerik üreten ekipler için Copyleaks dil desteği ve API açısından öne çıkıyor. HR ekipleri ve özgeçmiş inceleyen departmanlar da Copyleaks’in toplu analiz özelliğinden yararlanabiliyor; GPTZero API’ye Pro planda geçiyor.
Tespiti Etkileyen Faktörler
Hangi aracı kullanırsanız kullanın, sonuçları etkileyen birkaç değişken var:
Paraphrase: Quillbot gibi araçlarla yeniden biçimlendirilen metinler tespit skorunu ciddi biçimde düşürüyor. Prompt engineering yöntemlerini bilen yazarlar bunu bilinçli yapabiliyor.
Karma üretim: “AI destekli yazma” artık yaygın bir pratik. Bir paragraf AI, sonraki insan, ardından tekrar AI; bu tür metinler hiçbir araç tarafından güvenilir biçimde sınıflandırılamıyor.
Model çeşitliliği: Araçlar büyük ölçüde GPT-4 ve Claude çıktıları üzerinde eğitildi. Daha az yaygın ya da fine-tuned modeller düşük tespit oranına yol açabiliyor. Akıl yürüten modellerin çıktıları bu açıdan hâlâ zayıf kapsanan bir alan.
Kullanıcı dili: İkinci dilde yazan kullanıcılar (basit sözdizimi, sınırlı kelime dağarcığı) yanlış pozitif riskiyle daha sık karşılaşıyor. Bu, akademik değerlendirmelerde ciddi bir etik soru.
Peki Neden Bu Araçların Hiçbiri Kesin Değil?
Tespit mantığının kendisinde yapısal bir sorun var: her araç, belirli modellerin belirli dönemlerdeki çıktı kalıplarını öğreniyor. Model güncellendiğinde, yeni model versiyonu piyasaya sürüldüğünde ya da farklı bir dil tercih edildiğinde tespit oranları değişiyor. Bu bir yazılım hatası değil; sınıf sınırı olmayan bir tanımlama probleminin doğasından kaynaklanıyor. Araçlar en iyi bilinen, yaygın kullanılan modellerin temiz çıktısını yakalarken hibrit ve manipüle edilmiş metinlerde sınırlarını gösteriyor.
Araç Tek Başına Yetmez
Üç araç da belirli koşullarda işe yarıyor. Ama hiçbiri yanılmaz; özellikle karma ve paraphrase senaryolarında.
Bir metnin AI ile yazılmış olması tek başına gerçekte ne anlama geliyor? Bu sorunun cevabı araç seçiminden daha önemli. Tespit araçlarının skoru bir inceleme sürecinin başlangıcı; yargı değil. RLHF ve benzer tekniklerle eğitilen modellerin çıktıları ikna ediciliğini artırıyor; tespit teknolojisi ile içerik üretimi arasındaki mesafe kapatılması çok daha güç bir sorun olmaya devam edecek.



