tag CAI

Constitutional AI (Anayasal Yapay Zeka)

Bu sayfada CAI (Constitutional AI (Anayasal Yapay Zeka)) etiketi ile işaretlenmiş 1 yapay zeka kavramını bulabilirsiniz.

Constitutional AI (CAI — Anayasal Yapay Zeka), Anthropic tarafından 2022 yılında geliştirilen ve yapay zeka modellerini belirli bir etik ve değer "anayasasına" göre hizalayan bir tekniktir. Geleneksel RLHF'nin yararlılık ve zararsızlık değerlendirmesi için insanlar yerine büyük ölçüde yapay zeka geri bildirimini (AI feedback) kullanan Constitutional AI, ölçeklenebilir hizalama arayışındaki önemli bir adım olarak görülmektedir. Constitutional AI iki aşamada çalışır. SL-CAI (Supervised Learning — CAI): Modele zararlı veya sorunlu yanıt ürettirilir, ardından yazılı bir anayasadaki ilkeler listesi (örn. "Faydalı, zararsız ve dürüst ol", "İnsan haklarına saygı göster") aracılığıyla model kendi yanıtını eleştirir ve düzeltir. Bu eleştiri-revizyon döngüsü birkaç tur tekrarlanır ve üretilen yüksek kaliteli yanıtlar denetimli öğrenme için kullanılır. RL-CAI (Reinforcement Learning — CAI): RLHF'deki insan tercih sıralamasının yerine bir yapay zeka hakem modeli (AI preference model) kullanılır; hakem, anayasadaki ilkelere göre hangi yanıtın daha iyi olduğuna karar verir. Bu tercih verileriyle eğitilen ödül modeli, PPO yerine direkt tercih optimizasyonuyla politikayı günceller. Constitutional AI; insan etiketleyici gereksinimini azaltırken zararlılık değerlendirmesini şeffaf hale getirir ve denetlenebilir bir değer kümesine dayandırır. Claude modeli serisi bu teknikle eğitilmiştir.

account_balance

Constitutional AI (Anayasal Yapay Zeka)

Constitutional AI (CAI — Anayasal Yapay Zeka), Anthropic tarafından 2022 yılında geliştirilen ve yapay zeka modellerini belirli bir etik ve değer "anayasasına" göre hizalayan bir tekniktir. Geleneksel RLHF'nin yararlılık ve zararsızlık değerlendirmesi için insanlar yerine büyük ölçüde yapay zeka geri bildirimini (AI feedback) kullanan Constitutional AI, ölçeklenebilir hizalama arayışındaki önemli bir adım olarak görülmektedir. Constitutional AI iki aşamada çalışır. SL-CAI (Supervised Learning — CAI): Modele zararlı veya sorunlu yanıt ürettirilir, ardından yazılı bir anayasadaki ilkeler listesi (örn. "Faydalı, zararsız ve dürüst ol", "İnsan haklarına saygı göster") aracılığıyla model kendi yanıtını eleştirir ve düzeltir. Bu eleştiri-revizyon döngüsü birkaç tur tekrarlanır ve üretilen yüksek kaliteli yanıtlar denetimli öğrenme için kullanılır. RL-CAI (Reinforcement Learning — CAI): RLHF'deki insan tercih sıralamasının yerine bir yapay zeka hakem modeli (AI preference model) kullanılır; hakem, anayasadaki ilkelere göre hangi yanıtın daha iyi olduğuna karar verir. Bu tercih verileriyle eğitilen ödül modeli, PPO yerine direkt tercih optimizasyonuyla politikayı günceller. Constitutional AI; insan etiketleyici gereksinimini azaltırken zararlılık değerlendirmesini şeffaf hale getirir ve denetlenebilir bir değer kümesine dayandırır. Claude modeli serisi bu teknikle eğitilmiştir.

arrow_forward