tag KnowledgeGraph

Bu sayfada KnowledgeGraph etiketi ile işaretlenmiş 1 yapay zeka kavramını bulabilirsiniz.

GraphRAG, Microsoft Research tarafından 2024'te tanıtılan ve bilgi grafları (knowledge graph) ile desteklenen gelişmiş bir RAG (Retrieval-Augmented Generation) sistemidir. Klasik RAG'de belgeler küçük parçalara (chunk) bölünür ve vektör benzerliği ile en ilgili parçalar bulunup dil modeline verilir. Bu yaklaşım yerel, spesifik sorularda güçlü olmakla birlikte "Bu belge koleksiyonunun ana temaları nelerdir?" gibi küresel sorularda yetersiz kalır. GraphRAG bu sorunu köklü biçimde çözer. Hazırlık aşamasında belgeler LLM ile analiz edilir; varlıklar (kişi, yer, organizasyon, kavram), aralarındaki ilişkiler ve özetler çıkarılarak yapısal bir bilgi grafına aktarılır. Leiden veya Louvain algoritmasıyla graftaki düğümler topluluklara ayrılır; her topluluk için özet metinler üretilir. Sorgu aşamasında sistem iki moddan birini kullanır: lokal sorgular (belirli bir varlık hakkında) ilgili düğümleri ve komşularından bağlam çeker; küresel sorgular ise tüm topluluk özetlerini birleştirerek bütünsel bir yanıt üretir. 2024 sonunda Microsoft, Lazy GraphRAG adlı daha hafif bir varyant yayımladı. Lazy GraphRAG, hazırlık aşamasında tüm toplulukları önceden özetlemez; bunun yerine sorgu anında dinamik olarak ilgili düğümleri seçer. Bu yöntem indeksleme maliyetini önemli ölçüde düşürür ve orta büyüklükteki belge koleksiyonları için daha uygun bir seçenek sunar. Standart RAG ile karşılaştırıldığında GraphRAG'ın temel avantajı, büyük belge koleksiyonları hakkında tematik ve çapraz referans sorularını yanıtlayabilmesidir. Microsoft'un orijinal değerlendirmesinde GraphRAG, kapsamlılık ve çeşitlilik metriklerinde standart RAG'ı geçmiştir. Kurumsal belge analizi, akademik literatür keşfi ve araştırma raporlarında ilişki bağlantıları oluşturmak bu yaklaşımın öne çıktığı alanlardır. Pratik kullanım açısından Microsoft'un açık kaynak Python paketi (pip install graphrag) ve Azure AI Studio entegrasyonu hazır pipeline sunar. LlamaIndex ve LangChain da hibrit yaklaşımları destekler: yerel sorgular için vektör RAG, küresel sorgular için GraphRAG kombinasyonu. İndeksleme maliyetleri dikkat gerektirir: 1000 sayfalık bir belge koleksiyonunun GPT-4 ile işlenmesi 50–200 USD arası LLM masrafı doğurabilir. Küçük ve orta büyüklükteki projeler için önce standart RAG veya Lazy GraphRAG tercih edilmesi önerilir.

hub

GraphRAG (Graf Tabanlı RAG)

GraphRAG, Microsoft Research tarafından 2024'te tanıtılan ve bilgi grafları (knowledge graph) ile desteklenen gelişmiş bir RAG (Retrieval-Augmented Generation) sistemidir. Klasik RAG'de belgeler küçük parçalara (chunk) bölünür ve vektör benzerliği ile en ilgili parçalar bulunup dil modeline verilir. Bu yaklaşım yerel, spesifik sorularda güçlü olmakla birlikte "Bu belge koleksiyonunun ana temaları nelerdir?" gibi küresel sorularda yetersiz kalır. GraphRAG bu sorunu köklü biçimde çözer. Hazırlık aşamasında belgeler LLM ile analiz edilir; varlıklar (kişi, yer, organizasyon, kavram), aralarındaki ilişkiler ve özetler çıkarılarak yapısal bir bilgi grafına aktarılır. Leiden veya Louvain algoritmasıyla graftaki düğümler topluluklara ayrılır; her topluluk için özet metinler üretilir. Sorgu aşamasında sistem iki moddan birini kullanır: lokal sorgular (belirli bir varlık hakkında) ilgili düğümleri ve komşularından bağlam çeker; küresel sorgular ise tüm topluluk özetlerini birleştirerek bütünsel bir yanıt üretir. 2024 sonunda Microsoft, Lazy GraphRAG adlı daha hafif bir varyant yayımladı. Lazy GraphRAG, hazırlık aşamasında tüm toplulukları önceden özetlemez; bunun yerine sorgu anında dinamik olarak ilgili düğümleri seçer. Bu yöntem indeksleme maliyetini önemli ölçüde düşürür ve orta büyüklükteki belge koleksiyonları için daha uygun bir seçenek sunar. Standart RAG ile karşılaştırıldığında GraphRAG'ın temel avantajı, büyük belge koleksiyonları hakkında tematik ve çapraz referans sorularını yanıtlayabilmesidir. Microsoft'un orijinal değerlendirmesinde GraphRAG, kapsamlılık ve çeşitlilik metriklerinde standart RAG'ı geçmiştir. Kurumsal belge analizi, akademik literatür keşfi ve araştırma raporlarında ilişki bağlantıları oluşturmak bu yaklaşımın öne çıktığı alanlardır. Pratik kullanım açısından Microsoft'un açık kaynak Python paketi (pip install graphrag) ve Azure AI Studio entegrasyonu hazır pipeline sunar. LlamaIndex ve LangChain da hibrit yaklaşımları destekler: yerel sorgular için vektör RAG, küresel sorgular için GraphRAG kombinasyonu. İndeksleme maliyetleri dikkat gerektirir: 1000 sayfalık bir belge koleksiyonunun GPT-4 ile işlenmesi 50–200 USD arası LLM masrafı doğurabilir. Küçük ve orta büyüklükteki projeler için önce standart RAG veya Lazy GraphRAG tercih edilmesi önerilir.

arrow_forward