tag AcikAgirlikliModel

Bu sayfada AcikAgirlikliModel etiketi ile işaretlenmiş 2 yapay zeka kavramını bulabilirsiniz.

LLaMA (Large Language Model Meta AI), Meta AI tarafından 2023 yılında kamuoyuna sunulan açık ağırlıklı (open-weight) büyük dil modeli serisidir. GPT-4 ve Claude gibi yalnızca API erişimiyle sunulan kapalı modellerin aksine, LLaMA ağırlık dosyaları araştırmacılara ve geliştiricilere ücretsiz olarak dağıtılır; bu yapı modeli indirilebilir, yerel sunucularda barındırılabilir ve farklı alanlara ince ayar yapılabilir hâle getirir. LLaMA serisi aşamalı olarak gelişti. 2023 başında yayımlanan LLaMA 1, kısa sürede sızdırılmasıyla birlikte Alpaca ve Vicuna gibi topluluk türev modellerinin önünü açtı. LLaMA 2, ticari kullanıma tam açılan ilk versiyon olarak şirketlerin kendi sunucularında özel asistan kurmasına olanak tanıdı. LLaMA 3 ve 3.1, 8B ile 405B arasındaki parametre aralığıyla GPT-4o ile başa baş rekabet edebilir düzeye ulaştı; LLaMA 3.1 405B modeli, Ağustos 2024'te açık ağırlıklı modeller için tarihi bir kırılma noktası olarak değerlendirildi. 2025'te tanıtılan LLaMA 4 ise Mixture-of-Experts mimarisiyle metin, görsel ve sesi bir arada işleyebilen çok modlu bir yapıya geçti. Teknik açıdan LLaMA, standart Transformer bloklarını Grouped Query Attention (GQA) ve Rotary Position Embedding (RoPE) optimizasyonlarıyla güçlendirir. Bu düzenlemeler bellek bant genişliğini azaltır ve bağlam uzunluğunu artırır. Modeller 2 trilyon tokeni aşan çok dilli eğitim verisiyle ön eğitim alır; ardından RLHF ve SFT ince ayar aşamalarından geçer. Ekosistem oldukça geniştir. Ollama, LM Studio ve Jan gibi araçlar teknik bilgi gerektirmeden yerel LLaMA çalıştırmayı mümkün kılar. Unsloth ile QLoRA yöntemi, 24 GB VRAM'li tek bir tüketici GPU'sunda 70B parametre ince ayarını gerçekleştirir. Hugging Face Hub'daki on binlerce türev model — CodeLlama, Llama-Guard, tıbbi LLaMA türevleri — bu açık ekosistemi genişletmeye devam etmektedir. LLaMA lisansı belirli koşullarla ticari kullanıma izin verir; aylık 700 milyonu aşan kullanıcı tabanında Meta'dan ek lisans alınması gerekmektedir. Türkiye'deki geliştiriciler için LLaMA, GPT-4 API maliyetleri yerine aylık sıfır dolara yakın giderle yüksek kaliteli dil işleme olanağı sunar. LLaMA 3.1 ve üzeri modeller Türkçeyi desteklemekte; açık kaynak topluluk modelleri bu desteği geliştirmeye devam etmektedir.

integration_instructions

LLaMA (Meta LLaMA Modelleri)

LLaMA (Large Language Model Meta AI), Meta AI tarafından 2023 yılında kamuoyuna sunulan açık ağırlıklı (open-weight) büyük dil modeli serisidir. GPT-4 ve Claude gibi yalnızca API erişimiyle sunulan kapalı modellerin aksine, LLaMA ağırlık dosyaları araştırmacılara ve geliştiricilere ücretsiz olarak dağıtılır; bu yapı modeli indirilebilir, yerel sunucularda barındırılabilir ve farklı alanlara ince ayar yapılabilir hâle getirir. LLaMA serisi aşamalı olarak gelişti. 2023 başında yayımlanan LLaMA 1, kısa sürede sızdırılmasıyla birlikte Alpaca ve Vicuna gibi topluluk türev modellerinin önünü açtı. LLaMA 2, ticari kullanıma tam açılan ilk versiyon olarak şirketlerin kendi sunucularında özel asistan kurmasına olanak tanıdı. LLaMA 3 ve 3.1, 8B ile 405B arasındaki parametre aralığıyla GPT-4o ile başa baş rekabet edebilir düzeye ulaştı; LLaMA 3.1 405B modeli, Ağustos 2024'te açık ağırlıklı modeller için tarihi bir kırılma noktası olarak değerlendirildi. 2025'te tanıtılan LLaMA 4 ise Mixture-of-Experts mimarisiyle metin, görsel ve sesi bir arada işleyebilen çok modlu bir yapıya geçti. Teknik açıdan LLaMA, standart Transformer bloklarını Grouped Query Attention (GQA) ve Rotary Position Embedding (RoPE) optimizasyonlarıyla güçlendirir. Bu düzenlemeler bellek bant genişliğini azaltır ve bağlam uzunluğunu artırır. Modeller 2 trilyon tokeni aşan çok dilli eğitim verisiyle ön eğitim alır; ardından RLHF ve SFT ince ayar aşamalarından geçer. Ekosistem oldukça geniştir. Ollama, LM Studio ve Jan gibi araçlar teknik bilgi gerektirmeden yerel LLaMA çalıştırmayı mümkün kılar. Unsloth ile QLoRA yöntemi, 24 GB VRAM'li tek bir tüketici GPU'sunda 70B parametre ince ayarını gerçekleştirir. Hugging Face Hub'daki on binlerce türev model — CodeLlama, Llama-Guard, tıbbi LLaMA türevleri — bu açık ekosistemi genişletmeye devam etmektedir. LLaMA lisansı belirli koşullarla ticari kullanıma izin verir; aylık 700 milyonu aşan kullanıcı tabanında Meta'dan ek lisans alınması gerekmektedir. Türkiye'deki geliştiriciler için LLaMA, GPT-4 API maliyetleri yerine aylık sıfır dolara yakın giderle yüksek kaliteli dil işleme olanağı sunar. LLaMA 3.1 ve üzeri modeller Türkçeyi desteklemekte; açık kaynak topluluk modelleri bu desteği geliştirmeye devam etmektedir.

arrow_forward
translate

Qwen3 (Qwen3)

Qwen3, Alibaba Cloud'un Qwen model ailesi kapsamında Nisan 2025'te yayımladığı en gelişmiş nesil açık ağırlıklı dil modelidir. 0.6B'den 235B'ye kadar uzanan geniş parametre yelpazesiyle sunulan Qwen3; yoğun (dense) ve Mixture-of-Experts (MoE) mimarilerini bir arada sunar. 235B parametreli MoE versiyonu (Qwen3-235B-A22B), her token işleminde yalnızca 22B aktif parametre kullanarak çalışır; bu tasarım yüksek kapasiteyi verimli hesaplama maliyetiyle buluşturur. Modelin kıyaslama puanları MMLU, AGIEval ve çok dilli değerlendirmelerde Llama 4 ve Mistral Large gibi rakip açık modellerle rekabetçi seyir izlemektedir. Qwen3'ü rakiplerinden ayıran temel yenilik hibrit düşünme modudur (hybrid thinking). Thinking modunda model, o1/o3 benzeri uzun iç akıl yürütme zinciri oluşturur; non-thinking modunda ise bu adım atlanarak anlık yanıt verilir. Kullanıcılar ve geliştiriciler, görevin karmaşıklığına göre hesaplama bütçesini dinamik biçimde ayarlayabilir. Bu esneklik Qwen3'ü hem hızlı gündelik sohbet hem de derin matematik ve kodlama görevleri için uygun kılar. Model ailesi iki ana dalda şekillenir: 0.6B, 1.7B, 4B, 8B, 14B ve 32B parametreli yoğun modeller ile 30B-A3B ve 235B-A22B MoE modeller. Küçük modeller tüketici GPU'larında ve Apple Silicon'da çalışırken, büyük MoE versiyonları veri merkezi çıkarımı için tasarlanmıştır. Apache 2.0 lisansıyla HuggingFace ve ModelScope üzerinden erişilebilen modeller; Ollama, LM Studio ve vLLM gibi popüler platformlarla entegre çalışır. Çok dilli destek açısından Qwen3, Türkçe dahil 119 dil ve lehçeyi kapsar. AIME matematik yarışması, LiveCodeBench kodlama ve BFCL araç kullanımı kıyaslamalarında frontier modellerle rekabetçi sonuçlar elde etmiştir. Agentic görevler için araç çağrısı (function calling), çok adımlı problem çözme ve LangChain/LlamaIndex ekosistemiyle yerel ajan oluşturma desteği de sunar. Qwen3, 2025 itibarıyla GPT-4o ve Claude Sonnet gibi tescilli modellere karşı açık model dünyasının en güçlü alternatifleri arasında yer almaktadır.

arrow_forward