tag Alibaba
Bu sayfada Alibaba etiketi ile işaretlenmiş 3 yapay zeka kavramını bulabilirsiniz.
Qwen (通义千问), Alibaba Group'un geliştirdiği ve sürekli güncellenen büyük dil modeli serisidir. "Tongyi Qianwen" adının kısaltması olan Qwen, 2023'te kamuya açılan ilk sürümlerinden bu yana hem kapalı hem açık kaynak modeller sunarak küresel LLM pazarında Çin kökenli alternatiflerin en güçlü temsilcilerinden biri konumuna geldi. Model ailesi birkaç bölümde incelenir: **Qwen-Max/Plus/Turbo** sürümleri Alibaba Cloud üzerinden API olarak sunulan kapalı kaynak modellerdir; farklı hız-kalite-maliyet dengesine göre seçilebilir. **Qwen2 ve Qwen2.5** serisi ise 0.5B'dan 72B parametreye kadar uzanan açık kaynak modellerdir; Hugging Face'de yayımlanmış ve ince ayar topluluğu tarafından yaygın biçimde kullanılmaktadır. **Qwen-VL**, görüntü ve metin girdisini birleştiren çok modlu sürümdür. **Qwen-Coder** ve **QwQ** ise sırasıyla kod üretimi ve akıl yürütme (reasoning) için optimize edilmiş özel modeller olarak öne çıkar; QwQ, DeepSeek-R1 ile birlikte açık kaynak reasoning model yarışının önemli oyuncusu hâline geldi. Teknik özellikler açısından Qwen modelleri Grouped Query Attention (GQA) ve Rotary Position Embedding (RoPE) gibi modern Transformer iyileştirmelerini benimser; uzun bağlam penceresi (bazı sürümlerde 128K token) kurumsal belge analizine olanak tanır. Çince ve İngilizce'de güçlü performansıyla bilinmesinin yanı sıra çok dilli destek kapsamı giderek genişlemektedir. Lisanslama açısından Qwen2 ve Qwen2.5 serisi Tongyi Qianwen Lisansı altında yayımlanmakta olup bazı sürümler Apache 2.0 altında tamamen özgür kullanım sunar; bu durum kurumsal benimsemeyi kolaylaştırmaktadır. Ollama, LM Studio ve vLLM gibi çerçeveler Qwen modellerini yerel olarak çalıştırmayı desteklemektedir. Qwen modelleri Türkiye gibi gelişmekte olan yapay zeka ekosistemlerinde dikkat çekmektedir: açık kaynak statüsü, geniş dil desteği ve görece düşük çalıştırma maliyeti kurumsal benimsemeyi kolaylaştırmaktadır. 2026 itibarıyla Qwen2.5-Max sürümü MMLU ve GPQA gibi akademik karşılaştırmalarda Batı kaynaklı modellere yakın puanlar almaktadır.
Qwen (Alibaba Dil Modeli Ailesi)
Qwen (通义千问), Alibaba Group'un geliştirdiği ve sürekli güncellenen büyük dil modeli serisidir. "Tongyi Qianwen" adının kısaltması olan Qwen, 2023'te kamuya açılan ilk sürümlerinden bu yana hem kapalı hem açık kaynak modeller sunarak küresel LLM pazarında Çin kökenli alternatiflerin en güçlü temsilcilerinden biri konumuna geldi. Model ailesi birkaç bölümde incelenir: **Qwen-Max/Plus/Turbo** sürümleri Alibaba Cloud üzerinden API olarak sunulan kapalı kaynak modellerdir; farklı hız-kalite-maliyet dengesine göre seçilebilir. **Qwen2 ve Qwen2.5** serisi ise 0.5B'dan 72B parametreye kadar uzanan açık kaynak modellerdir; Hugging Face'de yayımlanmış ve ince ayar topluluğu tarafından yaygın biçimde kullanılmaktadır. **Qwen-VL**, görüntü ve metin girdisini birleştiren çok modlu sürümdür. **Qwen-Coder** ve **QwQ** ise sırasıyla kod üretimi ve akıl yürütme (reasoning) için optimize edilmiş özel modeller olarak öne çıkar; QwQ, DeepSeek-R1 ile birlikte açık kaynak reasoning model yarışının önemli oyuncusu hâline geldi. Teknik özellikler açısından Qwen modelleri Grouped Query Attention (GQA) ve Rotary Position Embedding (RoPE) gibi modern Transformer iyileştirmelerini benimser; uzun bağlam penceresi (bazı sürümlerde 128K token) kurumsal belge analizine olanak tanır. Çince ve İngilizce'de güçlü performansıyla bilinmesinin yanı sıra çok dilli destek kapsamı giderek genişlemektedir. Lisanslama açısından Qwen2 ve Qwen2.5 serisi Tongyi Qianwen Lisansı altında yayımlanmakta olup bazı sürümler Apache 2.0 altında tamamen özgür kullanım sunar; bu durum kurumsal benimsemeyi kolaylaştırmaktadır. Ollama, LM Studio ve vLLM gibi çerçeveler Qwen modellerini yerel olarak çalıştırmayı desteklemektedir. Qwen modelleri Türkiye gibi gelişmekte olan yapay zeka ekosistemlerinde dikkat çekmektedir: açık kaynak statüsü, geniş dil desteği ve görece düşük çalıştırma maliyeti kurumsal benimsemeyi kolaylaştırmaktadır. 2026 itibarıyla Qwen2.5-Max sürümü MMLU ve GPQA gibi akademik karşılaştırmalarda Batı kaynaklı modellere yakın puanlar almaktadır.
Qwen3 (Qwen3)
Qwen3, Alibaba Cloud'un Qwen model ailesi kapsamında Nisan 2025'te yayımladığı en gelişmiş nesil açık ağırlıklı dil modelidir. 0.6B'den 235B'ye kadar uzanan geniş parametre yelpazesiyle sunulan Qwen3; yoğun (dense) ve Mixture-of-Experts (MoE) mimarilerini bir arada sunar. 235B parametreli MoE versiyonu (Qwen3-235B-A22B), her token işleminde yalnızca 22B aktif parametre kullanarak çalışır; bu tasarım yüksek kapasiteyi verimli hesaplama maliyetiyle buluşturur. Modelin kıyaslama puanları MMLU, AGIEval ve çok dilli değerlendirmelerde Llama 4 ve Mistral Large gibi rakip açık modellerle rekabetçi seyir izlemektedir. Qwen3'ü rakiplerinden ayıran temel yenilik hibrit düşünme modudur (hybrid thinking). Thinking modunda model, o1/o3 benzeri uzun iç akıl yürütme zinciri oluşturur; non-thinking modunda ise bu adım atlanarak anlık yanıt verilir. Kullanıcılar ve geliştiriciler, görevin karmaşıklığına göre hesaplama bütçesini dinamik biçimde ayarlayabilir. Bu esneklik Qwen3'ü hem hızlı gündelik sohbet hem de derin matematik ve kodlama görevleri için uygun kılar. Model ailesi iki ana dalda şekillenir: 0.6B, 1.7B, 4B, 8B, 14B ve 32B parametreli yoğun modeller ile 30B-A3B ve 235B-A22B MoE modeller. Küçük modeller tüketici GPU'larında ve Apple Silicon'da çalışırken, büyük MoE versiyonları veri merkezi çıkarımı için tasarlanmıştır. Apache 2.0 lisansıyla HuggingFace ve ModelScope üzerinden erişilebilen modeller; Ollama, LM Studio ve vLLM gibi popüler platformlarla entegre çalışır. Çok dilli destek açısından Qwen3, Türkçe dahil 119 dil ve lehçeyi kapsar. AIME matematik yarışması, LiveCodeBench kodlama ve BFCL araç kullanımı kıyaslamalarında frontier modellerle rekabetçi sonuçlar elde etmiştir. Agentic görevler için araç çağrısı (function calling), çok adımlı problem çözme ve LangChain/LlamaIndex ekosistemiyle yerel ajan oluşturma desteği de sunar. Qwen3, 2025 itibarıyla GPT-4o ve Claude Sonnet gibi tescilli modellere karşı açık model dünyasının en güçlü alternatifleri arasında yer almaktadır.
QwQ (QwQ)
QwQ, Alibaba'nın Qwen ekibi tarafından geliştirilen, cevap vermeden önce uzun bir düşünce zinciri (chain-of-thought) üreten 32 milyar parametreli açık kaynak akıl yürütme (reasoning) modelidir. İlk önizlemesi **QwQ-32B-Preview** adıyla Kasım 2024'te, stabil sürümü **QwQ-32B** ise 5 Mart 2025'te Apache 2.0 lisansıyla yayımlandı. Model, Qwen2.5-32B tabanı üzerine takviye öğrenme (reinforcement learning) ile eğitildi ve AIME24 matematik kıyaslamasında 79,5 puan alarak kendisinden yaklaşık 20 kat büyük 671B parametreli DeepSeek-R1'in 79,8 puanına neredeyse eşit performans gösterdi; OpenAI o1-mini'yi (63,6) ise açık farkla geçti. İsmin ikinci ve daha eski bir anlamı da var: **qwq**, internet ve anime kültüründe ağlayan bir yüzü temsil eden metin ifadesidir. İki "q" harfi yaşlı gözleri, ortadaki "w" ise büzülmüş ağzı simgeler; "uwu" ve "owo" ifadeleriyle aynı aileden gelir ve Discord, Twitch, TikTok gibi platformlarda "üzgünüm ama sevimliyim" tonunda kullanılır. Qwen ekibi model adını seçerken bu ifadeye bilinçli bir gönderme yaptı; "Qwen with Questions" açılımı da bu kelime oyununun üzerine oturur. QwQ'nun teknik önemi, **test-time compute** paradigmasını tüketici donanımına indirmesinde yatar: model, çıkarım sırasında `<think>...</think>` etiketleri arasında yüzlerce hatta binlerce token uzunluğunda iç monolog üretir ve düşünme süresi arttıkça doğruluk oranı yükselir. 4-bit kuantize edilmiş hali yaklaşık 20 GB VRAM ile tek bir RTX 3090/4090 üzerinde veya 32 GB birleşik belleğe sahip bir Mac'te çalışır; bu, o dönemde yalnızca bulut API'leriyle erişilebilen o1 sınıfı akıl yürütmeyi yerel hale getiren ilk pratik seçeneklerden biriydi. 2026 itibarıyla QwQ, tarihsel olarak önemli ama aktif geliştirmesi durmuş bir modeldir: Qwen ekibi Nisan 2025'te yayımlanan **Qwen3** serisini QwQ'nun resmi halefi ilan etti. Qwen3'ün hibrit "thinking / non-thinking" modları, QwQ'nun her soruda uzun uzun düşünme zorunluluğunu ortadan kaldırır. Yine de QwQ-32B, Hugging Face ve Ollama üzerinden indirilebilir durumda ve açık kaynak reasoning modellerinin gelişimini anlamak için referans noktası olmayı sürdürür.