tag QwQ
Bu sayfada QwQ etiketi ile işaretlenmiş 2 yapay zeka kavramını bulabilirsiniz.
QwQ, Alibaba'nın Qwen ekibi tarafından geliştirilen, cevap vermeden önce uzun bir düşünce zinciri (chain-of-thought) üreten 32 milyar parametreli açık kaynak akıl yürütme (reasoning) modelidir. İlk önizlemesi **QwQ-32B-Preview** adıyla Kasım 2024'te, stabil sürümü **QwQ-32B** ise 5 Mart 2025'te Apache 2.0 lisansıyla yayımlandı. Model, Qwen2.5-32B tabanı üzerine takviye öğrenme (reinforcement learning) ile eğitildi ve AIME24 matematik kıyaslamasında 79,5 puan alarak kendisinden yaklaşık 20 kat büyük 671B parametreli DeepSeek-R1'in 79,8 puanına neredeyse eşit performans gösterdi; OpenAI o1-mini'yi (63,6) ise açık farkla geçti. İsmin ikinci ve daha eski bir anlamı da var: **qwq**, internet ve anime kültüründe ağlayan bir yüzü temsil eden metin ifadesidir. İki "q" harfi yaşlı gözleri, ortadaki "w" ise büzülmüş ağzı simgeler; "uwu" ve "owo" ifadeleriyle aynı aileden gelir ve Discord, Twitch, TikTok gibi platformlarda "üzgünüm ama sevimliyim" tonunda kullanılır. Qwen ekibi model adını seçerken bu ifadeye bilinçli bir gönderme yaptı; "Qwen with Questions" açılımı da bu kelime oyununun üzerine oturur. QwQ'nun teknik önemi, **test-time compute** paradigmasını tüketici donanımına indirmesinde yatar: model, çıkarım sırasında `<think>...</think>` etiketleri arasında yüzlerce hatta binlerce token uzunluğunda iç monolog üretir ve düşünme süresi arttıkça doğruluk oranı yükselir. 4-bit kuantize edilmiş hali yaklaşık 20 GB VRAM ile tek bir RTX 3090/4090 üzerinde veya 32 GB birleşik belleğe sahip bir Mac'te çalışır; bu, o dönemde yalnızca bulut API'leriyle erişilebilen o1 sınıfı akıl yürütmeyi yerel hale getiren ilk pratik seçeneklerden biriydi. 2026 itibarıyla QwQ, tarihsel olarak önemli ama aktif geliştirmesi durmuş bir modeldir: Qwen ekibi Nisan 2025'te yayımlanan **Qwen3** serisini QwQ'nun resmi halefi ilan etti. Qwen3'ün hibrit "thinking / non-thinking" modları, QwQ'nun her soruda uzun uzun düşünme zorunluluğunu ortadan kaldırır. Yine de QwQ-32B, Hugging Face ve Ollama üzerinden indirilebilir durumda ve açık kaynak reasoning modellerinin gelişimini anlamak için referans noktası olmayı sürdürür.
Qwen (Alibaba Dil Modeli Ailesi)
Qwen (telaffuz: "Chwen"), Alibaba Group'un DAMO Academy birimi tarafından geliştirilen açık kaynaklı büyük dil modelleri ailesidir. 2023 yılında kamuoyuyla paylaşılan Qwen serisi, hem yoğun (dense) hem de Mixture-of-Experts (MoE) mimarileri kullanarak metin anlama, kod üretimi, matematiksel akıl yürütme ve çok modlu (görüntü, video, ses) işleme yetenekleri sunar. 2026 itibarıyla en güncel modeller Qwen3.7 Max ve Qwen3.7 Plus olup 1 milyon token bağlam penceresi sunmaktadır. Qwen serisi; karmaşık problemler için adım adım düşünen "düşünme modu" (thinking mode) ile hızlı yanıt gerektiren görevler için "diyalog modu" (non-thinking mode) arasında geçiş yapabilme özelliğine sahiptir. Bu ikili mod yaklaşımı, DeepSeek-R1'in popülerleştirdiği ayrım stratejisine paralel şekilde geliştirilmiştir. Qwen ailesi kapsamında özelleşmiş varyantlar bulunmaktadır: akıl yürütme odaklı QwQ modelleri; kod yazmaya özel Qwen-Coder; görsel algılama için Qwen-VL; ses işleme için Qwen-Audio; matematik çözme için Qwen-Math. Modeller Apache 2.0 veya Qwen lisansı altında Hugging Face'te yayımlanmaktadır. Türkçe dahil 100'den fazla dili destekleyen Qwen, Hugging Face Open LLM Leaderboard başta olmak üzere birçok kıyaslamada Meta'nın Llama serisi ve Google'ın Gemma'sıyla rekabet edebilir puanlar almıştır. Özellikle Qwen-Coder 2.5 modeli, HumanEval ve MBPP gibi kod kıyaslamalarında Llama-70B düzeyinde performans göstererek dikkat çekmiştir. Geliştiriciler için Qwen'in temel çekiciliği maliyet-verimlilik dengesindedir: MoE mimarisi, aynı parametre boyutundaki dense modellere kıyasla çok daha az hesaplama kaynağıyla çalışır. Yerelde Ollama veya LM Studio gibi araçlarla donanım kısıtları olan ortamlarda dahi barındırılabilen küçük versiyonları (0.5B–7B) mevcuttur. Alibaba Cloud API (DashScope) üzerinden de erişilebilen Qwen, Together AI ve OpenRouter gibi platformlarda da listelenmektedir. Açık ağırlık stratejisi ve geniş dil desteğiyle Qwen, küresel ölçekte kurumsal yapay zeka projelerinde Meta Llama'ya ciddi bir alternatif konumuna gelmiştir. Qwen'in eğitim sürecinde kullanılan veri karmasında çok dilli içerik ağırlıklı olarak yer almaktadır. Özellikle Qwen2.5 serisinde Türkçe dahil düşük kaynaklı diller için ayrıca özel ince-ayar (fine-tuning) veri setleri kullanılarak dil performansı iyileştirilmiştir. Bu süreç, modelin Türkçe bağlamı anlama ve tutarlı yanıt üretme becerisini güçlendirmektedir.
QwQ (QwQ)
QwQ, Alibaba'nın Qwen ekibi tarafından geliştirilen, cevap vermeden önce uzun bir düşünce zinciri (chain-of-thought) üreten 32 milyar parametreli açık kaynak akıl yürütme (reasoning) modelidir. İlk önizlemesi **QwQ-32B-Preview** adıyla Kasım 2024'te, stabil sürümü **QwQ-32B** ise 5 Mart 2025'te Apache 2.0 lisansıyla yayımlandı. Model, Qwen2.5-32B tabanı üzerine takviye öğrenme (reinforcement learning) ile eğitildi ve AIME24 matematik kıyaslamasında 79,5 puan alarak kendisinden yaklaşık 20 kat büyük 671B parametreli DeepSeek-R1'in 79,8 puanına neredeyse eşit performans gösterdi; OpenAI o1-mini'yi (63,6) ise açık farkla geçti. İsmin ikinci ve daha eski bir anlamı da var: **qwq**, internet ve anime kültüründe ağlayan bir yüzü temsil eden metin ifadesidir. İki "q" harfi yaşlı gözleri, ortadaki "w" ise büzülmüş ağzı simgeler; "uwu" ve "owo" ifadeleriyle aynı aileden gelir ve Discord, Twitch, TikTok gibi platformlarda "üzgünüm ama sevimliyim" tonunda kullanılır. Qwen ekibi model adını seçerken bu ifadeye bilinçli bir gönderme yaptı; "Qwen with Questions" açılımı da bu kelime oyununun üzerine oturur. QwQ'nun teknik önemi, **test-time compute** paradigmasını tüketici donanımına indirmesinde yatar: model, çıkarım sırasında `<think>...</think>` etiketleri arasında yüzlerce hatta binlerce token uzunluğunda iç monolog üretir ve düşünme süresi arttıkça doğruluk oranı yükselir. 4-bit kuantize edilmiş hali yaklaşık 20 GB VRAM ile tek bir RTX 3090/4090 üzerinde veya 32 GB birleşik belleğe sahip bir Mac'te çalışır; bu, o dönemde yalnızca bulut API'leriyle erişilebilen o1 sınıfı akıl yürütmeyi yerel hale getiren ilk pratik seçeneklerden biriydi. 2026 itibarıyla QwQ, tarihsel olarak önemli ama aktif geliştirmesi durmuş bir modeldir: Qwen ekibi Nisan 2025'te yayımlanan **Qwen3** serisini QwQ'nun resmi halefi ilan etti. Qwen3'ün hibrit "thinking / non-thinking" modları, QwQ'nun her soruda uzun uzun düşünme zorunluluğunu ortadan kaldırır. Yine de QwQ-32B, Hugging Face ve Ollama üzerinden indirilebilir durumda ve açık kaynak reasoning modellerinin gelişimini anlamak için referans noktası olmayı sürdürür.