tag Google
BERT (Bidirectional Encoder Representations) (BERT Doğal Dil Modeli)
Bu sayfada Google (BERT (Bidirectional Encoder Representations) (BERT Doğal Dil Modeli)) etiketi ile işaretlenmiş 7 yapay zeka kavramını bulabilirsiniz.
BERT (Bidirectional Encoder Representations from Transformers), Google'ın 2018'de açık kaynak olarak yayınladığı, metni soldan sağa ve sağdan sola aynı anda okuyarak her kelimenin bağlamını çözen Transformer tabanlı bir dil modelidir. GPT gibi üretken modeller bir sonraki kelimeyi tahmin ederken, BERT encoder-only mimarisiyle cümlenin tamamına bakar; bu yüzden metin sınıflandırma, varlık ismi tanıma (NER) ve soru cevaplama gibi **anlama** görevlerinde uzun süre standart model oldu. Modelin iki temel ön eğitim görevi vardır: **Masked Language Modeling (MLM)** ile token'ların yaklaşık %15'i maskelenir ve model bunları çift yönlü bağlamdan tahmin eder; **Next Sentence Prediction (NSP)** ile iki cümlenin ardışık olup olmadığı öğrenilir. Eğitim verisi BooksCorpus ve İngilizce Wikipedia'dan oluşan yaklaşık 3,3 milyar kelimedir. BERT-base 110 milyon, BERT-large 340 milyon parametre taşır; bağlam penceresi 512 token ile sınırlıdır. BERT'in en görünür etkisi arama motorlarında yaşandı. Google, Ekim 2019'da BERT'i arama sıralamasına entegre etti ve o dönemde İngilizce sorguların yaklaşık %10'unun anlaşılmasını iyileştirdiğini duyurdu; Aralık 2019'da model Türkçe dahil 70'ten fazla dile genişledi. "Brezilya'dan ABD'ye vize" gibi edatın anlamı değiştirdiği sorgularda arama niyeti ilk kez doğru okunmaya başladı. Bu, SEO'da anahtar kelime yoğunluğu yerine niyet odaklı içerik döneminin başlangıcı sayılır. 2026 itibarıyla BERT üretken sohbet modellerinin gölgesinde kalmış görünse de üretimde en çok çalıştırılan modellerden biri olmaya devam ediyor: Google aramada hâlâ sıralama sistemlerinin bir parçası, Hugging Face'te BERT türevleri (RoBERTa, DistilBERT, DeBERTa, 2024 çıkışlı ModernBERT) aylık yüz milyonlarca kez indiriliyor. Türkçe NLP'de dbmdz/bert-base-turkish-cased (BERTurk) duygu analizi ve NER projelerinin varsayılan başlangıç noktasıdır. Düşük maliyeti, birkaç yüz örnekle fine-tune edilebilmesi ve milisaniyelik çıkarım süresi, BERT'i sınıflandırma ve embedding işlerinde LLM'lere pratik bir alternatif olarak ayakta tutuyor.
BERT (Bidirectional Encoder Representations) (BERT Doğal Dil Modeli)
BERT (Bidirectional Encoder Representations from Transformers), Google'ın 2018'de açık kaynak olarak yayınladığı, metni soldan sağa ve sağdan sola aynı anda okuyarak her kelimenin bağlamını çözen Transformer tabanlı bir dil modelidir. GPT gibi üretken modeller bir sonraki kelimeyi tahmin ederken, BERT encoder-only mimarisiyle cümlenin tamamına bakar; bu yüzden metin sınıflandırma, varlık ismi tanıma (NER) ve soru cevaplama gibi **anlama** görevlerinde uzun süre standart model oldu. Modelin iki temel ön eğitim görevi vardır: **Masked Language Modeling (MLM)** ile token'ların yaklaşık %15'i maskelenir ve model bunları çift yönlü bağlamdan tahmin eder; **Next Sentence Prediction (NSP)** ile iki cümlenin ardışık olup olmadığı öğrenilir. Eğitim verisi BooksCorpus ve İngilizce Wikipedia'dan oluşan yaklaşık 3,3 milyar kelimedir. BERT-base 110 milyon, BERT-large 340 milyon parametre taşır; bağlam penceresi 512 token ile sınırlıdır. BERT'in en görünür etkisi arama motorlarında yaşandı. Google, Ekim 2019'da BERT'i arama sıralamasına entegre etti ve o dönemde İngilizce sorguların yaklaşık %10'unun anlaşılmasını iyileştirdiğini duyurdu; Aralık 2019'da model Türkçe dahil 70'ten fazla dile genişledi. "Brezilya'dan ABD'ye vize" gibi edatın anlamı değiştirdiği sorgularda arama niyeti ilk kez doğru okunmaya başladı. Bu, SEO'da anahtar kelime yoğunluğu yerine niyet odaklı içerik döneminin başlangıcı sayılır. 2026 itibarıyla BERT üretken sohbet modellerinin gölgesinde kalmış görünse de üretimde en çok çalıştırılan modellerden biri olmaya devam ediyor: Google aramada hâlâ sıralama sistemlerinin bir parçası, Hugging Face'te BERT türevleri (RoBERTa, DistilBERT, DeBERTa, 2024 çıkışlı ModernBERT) aylık yüz milyonlarca kez indiriliyor. Türkçe NLP'de dbmdz/bert-base-turkish-cased (BERTurk) duygu analizi ve NER projelerinin varsayılan başlangıç noktasıdır. Düşük maliyeti, birkaç yüz örnekle fine-tune edilebilmesi ve milisaniyelik çıkarım süresi, BERT'i sınıflandırma ve embedding işlerinde LLM'lere pratik bir alternatif olarak ayakta tutuyor.
Gemini (Google Gemini Yapay Zeka)
Gemini, Google DeepMind tarafindan gelistirilen multimodal yapay zeka modelidir. 2023 yilinda duyurulan Gemini, metin, goruntu, ses, video ve kod gibi farkli modaliteleri yerel olarak anlayip isleyebilen guclu bir dil modeli ailesidir. OpenAI'nin GPT modelleri ve Anthropic'in Claude'u ile rekabet eden Gemini, Google'ın yapay zeka stratejisinin merkezine yerlestirilmistir. Gemini modellerinin bircok boyutu vardir. Gemini Ultra, en buyuk ve en guclu model olup AGI yolundaki en gelismis surumudur. Gemini Pro, genis caplı uygulamalar icin dengeli guç ve verimlilik sunar. Gemini Nano ise mobil cihazlarda yerel olarak calistirilebilen, kaynak verimli surumudur. Bu hiyerarsik yapi, uygulamalarin gereksinimlerine gore dogru model buyuklugunu secmelerine olanak tanır. Gemini 1.5 Pro, genisletilmis baglam penceresi (1 milyon token'a kadar) ile one cikti. Bu ozellik, cok uzun belgeleri, saatlik video veya tum kod tabanlarini tek bir istem cercevesine sigdirmay mumkun kilar. 2024'te tanitilan Gemini 2.0 Flash ise daha hizli ve verimli bir yapida sunulmustur. Gemini, Google'in urun ekosistemiyle derin entegrasyona sahiptir. Google Search'te cevap uretimi (AI Overviews), Gmail'de yazma onerileri, Google Docs'ta icerik olusturma ve Android asistanı (Bard'dan Gemini adina gecis) bu entegrasyonlarin oncu ornekleridir. API erisimi Google AI Studio ve Vertex AI uzerinden saglanmaktadir.
Gemma (Google Açık Ağırlıklı Model Ailesi)
Gemma, Google DeepMind tarafından 2024 yılında duyurulan ve Apache 2.0 lisansı altında yayımlanan açık ağırlıklı büyük dil modelleri (LLM) ailesidir. Gemma modelleri, Google'ın kapalı kaynaklı Gemini modeliyle aynı araştırma altyapısı ve eğitim teknikleri kullanılarak geliştirilmiş; ancak model ağırlıkları toplulukla paylaşılmıştır. 2026 yılında yayımlanan Gemma 4 serisi (2 Nisan 2026), 1B, 4B, 12B ve 27B yoğun (dense) ile 26B Mixture-of-Experts (MoE) varyantlarını içermektedir. Tüm Gemma 4 modelleri 128.000 token bağlam penceresini (context window) destekler. En büyük varyant olan 31B Dense modeli, Arena AI sıralamalarında üçüncü sıraya yükselmiş; matematik, kodlama ve akıl yürütme görevlerinde Meta'nın Llama 4 Maverick modelini geride bırakmıştır. Gemma 4, tüm varyantlarında yerel olarak çok modlu (natively multimodal) bir mimari kullanır: metin, görüntü ve videoyu tek bir model içinde işleyebilir; küçük modeller ise ses girdisini de desteklemektedir. Bu yapı, Gemma'nın önceki sürümlerine kıyasla büyük bir sıçramayı temsil eder; 1B ve 4B gibi hafif modeller bile görüntü anlama kapasitesiyle donanmıştır. Google, Gemma ekosistemini genişletmek amacıyla özel amaçlı türevler de yayımlamıştır: CodeGemma kod üretmeye, ShieldGemma içerik güvenliğine, PaliGemma görsel-dil görevlerine odaklanmaktadır. Bu türevler, araştırmacıların belirli uygulama alanlarında düşük hesaplama maliyetiyle güçlü sonuçlar elde etmesine imkân tanır. Model ailesi ince ayar (fine-tuning) ve özelleştirme süreçlerinde yaygın tercih edilen modellerden biridir. Hugging Face, Google Cloud Vertex AI, Kaggle ve Google AI Studio üzerinden erişilebilmekte; Google'ın AI Edge çerçevesiyle mobil ve gömülü cihazlarda da barındırılabilmektedir. Gemma 4'ün 1B modeli, modern akıllı telefonlarda bile gerçek zamanlı çıkarım yapabilecek kapasitededir. Türkiye'deki geliştiriciler ve KOBİ'ler için Gemma; açık ağırlıklı yapısı, ticari kullanıma uygun lisansı ve yerel barındırma olanağı ile öne çıkmaktadır. Veri gizliliği hassasiyeti yüksek sektörlerde (sağlık, hukuk, finans) tamamen çevrimiçi API'lere bağlı kalmadan yapay zeka tabanlı uygulamalar geliştirmek için uygun bir başlangıç noktası sunar. Gemma'nın LoRA ve QLoRA destekli ince ayar süreçleri, Hugging Face PEFT kütüphanesi aracılığıyla 8 GB VRAM'li tüketici sınıfı GPU'larda bile alan-spesifik modeller üretmek için kullanılabilir. Bu esneklik, araştırma ekiplerine büyük bulut bütçelerine gerek kalmadan Gemma'yı hukuk, tıp veya finans gibi özelleştirilmiş alanlara uyarlamak için pratik bir yol açar.
Gemma 3 (Gemma 3)
Gemma, Latince "değerli taş" anlamına gelen ve Google DeepMind'ın açık ağırlıklı yapay zeka modeli ailesine verdiği isimdir; Gemma 3 ise bu ailenin 2025 yılında yayımlanan, çok modlu (multimodal) üçüncü nesil sürümüdür. 1B, 4B, 12B ve 27B parametre boyutlarında sunulan Gemma 3, metin ve görüntü anlama yeteneklerini tek mimaride birleştirir. Önceki Gemma 2'ye kıyasla uzun bağlam desteği (128K token), işlev çağırma (function calling) ve çok dilli performans belirgin şekilde iyileştirilmiştir. Gemma 3, Google'ın Gemini modellerinin eğitim altyapısından ve araştırma birikiminden yararlanan ama bağımsız bir ağırlık setine sahip model ailesidir. Ticari kullanıma açık Gemma lisansı altında yayımlanan bu modeller HuggingFace Transformers, Ollama ve LM Studio gibi platformlarda kolayca çalıştırılabilir. 27B parametreli versiyon, tek tüketici GPU'suna sığabilen en güçlü açık modellerden biridir; instruction-tuned (IT) varyantları sohbet ve görev yönlendirme için optimize edilmiştir. Gemma'nın önemi, güçlü bir modelin ağırlıklarını indirip kendi donanımınızda çalıştırabilmenizde yatar: Veri gizliliği gerektiren kurumsal senaryolarda, internet bağlantısız edge cihazlarda veya API maliyetinden kaçınmak istediğiniz projelerde yerel bir alternatif sunar. Performans açısından Gemma 3 27B, birçok kıyaslamada 70B ölçekli modellere yakın sonuçlar üretir; özellikle çok dilli anlama, kod üretimi ve görüntü açıklama görevlerinde güçlüdür. Türkçe dahil 140'tan fazla dili destekler. Pratikte `ollama run gemma3:4b` komutuyla dakikalar içinde denenebilir; kurumsal tarafta ise Google AI Studio ve Vertex AI üzerinden yönetilen API erişimi de mevcuttur.
TensorFlow (TensorFlow)
TensorFlow, Google Brain ekibinin 2015 yılında Apache 2.0 lisansıyla açık kaynak olarak yayımladığı, makine öğrenimi ve derin öğrenme modellerini geliştirmek, eğitmek ve üretime almak için kullanılan uçtan uca bir kütüphanedir. GitHub'da 190 binden fazla yıldıza ulaşan proje, hem araştırma prototiplerini hem de milyarlarca kullanıcıya hizmet veren üretim sistemlerini aynı altyapı üzerinde çalıştırır. İsim, iki kavramın birleşiminden gelir: **tensor**, çok boyutlu sayı dizilerini (skaler, vektör, matris ve daha yüksek boyutlar) temsil eden temel veri yapısıdır; **flow** ise bu tensörlerin bir hesaplama grafiği üzerindeki akışını anlatır. Grafikteki her düğüm bir matematiksel işlemdir; otomatik türev (autodiff) mekanizması bu grafik üzerinden gradyanları hesaplayarak geri yayılımı (backpropagation) otomatikleştirir. TensorFlow 1.x'in statik graf ve `session` yapısı öğrenmeyi zorlaştırıyordu. 2019'daki TensorFlow 2.0, eager execution'ı varsayılan yaptı ve Keras'ı resmi yüksek seviyeli API olarak benimsedi; böylece bir görüntü sınıflandırma modeli 10 satırın altında kodla tanımlanabilir hale geldi. `tf.function` dekoratörü ise aynı kodu XLA derleyicisiyle optimize edilmiş grafa çevirerek Python esnekliği ile graf performansını birleştirir. Donanım desteği kütüphanenin en güçlü yanlarından biridir: CPU, NVIDIA GPU (CUDA), Apple Silicon (Metal) ve Google'ın kendi tasarladığı TPU'larda aynı kod çalışır. TPU v5e ve sonrası pod'larda binlerce çipe ölçeklenen dağıtık eğitim, `tf.distribute` API'siyle birkaç satırlık değişiklikle kurulur. 2026 itibarıyla güncel kararlı sürüm TensorFlow 2.21 serisidir; NumPy 2.x uyumluluğu ve uç cihazlar için int2/int4 kuantizasyon desteği bu dönemde eklendi. Mobil tarafta TensorFlow Lite, Google AI Edge çatısı altında LiteRT adıyla bağımsız bir projeye dönüştü ve artık TensorFlow'un yanı sıra PyTorch ile JAX modellerini de çalıştırıyor. Keras 3 ise çoklu-backend mimarisiyle aynı model kodunun TensorFlow, JAX veya PyTorch üzerinde koşmasına imkân tanıyor; Google'ın araştırma tarafında JAX'e yönelmesine karşın TensorFlow üretim dağıtımı, TF Serving ve TFX boru hatlarıyla kurumsal tarafta konumunu koruyor. Kütüphaneyi tek başına bir araçtan çok bir ekosistem olarak düşünmek gerekir. Model geliştirme Keras ile, eğitim izleme TensorBoard ile, veri boru hatları `tf.data` API'siyle, üretim servisleme TF Serving ile, uçtan uca MLOps süreçleri ise TFX ile yönetilir. Tarayıcıda çalışan TensorFlow.js, sunucuya veri göndermeden gizlilik dostu çıkarım yapar; TensorFlow Hub ve Kaggle Models üzerindeki binlerce önceden eğitilmiş model, transfer öğrenmeyle özel bir görevi birkaç saatlik eğitimle çözmeye yeter. Bu bütünlük, tek bir prototipin veri hazırlığından mobil uygulamadaki çıkarıma kadar aynı araç zincirinde ilerlemesini mümkün kılar. Google Arama, YouTube öneri motoru, Google Translate, Airbnb, Uber, Twitter/X ve Spotify gibi sistemlerde üretimde kullanılan TensorFlow; bilgisayarlı görü, doğal dil işleme, öneri sistemleri, zaman serisi tahmini ve konuşma tanıma alanlarında sektör standardı araç zincirleri sunar. Python birincil dil olmakla birlikte C++, JavaScript (TensorFlow.js) ve Java/Kotlin (LiteRT) ile de model çalıştırılabilir. Yeni başlayanlar için resmi tensorflow.org eğitimleri, ücretsiz GPU sunan Google Colab not defterleri ve Coursera'daki TensorFlow Developer sertifika programları en yaygın öğrenme yollarıdır; temel Python ve lise düzeyi lineer cebir bilgisi ilk çalışan modeli eğitmek için çoğu durumda fazlasıyla yeterlidir.
TPU (Tensor Processing Unit) (Tensör İşlem Birimi)
TPU (Tensor Processing Unit), Google tarafindan buyuk olcekli makine ogrenmesi is yuklerini, ozellikle derin sinir agi egitimini ve cikarsama islemlerini hizlandirmak icin tasarlanmis ozel amacli bir entegre devre (ASIC — Application-Specific Integrated Circuit). 2016 yilinda Google'in dahili kullanim icin gelistirmis; 2018'den itibaren Google Cloud uzerinden dis kullanicilara da sunulmustur. TPU'lar, matris cogaltma islemlerine (matrix multiplication) ozellesmis yapilarindan dolayi standart CPU ve GPU'dan farkliliklar ortaya koyar. Derin ogrenme modellerindeki en hesaplama yogun operasyon — ornegin transformer'larin dikkat hesaplama veya convolutional katmanlar — matris cogaltma icerir. TPU'nun Systolic Array mimarisi bu operasyonu paralel ve yuksek bant genisligiyle gerceklestirir. TPU surumleri tarihsel gelisimini yansitiyor: TPU v1 yalnizca cikarsama; TPU v2 ve v3 hem egitim hem cikarsama; TPU v4 ve v5 cok buyuk modellerin (LLM) egitimi icin optimize edilmistir. Google'ın PaLM, Gemini ve AlphaFold modelleri TPU kümelerinde (pod) egitilmistir. Google Cloud TPU Pods, binlerce TPU v4 cekirdegini yuksek bant genislikli agla birlestirerek devasa modellerin egitilmesini olanaklı kilar. JAX (Google'in otomatik turv ve XLA derleme kutuphanesi), TensorFlow ve PyTorch XLA modu ile TPU'lar programlanabilir. Kullanicilara Google Colab veya Cloud TPU uzerinden erisim saglanmaktadir.
Transformer (Dönüştürücü Mimarisi)
Transformer, 2017'de Google araştırmacılarının "Attention Is All You Need" makalesiyle tanıttığı ve bugünkü yapay zeka modellerinin büyük bölümünün temelini oluşturan derin öğrenme mimarisidir. Veriyi kelime kelime, sıralı biçimde işleyen RNN ve LSTM modellerinin aksine Transformer, Self-Attention (öz-dikkat) mekanizmasıyla bir dizideki tüm öğeleri aynı anda işler: her kelime, cümledeki diğer tüm kelimelerle ilişkisini eşzamanlı hesaplar. Bu paralel çalışma biçimi iki büyük sorunu birden çözer. Birincisi, GPU'ların matris çarpımındaki gücünden tam olarak yararlanıldığı için eğitim çok daha hızlıdır; devasa veri setleriyle milyarlarca parametreli model eğitmek ancak bu mimariyle pratik hale gelmiştir. İkincisi, uzak kelimeler arasındaki bağlamsal ilişkiler kaybolmaz; model uzun bir metnin başındaki bilgiyi sonunda da hatırlar. Transformer'ın önemi dil işlemeyle sınırlı kalmadı. ChatGPT, Claude, Gemini ve Llama gibi büyük dil modellerinin (LLM) tamamı bu mimari üzerine kuruludur; BERT arama motorlarında sorgu anlamada, GPT ailesi metin ve kod üretiminde kullanılır. Görüntü tarafında Vision Transformer (ViT) sınıflandırma ve nesne tanımada CNN'lere güçlü bir alternatif oldu; Whisper konuşma tanımada, AlphaFold 2 ise protein yapısı tahmininde aynı temeli kullanır. Pratikte bugün bir sohbet botuyla konuştuğunuzda, makine çevirisi yaptığınızda veya yapay zeka destekli kod tamamlama kullandığınızda arka planda neredeyse her zaman bir Transformer çalışır. Mimarinin bir diğer kritik özelliği öngörülebilir ölçeklenmesidir: parametre, veri ve hesaplama arttıkça performans da düzenli biçimde artar; bu ölçekleme yasaları son yılların yapay zeka araştırma gündemini belirlemiştir.