Cluster Rehber

Görsel Prompt Rehberi: Midjourney ve DALL-E İçin

Yapay zeka ile görsel üretmenin sırrı doğru promptta. Konu, stil, ışık ve teknik parametrelerle Midjourney, DALL-E ve Stable Diffusion için etkili görsel prompt yazmayı öğrenin.

Metin modeline “bana bir tanıtım yazısı yaz” dediğinizde eksik kalan yeri model kendi mantığıyla tamamlar. Görsel modelde böyle bir lüks yok. Midjourney’e “güzel bir manzara” derseniz size ortalama bir stok fotoğrafı verir, çünkü hangi ışığı, hangi açıyı, hangi ruh halini istediğinizi söylemediniz. Metin promptlamanın temelini prompt yazma rehberimiz baştan sona anlatıyor, ama görselde işler bambaşka yürüyor. Burada bir talimat değil, bir sahne tarif ediyorsunuz.

Fark şurada: metin modeli anlamı işler, görsel model ise görüntüyü. Bir difüzyon modeli rastgele gürültüden başlayıp adım adım sizin tarif ettiğiniz kareye doğru gürültüyü temizler. O yüzden yazdığınız her kelime bir görsel karar demek. Bu rehber görsel promptun altı katmanını, stil anahtar kelimelerini, Midjourney parametrelerini ve en sık düşülen tuzakları kopyala-yapıştır örneklerle topluyor.

Metin tarafındaki temel prompt mantığını atladıysanız önce ona göz atın: pillar Prompt Yazma Rehberi. Bu cluster yalnızca görsel üretim tarafına odaklanır.

Görsel Promptun Anatomisi: Altı Katman

İyi bir görsel prompt aslında altı sorunun cevabıdır. Hepsini her seferinde yazmanız gerekmez, ama ne kadar çoğunu netleştirirseniz sonuç o kadar sizin kafanızdaki kareye yaklaşır.

  • Konu. Karede kim ya da ne var? “Yaşlı bir balıkçı”, “mat siyah bir kupa”, “çam ormanı”. Bu ne kadar somutsa model o kadar az doğaçlama yapar.
  • Ortam. Nerede geçiyor? İç mekan mı, gün batımı mı, stüdyo mu, sokak mı? Ortam hem arka planı hem atmosferi belirler.
  • Işık. Görsel promptun en çok atlanan ama en belirleyici katmanı. “Yumuşak pencere ışığı”, “sert öğle güneşi”, “altın saat”, “sinematik yan ışık”. Işık değişince aynı sahne tamamen başka bir fotoğraf olur.
  • Stil. Fotoğraf mı, yağlıboya mı, 3B render mı, düz vektör mü? Model bir estetik seçmek zorunda; siz seçmezseniz kendi seçer.
  • Kompozisyon. Yakın çekim mi, geniş açı mı? Özne solda mı ortada mı? “Üstte boşluk bırak” gibi bir not, görseli sonradan başlık ekleyeceğiniz bir kapağa çevirir.
  • Teknik. Lens, film türü, çözünürlük, en boy oranı gibi fotoğrafik detaylar. “85mm lens”, “Kodak Portra 400”, “shallow depth of field” gibi terimler modele referans veriyor.

Bu katmanları bir portre örneğinde birleştirelim. Konu, ışık ve teknik birlikte çalışınca çıkan fark net görülür:

close-up portrait of a middle-aged fisherman, weathered face,
salt-and-pepper beard, soft window light from the left,
shallow depth of field, shot on 85mm lens, Kodak Portra 400 film,
muted earthy tones --ar 4:5 --v 6 --style raw

Buradaki her öbek bir katmana denk geliyor: konu (balıkçı), ışık (soldan yumuşak pencere ışığı), teknik (85mm, film türü, alan derinliği). Aynı promptu ışık satırını çıkarıp deneyin, yüz ifadesi bile değişecektir.

Bir ürün fotoğrafında ise kompozisyon ve arka plan öne çıkar. E-ticaret için tipik bir kare:

product photo of a matte black ceramic coffee mug on a marble
countertop, soft diffused studio lighting, subtle steam rising,
minimal background, high detail, commercial photography
--ar 1:1 --v 6 --style raw --no text logo hands

Not: --no text logo hands kısmı istemediğiniz şeyleri sayıyor. Ürün fotoğraflarında modelin kadraja rastgele bir el ya da uydurma bir logo sokması sık görülür; bunları baştan dışlamak zaman kazandırır.

Stil ve Sanatçı Anahtar Kelimeleri

Görsel modeller, üzerinde eğitildikleri milyonlarca etiketli görüntüden stil çıkarır. Yani doğru anahtar kelimeyi verdiğinizde modelin hafızasındaki koca bir estetik kümesini çağırıyorsunuz. Birkaç işe yarayan grup:

  • Ortam/medya: “oil painting”, “watercolor”, “3D render”, “flat vector illustration”, “isometric”, “pencil sketch”, “cinematic photography”.
  • Dönem/akım: “art deco”, “bauhaus”, “cyberpunk”, “vaporwave”, “minimalist”, “brutalist”.
  • Fotoğrafik referans: “shot on film”, “golden hour”, “long exposure”, “macro”, “bokeh”, “wide angle”.
  • Ruh hali: “moody”, “warm and cozy”, “high contrast”, “dreamy”, “editorial”.

Manzara örneğinde stil ve ışığı birlikte kullanmak atmosferi tek başına belirler:

wide landscape of a misty pine forest at dawn, volumetric fog
between the trees, golden sunbeams breaking through,
cold blue shadows, cinematic wide shot, ultra detailed --ar 16:9 --v 6

Sanatçı adları konusunda dikkatli olun. Bazı modeller belirli sanatçı isimlerini artık filtreliyor ya da telif tartışması nedeniyle kısıtlıyor. Yaşayan bir sanatçının adını kopyalamak yerine, o sanatçının stilini tanımlayan sıfatları yazmak hem daha güvenli hem çoğu zaman daha esnek. “Van Gogh style” yerine “thick expressive brushstrokes, swirling night sky, vivid blues and yellows” yazmak size stilin kontrolünü bırakır.

Midjourney Parametreleri

Midjourney’de asıl kontrol, promptun sonuna eklenen parametrelerde. Bunlar iki tire ile başlar ve modelin davranışını doğrudan ayarlar. En çok kullanılanlar:

ParametreNe yaparÖrnek
--arEn boy oranı (aspect ratio)--ar 16:9, --ar 4:5, --ar 1:1
--vModel sürümü--v 6
--style rawMidjourney’nin otomatik estetik dokunuşunu azaltır, daha ham/gerçekçi--style raw
--chaosVaryasyonlar arası çeşitliliği artırır (0-100)--chaos 25
--noNegatif: karede istemediğiniz öğeleri dışlar--no text, blur
--stylizeModelin sanatsal yorumunun gücü (0-1000)--stylize 250

Pratik öneriler:

  • --ar her zaman yazın. Varsayılan kare (1:1) çoğu iş için yanlıştır. Blog kapağına --ar 16:9, Instagram gönderisine --ar 4:5, hikaye için --ar 9:16 daha uygun.
  • Gerçekçilik istiyorsanız --style raw ekleyin. Midjourney varsayılan olarak görüntüye hafif bir “güzelleştirme” katıyor; ürün ve belgesel tarzı işlerde bunu kapatmak daha inandırıcı sonuç veriyor.
  • --chaos düşük tutun. Aynı konseptin tutarlı varyasyonlarını istiyorsanız 0-15 bandında kalın. Yaratıcı keşif için 40 ve üstünü deneyin.

Düz vektör bir logo denemesi, parametrelerin nasıl bir arada çalıştığını gösteriyor:

minimalist flat vector logo of a mountain and a rising sun,
two-color palette deep teal and warm orange, geometric shapes,
clean lines, solid white background --ar 1:1 --v 6 --style raw
--no gradient, photo, shadow, text

Uyarı: Midjourney metin yazmakta hala zayıf. Logoya marka adını modelin yazmasını beklemeyin; markayı boş bırakıp yazıyı sonradan bir tasarım aracında ekleyin. Yukarıdaki promptta --no text tam da bunun için var.

İzometrik illüstrasyon, sunum ve arayüz görsellerinde çok işe yarıyor:

isometric 3D illustration of a cozy home office, warm desk lamp,
potted plants, laptop and a cup of coffee, pastel color palette,
soft ambient occlusion, clean render --ar 1:1 --v 6

DALL-E ve ChatGPT Görsel İçin İpuçları

DALL-E ve ChatGPT içindeki görsel üretimi Midjourney’den farklı bir mantıkla çalışır. Burada iki tire parametreleri yoktur; model doğal dili doğrudan anlar. Yani kısa anahtar kelime öbekleri yerine tam bir cümleyle, neredeyse bir sahne yönetmeni gibi tarif etmek daha iyi sonuç verir.

A friendly 3D cartoon robot watering a small potted plant on a
sunny windowsill. Soft pastel colors, rounded shapes, gentle
morning light, Pixar-style rendering, centered composition with
plenty of empty space at the top for a headline.

ChatGPT üzerinden çalışırken bir avantajınız var: görseli ürettikten sonra “ışığı biraz daha sıcak yap”, “robotu sola kaydır”, “arka planı sadeleştir” gibi konuşarak düzeltme yapabilirsiniz. Midjourney’de bunu yeni promptla yeniden denersiniz; ChatGPT’de sohbet sürer. En boy oranını da cümleyle isteyebilirsiniz: “yatay 16:9 formatında” ya da “dikey story formatı” demek yeterli.

DALL-E metni Midjourney’den daha iyi yazar ama hala güvenilmez. Kısa ve tek kelimelik metinlerde (bir tabela, bir etiket) şansınız yüksek; uzun cümlelerde harfler bozulur. Hangi aracın hangi işte önde olduğunu karşılaştıran güncel bir döküm için yapay zeka görsel oluşturma araçları 2026 yazısına bakabilirsiniz.

Negatif Prompt ve Sık Hatalar

Negatif prompt, modele “bunları yapma” demenin yoludur. Stable Diffusion’da ayrı bir alan olarak girilir; Midjourney’de --no ile, DALL-E’de ise cümle içinde belirtilir. Özellikle insan figüründe bozuk eller ve fazladan parmak sorununa karşı hayat kurtarır:

Positive: professional headshot of a young woman, natural makeup,
soft studio lighting, sharp focus, 50mm lens, detailed skin texture

Negative: extra fingers, deformed hands, blurry, low resolution,
watermark, text, oversaturated, plastic skin, extra limbs

Yeni başlayanların en sık yaptığı dört hata:

  • Prompta her şeyi tıkmak. Otuz sıfat yazınca model hepsine birden odaklanamaz ve bulanık bir ortalama üretir. Beş altı güçlü katman, yirmi zayıf kelimeden iyidir.
  • Işığı hiç yazmamak. Fotoğrafın ruhu ışıktadır. “soft light”, “backlit”, “golden hour” gibi tek bir satır sonucu bambaşka yapar.
  • En boy oranını unutmak. Kare bir görseli sonradan yatay kapağa kırpmaya çalışmak konuyu bozar. Baştan --ar ile doğru oranı isteyin.
  • Metni modele yazdırmaya çalışmak. Görsel modeller yazıda kötüdür. Metni sonradan ekleyin; görsele boşluk bıraktırın.

Bir promptun neden çalışmadığını anlamanın en pratik yolu, tek seferde tek değişken oynamaktır. Işığı değiştirin, gerisini sabit tutun; sonra stili değiştirin. Bu şekilde hangi kelimenin neyi kontrol ettiğini kısa sürede öğrenirsiniz. Metinden görsel üreten bu üretken yapay zeka ailesinde çıktının kalitesi neredeyse tamamen promptun kalitesine bağlı; model aynı, fark tarifte.

Sık Sorulan Sorular

Görsel prompt İngilizce mi Türkçe mi yazılmalı?

Çoğu görsel model ağırlıklı olarak İngilizce etiketli veriyle eğitildiği için anahtar kelimeleri İngilizce yazmak daha isabetli sonuç verir. “golden hour”, “shallow depth of field”, “isometric” gibi terimlerin İngilizcesi modelin hafızasında net karşılıklara sahip. Türkçe yazınca model çoğu zaman anlar ama daha genel bir yorum yapar. Pratik yol: sahneyi Türkçe düşünüp anahtar kelimeleri İngilizce yazmak.

Midjourney mi DALL-E mi daha iyi?

İşe göre değişir. Midjourney sinematik, sanatsal ve fotoğrafik görsellerde estetik olarak önde; parametrelerle ince kontrol sunuyor. DALL-E ise ChatGPT içinde konuşarak düzeltme, kavramsal illüstrasyon ve metin yazımında daha rahat. Stable Diffusion’ı ise kendi donanımınızda ücretsiz çalıştırıp negatif prompt ve model ağırlıklarında tam kontrol istiyorsanız seçersiniz. Çoğu profesyonel üçünü de işe göre değiştiriyor.

Negatif prompt her modelde var mı?

Kavram her yerde var ama girişi farklı. Stable Diffusion’da ayrı bir negatif alan bulunur ve en güçlü haliyle orada çalışır. Midjourney’de --no öğe1, öğe2 biçiminde promptun sonuna eklenir. DALL-E ve ChatGPT’de ayrı alan yoktur; “arka planda metin olmasın, el görünmesin” gibi cümlelerle belirtirsiniz. Bozuk el ve fazla parmak sorununda en çok işe yarayan Stable Diffusion’ın negatif alanıdır.

Aynı promptu her çalıştırdığımda neden farklı görsel çıkıyor?

Difüzyon modelleri rastgele bir gürültü tohumundan (seed) başlar ve her seferinde farklı bir tohum kullanır. Aynı kareyi tekrar üretmek isterseniz seed değerini sabitlemeniz gerekir; Midjourney’de --seed parametresiyle, Stable Diffusion’da arayüzdeki seed alanıyla yapılır. Sabit seed, promptta ufak değişiklikler denerken kompozisyonu koruyup yalnızca değiştirdiğiniz katmanı gözlemlemenizi kolaylaştırır.