MAI-Image-2.6 promptları: Microsoft'tan dört ders
Microsoft'un MAI-Image-2.6 modeli Arena'da ikinci sıraya girdi. Bu sürümün daha uzun ömürlü kısmı ise yanında yayımlanan promptlar: dört yazım biçimi ve her modele taşınabilen dört kural.

Microsoft AI, 10 Ağustos 2026'da MAI-Image-2.6 modelini duyurdu ve modelin Arena metinden görsele sıralamasında ikinci olduğunu, MAI-Image-2.5'e göre genelde +79 Elo, yalnızca metin işlemede ise +91 Elo kazandığını açıkladı. Başlık bu ve sıralama başlıkları çoğu zaman hızla eskiyor.
Bu sürümün raf ömrü daha uzun olan kısmı çok daha sessiz kaldı: MAI-Image-2, MAI-Image-2.5 ve MAI-Image-2.6 sayfalarında Microsoft, örnek görsellerin arkasındaki promptların kendisini yayımladı. Bu promptlar rastgele bir derleme değil. Bir görsel modeline yazmanın belirgin biçimde farklı dört yolu ve her biri belirli bir işi yapıyor: betimlemek, sıkıştırmak, düzenlemek, alıntılamak.
MAI-Image, OmniArt model listesinde yer almıyor; dolayısıyla bu yazı burada çalıştırabileceğiniz bir modelin incelemesi değil. Bu, oradaki prompt zanaatının bir okuması, çünkü o zanaat taşınabiliyor. Aşağıdaki dört kalıp, bugünün yetkin görsel modellerinin hepsinde çalışıyor ve her seferinde ders aynı biçimde çıkıyor: prompta ne koyduğunuz, hangi hatayla karşılaşacağınızı belirliyor.
MAI-Image 2, 2.5 ve 2.6 neler getirdi
Beş aydan kısa sürede üç sürüm çıktı ve her birinin ağırlık merkezi farklıydı.
| Sürüm | Duyuru | Microsoft'un konumlandırması | Arena iddiası |
|---|---|---|---|
| MAI-Image-2 | 19 Mart 2026 | Fotogerçekçilik, görsel içi metin, zengin sahne üretimi — "kreatiflerle birlikte kuruldu" | Model ailesi sıralamasında 3. |
| MAI-Image-2.5 | Model sayfası | Hassas düzenleme, malzeme doğruluğu, tasarıma hazır çıktı; Pro / standart / Flash | Metinden görsele 3., 2 Haziran 2026 itibarıyla |
| MAI-Image-2.6 | 10 Ağustos 2026 | Metin işleme, portre ve 3B, ticari ve sinematik işçilik | Metinden görsele 2.; 2.5'e göre +79 Elo |
MAI-Image-2.5 ayrıca bir aileye bölündü: nesne tutarlılığı ve görsel akıl yürütme için 2.5-Pro, üretimle birlikte denetlenebilir düzenleme için 2.5 ve Microsoft'un amiral gemisinin yarısından düşük bir fiyata üretime hazır dediği 2.5-Flash. 2.5 model sayfasında "Image Arena Elo'ya karşılık 1.000 görsel başına temsili API fiyatı" grafiği yer alıyor ve bu grafik ekibin neyi iyileştirdiğini gösteriyor: yalnızca tepe kalite değil, harcanan para başına kalite.
2.6 için Microsoft henüz ayrıntılandırılmamış başlıklar olduğunu söylüyor: "birden fazla referans üzerinde çalışmaktan ve daha zengin temellendirmeden, akıl yürütme, format ve çözünürlük üzerinde daha fazla denetime kadar." Bunlar herkese açık çıkana kadar birer yol haritası beyanı sayılır, teknik özellik değil.
Ders 1: uzun ve yapılandırılmış prompt her bilgiyi kendi kutusuna koyar
MAI-Image-2.5 sayfasındaki fotogerçekçilik örneğinin arkasındaki prompt yaklaşık 90 kelime ve yapısı uzunluğundan daha ilgi çekici:
A young woman in profile on a rooftop, blowing soap bubbles against an overcast sky. She has long straight black hair, windswept slightly, and wears a dark navy double-breasted school uniform jacket with gold buttons and a white collar. She holds a hot pink bubble solution bottle in one hand and a neon lime-green wand to her lips in the other. Five iridescent bubbles of varying sizes float around her.
Behind her: low-rise apartment buildings under a flat gray sky, a black metal railing, and weathered concrete underfoot. Film photography aesthetic.

Onu düz yazı gibi değil, bir form gibi yeniden okuyun. İlk cümle özne, duruş, eylem ve gökyüzü. İkinci cümle saç ve kıyafet. Üçüncü cümle aksesuarlar, her ele bir tane. Dördüncü cümle sayılabilir bir öğe. Ardından etiketli bir blok — Behind her: — çevreye ait her şeyi üstleniyor ve iki kelimelik bir stil yönergesi promptu kapatıyor.
Bu yapıda gerçekten iş gören üç şey var:
- Sıfat yerine renk adı. "Hot pink", "neon lime-green", "dark navy", "gold", "flat gray". "Parlak" değil, "renkli" değil. Renk adı, modelin karşılayabileceği ya da gözle görülür biçimde ıskalayabileceği bir kısıttır; "vibrant" böyle bir kısıt değildir.
- Belirsiz miktar yerine sayı. "Five iridescent bubbles of varying sizes" doğrulanabilir, "some bubbles" doğrulanamaz. Yayımlanan çıktıda sayı tutuyor; görselin karşısına geçip sayabilirsiniz ve asıl mesele de bu.
- Arka plan kendi kabını alır.
Behind her:çevreyi çitle ayırır, böylece ayrıntıları özne betimlemesine sızmaz. Uzun promptlar, modelin bir niteleyicinin hangi ada ait olduğunu tahmin etmek zorunda kaldığı yerde çöker.
Stil kelimesi en sona, içerikten sonra düşer; böylece kompozisyonu kendisi yönlendirmek yerine, zaten tümüyle belirlenmiş bir sahneyi niteler.
İpucu
Uzun promptları düz yazı gibi değil, kutular hâlinde yazın: özne ve eylem, sonra görünüş, sonra aksesuarlar, sonra sayılabilir ayrıntı, sonra etiketli bir çevre bloğu, sonra stil. Bir kelimenin hangi kutuya ait olduğunu siz gösteremiyorsanız, model de gösteremez.
Ders 2: kısa prompt kompozisyonu bir benzetmeyle satın alır
MAI-Image-2 duyurusu çok farklı bir prompt yayımladı: yaklaşık 30 kelime, cümle yok, yalnızca öneme göre sıralanmış öbekler var.
A glacier wall towering like a cathedral interior, deep blue ice with light refracting through layers, tiny human figure at base for scale, cinematic, cold mist in air, hyper-real detail

Bütün hüner ilk öbekte. "Like a cathedral interior" bir süs değil, metafor kılığına girmiş bir kompozisyon yönergesidir. Katedral beraberinde tonozlu tavanı, içeri doğru çekilen nefi, kemeri, simetriyi ve dipten giren ışığı getirir. Çıktıda bu beşinin hepsi var, yalnızca buzdan yapılmış hâlde. Aynı yerleşimi düz düz anlatmak otuz kelime tutar ve büyük olasılıkla daha katı çıkardı.
İkinci işe yarayan hamle tiny human figure at base for scale. Ölçek, görsel modellerinin en güvenilir biçimde kaybettiği şeydir; çünkü hiçbir doku size ne kadar büyük olduğunu söylemez. Konumu belirtilmiş, adı konmuş bir insan referansı bunu dört kelimede sabitler ve çıktıdaki kırmızı mont, ne kadar "epic, massive, enormous" yığarsanız yığın hepsinden daha çok kompozisyon işi görür.
Sondaki terimler — cinematic, cold mist in air, hyper-real detail — atmosfer ve render yönergeleridir ve en sonda durmalarının nedeni 1. dersteki stil kelimesiyle aynıdır.
Yani bu iki prompt aynı şeyin iyi ve kötü sürümleri değil. Farklı araçlar:
| Uzun yapılandırılmış promptu şu durumda kullanın | Kısa yığın promptu şu durumda kullanın |
|---|---|
| kıyafet, aksesuar veya marka ayrıntıları önemliyse | güçlü bir kare alıp sonra yineleyecekseniz |
| çıktıyı brief ile karşılaştıracak biri varsa | atmosfer envanterden daha çok önemliyse |
| sonradan yeniden üretmeniz gerekecekse | bir görsel dili araştırıyorsanız |
| sayı ve renkler pazarlığa kapalıysa | iyi bir benzetme kompozisyonu taşıyabiliyorsa |
Ders 3: düzenlemede bir prompt tek bir şeyi değiştirir
MAI-Image-2.5 sayfası düzenlemeyi üç promptla gösteriyor ve dikkat çeken şey her birinin ne kadar küçük olduğu:
Change the tote color to orange
Add peonies peeking out the tote
Edit this image to have the woman walking through the streets of New York City
İlkinin öncesi ve sonrası şöyle:


Prompt altı kelime: bir fiil, adı konmuş bir nesne, bir hedef değer. Yanında farklı bir arka plan, yeni bir açı ya da daha iyi bir ışık istemiyor. Asıl teknik bu ölçülülük, çünkü bir düzenlemede modelin en zor işi korumaktır, değiştirmek değil. Yönergeye eklediğiniz her şey, modelin yeniden yapmaya karar verebileceği bir şey daha demektir.
Nesnenin adının konduğuna da dikkat edin. "The tote" modele hiçbir belirsizlik bırakmayan bir gönderge verir. "Turuncu yap" derseniz model çanta, masa ve duvar arasında kendi seçimini yapar.
Üçüncü prompt, yani özneyi New York'a taşımak, çok daha büyük bir işlem gibi duruyor ve öyle de. Ama yine tek bir işlem ve yine kalması gerekeni adıyla anıyor: "the woman". Hem şehri değiştiren hem kıyafeti yenileyen hem de günün saatini kaydıran bir prompt, kötü sonucu hangi yönergenin doğurduğunu anlamanıza imkân bırakmaz.
Uyarı
Küçük düzenlemelerden oluşan bir zincir, aynı zamanda küçük sapmalardan oluşan bir zincirdir. Önem verdiğiniz ayrıntıları yalnızca sonda değil her adımdan sonra denetleyin; ten tonu, logo geometrisi ve metin, birkaç turun ardından sessizce bozulan ilk üç şeydir.
Ders 4: kültürel gönderme ucuzdur ve yalnızca sahneyi satın alır
Yayımlanan en kısa prompt sekiz kelime:
Chihuahua in Abbey Road album cover with moptop wig


Sekiz kelime çok belirli bir sahneyi yeniden kuruyor: yaya geçidi, uzağa doğru daralan ağaçlı yol, solda park etmiş beyaz VW Beetle, döneme ait arabalar, altmışlı yılların paltolarını giymiş yayalar ve düz cepheden kadraj. Bunu uzun uzun yazmak bir paragraf tutar ve büyük olasılıkla Beetle'ı yine de kaçırır. Microsoft bunu "dünya bilgisi ve akıl yürütme" başlığına koyuyor ve çerçeve doğru: yaygın olarak bilinen bir gönderme, elinizdeki en sıkıştırılmış prompttur.
Aynı zamanda en az denetlenebilir olanıdır ve bu örnek sınırın tam olarak nerede durduğunu gösteriyor. İki görseli karşılaştırın: kaynak, siyah fon önünde krem rengi, kısa tüylü, dik kulaklı bir chihuahua. Sonuç ise beyaz-kahverengi, tüy dokusu, oranları ve kulakları farklı bir köpek. Gönderme sahneyi satın aldı. Özneyi korumadı.
Asıl pratik ders bu ayrım. Göndermeyle kısaltma, bir dünya kurmak için mükemmeldir: bir tür, bir dönem, bir ışık geleneği, bir yerleşim. Kimlik konusunda güvenilir değildir. Belirli bir yüzün, evcil hayvanın, ürünün ya da ambalajın hayatta kalması gerekiyorsa, o gereklilik açık betimlemeye ya da referans görselli bir akışa aittir; kültürel bir imaya değil.
Akılda tutulacak iki uyarı daha var: gönderme yalnızca model onu tanıyorsa çalışır, bu yüzden bilinmeyen ya da yöresel göndermeler sessizce genel geçer bir çıktıya iner; ayrıca ünlü imgeler beraberinde hak sorunları getirir ve promptunuz bunu sizin yerinize çözmez.
Metin işleme neden manşet sayısı oldu
2.6 duyurusundaki her şeyin içinden Microsoft'un ayrı olarak öne çıkardığı sayı metne aitti: +91 Elo, genel +79 Elo artışının üzerinde. Bu bilinçli bir vurgu ve örnek işler nedenini açıklıyor.

Bir başlığı doğru yazmak işin kolay yarısıdır. Yukarıdaki afiş ayrıca aksanlı bir Fransızca yer adını, kategori içindeki bir yıldız işaretini, virgülle ayrılmış bir tarih dizisini ve en önemlisi bir hiyerarşiyi ayakta tutuyor: tarih satırı ikincil, başlık baskın, illüstrasyon üst üçte ikiyi alıyor. Yazımı kusursuz olup her metin bloğuna aynı görsel ağırlığı veren bir model yine de kullanılamaz bir sayfa üretir.
Burası görsel üretimin ücretli işe en yakın kısmı ve 2.5 sayfasındaki iş ortağı görüşlerinin buraya yoğunlaşmasının nedeni de bu. WPP'nin küresel kreatif direktörü Rob Reilly, doğal dille düzenlemenin yanında metin doğruluğunu "gerçek bir sıçrama" diye anıyor; Shutterstock'tan Vanessa Salvo ise ölçütü, modellerin niyeti "tutarlı ve üretime hazır çıktılara çevirip çeviremediği" olarak tanımlıyor. Ambalaj, afiş, menü ve kampanya işleri fotogerçekçilikte tökezlemeden önce tipografide tökezler.
"Arena'da 2. sıra" neyi söyler, neyi söylemez
Arena sonuçları kör insan tercihi karşılaştırmalarıdır; dolayısıyla büyük bir Elo sıçraması, karışık bir prompt kümesinde insanların o çıktıları tercih ettiğine dair gerçek bir sinyaldir. Bu hakiki bir sonuç ve iki ay kadar sürede +79 Elo hızlı bir tırmanış.
Aynı zamanda tek bir toplu sayıdır. Microsoft'un duyurusu ne kategori bazında Elo değerlerini, ne güven aralıklarını, ne prompt kümesinin büyüklüğünü, ne de üstündeki modelin kimliğini yayımlıyor. 14 Ağustos 2026 itibarıyla, bir ekibin bir üretim hattına bağlanmadan önce ihtiyaç duyacağı birkaç şey hâlâ yayımlanmadı:
- 2.6 kademesi için görsel başına API fiyatı
- Doğal ve azami çıktı çözünürlükleri
- Üretim ve düzenleme gecikme süreleri
- "Yakında" diye tarif edilen çoklu referans ve temellendirme yetenekleri
- Elo farklarının arkasındaki teknik rapor
Not
Arena'daki genel sıra, bir modelin sizin somut işinize uyup uymadığını söyleyemez. Latin dışı bir yazıyla hazırlanmış metin yoğun ambalaj, on iki karede aynı kalması gereken bir yüz ve bir oyun arayüzü için saydam bir dosya birbirinden farklı üç sınavdır; bir model toplamda önde giderken bunlardan herhangi birini kaybedebilir.
2.6 hakkındaki dürüst okuma dar ama yine de işe yarar: Microsoft bu aileyi hızla yineliyor ve kazanımları gösterişe değil ticari çıktıya — metne, portreye, ürüne, markaya — yöneltiyor.
Bu dört kalıbı OmniArt'ta çalıştırmak
MAI-Image şu anda OmniArt görsel çalışma alanında bulunmuyor. Prompt kalıpları ise var ve modelden bağımsız. Briefinizin aslında hangi dört işten biri olduğuna göre seçin:
| Kalıp | Ne işe yarar | OmniArt'ta pratik bir başlangıç |
|---|---|---|
| Uzun yapılandırılmış prompt | Kıyafet, aksesuar, renk ve sayıların denetlendiği briefler | GPT Image 2 |
| Benzetmeli kısa yığın prompt | Sinematik tek kareler ve atmosfer araştırması | Seedream 5.0 Pro |
| Turda tek değişiklikli düzenleme | Ürün renk varyantları, ekleme, denetimli mekân değişikliği | Nano Banana 2 |
| Gönderme kısaltması artı açık kimlik betimi | Öznenin sabit kalması gereken dünya kurulumu | Seedream 5.0 Pro ile referans görselleri |
| Karara varmadan önce ucuz yineleme | Prompt yapısını düşük maliyetle sınamak | Qwen Image |
İşe yarayan bir alıştırma: yukarıdaki çatı promptunu olduğu gibi bir kez çalıştırın, sonra renkleri sıfatlarla ("a pink bottle", "a green wand") ve sayıyı "some bubbles" ile değiştirip bir kez daha çalıştırın. İki çıktı arasındaki fark yapının değeridir ve bir tanıtım galerisinde değil, kendi modelinizde ölçülmüştür.
Yerleşim ve fotogerçekçilik üzerine güncel bir karşılaştırma için GPT Image 2 ile Nano Banana 2 yazısına bakın. Referansla yürütülen tutarlılık için Seedream 5.0 Pro çıkış rehberi girdileri ve denetimleri anlatıyor, Qwen Image rehberi ise ilk taslaklar için düşük maliyetli yol. Benzer bir çıkış analizi arıyorsanız Grok Imagine Image 2.0 aynı hafta yakın bir Arena iddiası ortaya koydu.
Sık sorulan sorular
MAI-Image-2.6 nedir?
MAI-Image-2.6, Microsoft AI'ın 10 Ağustos 2026'da duyurduğu metinden görsele modelidir. Microsoft, modelin Arena metinden görsele sıralamasında ikinci olduğunu, MAI-Image-2.5'e göre +79 Elo, metin işlemede ise +91 Elo kazandığını belirtiyor.
MAI-Image-2.6 ile MAI-Image-2.5 arasındaki fark nedir?
Microsoft ölçülen her Arena kategorisinde kazanım olduğunu söylüyor ve özellikle metin işlemeyi, portre ile 3B'yi, bunun yanında ürün, marka ve sinematik işlerde daha rafine ticari ve fotogerçekçi çıktıyı öne çıkarıyor. Çoklu referans girdisi, daha zengin temellendirme ve akıl yürütme, format, çözünürlük üzerinde daha fazla denetim ise yakında geleceği söylenen, ayrıntısı yayımlanmamış başlıklar.
MAI-Image-2.6'yı nerede kullanabilirim?
Microsoft'un duyurusuna göre model, Arena'da metinden görsele kullanılabiliyor, aynı haftanın ilerleyen günlerinde MAI Playground'a geliyor ve ardından Microsoft Foundry ile diğer ürünlere yayılıyor.
MAI-Image OmniArt'ta var mı?
Hayır. OmniArt görsel model listesinde MAI-Image bulunmuyor. Bu yazıdaki prompt kalıpları modelden bağımsızdır ve OmniArt'ın sunduğu görsel modellerinde kullanılabilir.
MAI-Image-2.5 ailesinde neler var?
Üç sürüm var: nesne tutarlılığı ve görsel akıl yürütme için MAI-Image-2.5-Pro, denetlenebilir düzenlemeyle yüksek kaliteli üretim için MAI-Image-2.5 ve amiral gemisinin yarısından düşük fiyata üretime hazır diye tanımlanan MAI-Image-2.5-Flash.
Bu prompt kalıpları başka modellerde de işe yarar mı?
Yarar. Renk adları, açık sayılar, çitle ayrılmış bir arka plan bloğu, bir ölçek dayanağı, düzenleme başına tek değişiklik ve kompozisyonu taşıyan bir benzetme genel prompt teknikleridir. Modeller arasında değişen tek şey her birinin ne kadar tutarlı biçimde uygulandığıdır ve bunu asıl kullandığınız modelde sınamak değer.
OmniArt'ta başlayın
OmniArt görsel çalışma alanını açın ve tek bir briefi yukarıdaki dört kalıptan ikisiyle çalıştırın: aynı fikrin uzun yapılandırılmış ve kısa yığın sürümü. Özneyi aynı tutun, yalnızca promptun biçimini değiştirin. Bu tek karşılaştırma size modeliniz hakkında herhangi bir sıralama derecesinden çok daha fazlasını anlatır.
Sonrasında düzenlemeyi ayrı bir iş olarak ele alın: önce bir görseli onaylayın, ardından prompt başına tek değişiklik yapın ve her turun sonunda önem verdiğiniz ayrıntıları denetleyin. OmniArt görsel, video, ses ve müzik modellerini tek bir çalışma alanında tutar; böylece onaylanmış bir kare, araç değiştirmeden doğrudan harekete geçebilir. Yeni bir model listede yerini hak ettiğinde de yazmayı öğrendiğiniz promptlar sizinle birlikte gelir.
Üretmeye hazır mısınız?
AI ile harika içerikler üretmeye başlayın