Proje vitrini hazırlanıyorPreparing project showcaseПодготавливаем витрину проекта

Pazarlama

Yapay Zeka İçin Görseller: Multimodal Aramada Görünür Olmak

Yapay zeka artık görselleri de okuyor. Multimodal aramada görünmek için alt metin, dosya adı, bağlam ve özgün görselleri nasıl kullanacağınızı anlatıyoruz.

Rocketly · 2026-08-16

Yıllar boyunca yapay zekayı yalnızca metin okuyan bir sistem olarak düşündük: kelimeleri tarar, cümleleri çözer ve bir cevap üretir. Oysa bugünün üretici motorları artık yalnızca okumuyor, aynı zamanda görüyor. Bir ürün fotoğrafına, bir infografiğe ya da bir ekran görüntüsüne bakıp içinde ne olduğunu yorumlayabiliyor; nesneyi, sahneyi, rengi, hatta görselin üzerindeki yazıyı okuyabiliyor. Bu, "multimodal arama" denen yeni bir dünyanın kapısı ve markanızın görünürlüğü açısından sandığınızdan çok daha belirleyici.

Sorun şu ki çoğu KOBİ sitesi görsellerini hâlâ yalnızca insan gözü için hazırlıyor: güzel görünen ama makinenin hiçbir şey anlamadığı fotoğraflar, anlamsız dosya adları, boş bırakılmış alt metinler. Yapay zeka bir görseli "okuyamadığında" onu görmezden gelir ve sizi cevabın dışında bırakır. Bu yazıda multimodal aramanın nasıl çalıştığını, yapay zekanın bir görseli nasıl anladığını ve markanızın görsellerini hem insanlar hem de makineler için nasıl hazırlayacağınızı adım adım ele alıyoruz.

1Görsel2Alt metin + bağlam3Multimodal AI4Görünürlük

Multimodal arama nedir?

Multimodal arama, bir yapay zeka sisteminin aynı anda birden fazla "modaliteyi" —metni, görseli, kimi zaman sesi ve videoyu— birlikte işleyebilmesi demek. Eskiden bir arama motoru için görsel, aslında etrafındaki metinden ibaretti; motor fotoğrafın kendisini değil, yalnızca dosya adını ve alt metnini "okurdu". Bugünse Gemini, ChatGPT ve benzeri motorlar görselin piksellerine doğrudan bakıp içindekini tanımlayabiliyor.

Bunun pratik sonucu net: Kullanıcı artık yalnızca kelime yazmıyor. Bir fotoğraf yükleyip "bu nedir, nereden alabilirim, buna benzer ne önerirsin?" diye sorabiliyor. Ya da metinle sorduğu bir soruya motor, hem yazılı hem görsel kaynaklardan beslenerek yanıt veriyor. Görsel artık sayfanın süsü değil, cevabın bir parçası. Markanızın görselleri makine tarafından doğru anlaşıldığında bu yeni cevap katmanında görünür olma şansınız artar; anlaşılmadığındaysa en iyi ürün fotoğraflarınız bile makinenin gözünde boş bir kareye dönüşür.

Bu değişim iki yönlü işliyor. Bir yandan kullanıcılar artık görselle arama yapıyor: bir ürünü fotoğraflayıp "bunun benzeri ne, nereden bulurum?" diye soruyor, ekran görüntüsü paylaşıyor ya da kamerasını bir nesneye tutup ne olduğunu öğrenmek istiyor. Öte yandan üretici motorlar da ürettikleri cevaplara giderek daha çok görsel yerleştiriyor; yani cevabın yanında gösterilen görsel olmak, başlı başına yeni bir görünürlük biçimine dönüşüyor. Her iki yönde de kazanan, görsellerini makinelerin anlayabildiği markalar oluyor.

Yapay zeka bir görseli nasıl "anlar"?

Modern görsel modelleri bir fotoğrafı; içindeki nesneleri, sahneyi ve bunlar arasındaki ilişkileri temsil eden sayısal bir forma çevirir. Bir deri cüzdanı deri cüzdan, bir kahve makinesini kahve makinesi olarak tanır; görselin üzerindeki yazıyı optik karakter tanımayla okur; rengi, dokuyu ve kompozisyonu değerlendirir. Yani makine artık "bir şeyin fotoğrafı" değil, ne olduğu belli bir nesne görür. Görselin kalitesi de bu okumayı etkiler: net, iyi ışıklandırılmış ve konusu belirgin bir fotoğraf, kalabalık ya da bulanık bir kareye göre çok daha kolay yorumlanır.

Ama burada kritik bir sınır var: Model görselde ne olduğunu anlayabilir, fakat o görselin sizin markanıza ait olduğunu kendiliğinden bilemez. Bir fotoğrafı belirli bir işletmeye, ürüne veya varlığa bağlayan şey, çevresindeki bağlam ve tutarlı sinyallerdir. Makinenin sizi net bir varlık olarak tanıması, görsellerinizi de doğru sahibine atfetmesini kolaylaştırır. Bu yüzden görsel stratejisi, markanızı makinelerin tanıdığı bir varlığa (entity) dönüştürme çabasından ayrı düşünülemez; kim olduğunuz belirsizse, görsellerinizin kime ait olduğu da belirsiz kalır. Logonuz, ambalajınız ve tutarlı bir ürün stili gibi tanınabilir görsel işaretler, bir görseli markanıza bağlayan bu bağı güçlendirir.

Alt metin ve dosya adları: makineye verdiğiniz ilk ipuçları

Görsel modelleri ne kadar güçlense de, alt metin (alt text) ve dosya adı hâlâ makineye sunduğunuz en açık, en doğrudan ipuçlarıdır. Alt metin aslında erişilebilirlik için —ekran okuyucu kullanan görme engelli ziyaretçiler için— vardır; ama tam da bu yüzden görseli düz, betimleyici bir dille anlatır ve makineler için de aynı işi görür. İyi yazılmış bir alt metin, motorun görseli yorumlarken başvurduğu güvenilir bir çapa olur.

İyi bir alt metin görseli gerçekten tarif eder: "resim" değil, "açık konumdaki el yapımı kahverengi deri kartlık" gibi. Dosya adları da öyle: "IMG_export.jpg" makineye hiçbir şey söylemezken "deri-kartlik-kahverengi.jpg" bağlam taşır. Aynı mantık başlıklara (caption) ve görselin hemen çevresindeki metne de uzanır. Birkaç sağlam ilke:

  • Betimleyici olun, anahtar kelime doldurmayın: alt metin doğal bir cümle olmalı, kelime yığını değil.
  • Dosya adlarını okunur ve anlamlı tutun; kelimeleri tireyle ayırın, Türkçe karakter ve boşluktan kaçının.
  • Görselin gerçekten ne gösterdiğini yazın; sayfadaki iddia ile görsel birbirini doğrulasın.
  • Anlam taşımayan, tamamen dekoratif görsellerde alt metni boş bırakmak da geçerli bir tercihtir.
  • Alt metni görselin ve hedef kitlenizin dilinde yazın; çok dilli bir sitede her dil sürümü kendi alt metnini hak eder.

Bu ipuçlarının birbiriyle tutarlı olması da önemlidir. Dosya adı, alt metin, başlık ve görselin çevresindeki paragraf aynı şeyi anlatıyorsa, makine görseli çok daha güvenle yorumlar. Alt metnin başlığı kelimesi kelimesine tekrarlaması gerekmez; ikisi birbirini tamamlamalı ve sayfadaki aynı iddiayı işaret etmelidir.

Bağlam ve özgünlük: görsel tek başına yeterli değil

Bir görsel, çevresindeki metinle birlikte çok daha güçlüdür. Yapay zeka bir fotoğrafı yorumlarken yalnızca piksellere değil, o görselin hangi başlığın altında, hangi paragrafın yanında ve hangi sayfada durduğuna da bakar. Konuyla ilgili, açıklayıcı bir metnin yanındaki görsel, boşlukta duran bir görsele kıyasla çok daha anlaşılırdır. Yani görseli yerleştirdiğiniz bağlam, çoğu zaman görselin kendisi kadar önemlidir.

Görselin hemen altındaki başlık (caption) çoğu zaman en değerli ama en çok ihmal edilen sinyaldir: okuyucunun dilinde yazılmış kısa bir açıklama, hem insana hem makineye görselin ne olduğunu ve neden orada bulunduğunu söyler. Teknik erişilebilirlik de en az bunun kadar önemlidir; görsel dosyasının kendisine ulaşılabilmelidir. Yalnızca bir etkileşimden sonra yüklenen, engellenmiş ya da alışılmadık bir biçimde sunulan bir görseli motor çoğu zaman hiç işleyemez. Makul boyutta, standart bir web biçiminde ve doğrudan erişilebilir bir görsel, yorumlanma şansı en yüksek olandır.

Özgünlük de burada devreye girer. Herkesin kullandığı stok fotoğraflar makineye markanız hakkında özel hiçbir şey söylemez; aynı görsel onlarca sitede varsa, sizi diğerlerinden ayırmaz. Kendi ürününüzü, ekibinizi, sürecinizi ve gerçek işinizi gösteren özgün görseller ise hem insanlar hem makineler için birer güven işaretidir. Yapay zekanın bir markayı neden kaynak gösterdiği büyük ölçüde otorite ve güven sinyalleriyle ilgilidir; özgün, iyi bağlamlandırılmış bir görsel de bu sinyallerden biridir ve "bu içeriğin arkasında gerçek bir işletme var" mesajını verir.

Ürün görselleri ve yapılandırılmış veri

Ticari sayfalarda görseller ayrıca kritiktir, çünkü alıcı çoğu zaman ürünü görmeden karar vermez. Yapay zeka bir ürünü cevaba dahil edecekse, onun ne olduğunu, kime uygun olduğunu ve neye benzediğini anlamak ister. Burada yapılandırılmış veri (structured data) devreye girer: Product ve ImageObject işaretlemesi bir görseli belirli bir ürüne, özelliklerine ve stok durumuna açıkça bağlar. Böylece makine tahmin etmek zorunda kalmaz; ilişki net biçimde önüne konur.

Tek bir vitrin fotoğrafı alıcının pratik sorularını nadiren yanıtlar. Ürünü farklı açılardan, gerçek kullanım içinde ve ölçek hissi verecek biçimde göstermek, hem alıcıya hem makineye çok daha fazlasını anlatır. Bir noktaya da dikkat edin: Yapay zeka görselin üzerindeki yazıyı okuyabildiği için kritik bilgileri yalnızca bir grafiğin içine gömmeyin. Fiyat, özellik ya da koşul gibi bilgiler sayfada gerçek metin olarak da yer almalı; görsel bu bilgiyi değil, onu pekiştirmelidir.

Ne yazık ki birçok ürün sayfası, makinenin okuyamadığı görsellerle ya da hiçbir bağlam taşımayan şablon fotoğraflarıyla dolu. Yapay zekanın ürün sayfanızı neden atladığı çoğu zaman metin kadar görselle de ilgilidir. Gerçek ürün fotoğrafları, farklı açılar, kullanım sahneleri ve bunları destekleyen temiz işaretleme, ürün sayfanızın multimodal cevaplarda yer bulma ihtimalini belirgin biçimde artırır. Kısacası ürün görseli, alıcının göremediği bir mağazada vitrin işlevi görür; onu makineye de açıklamak sizin elinizdedir.

Görsellerin GEO içindeki yeri

Görsel optimizasyonu tek başına bir taktik değil, daha büyük bir resmin parçasıdır. Üretici arama optimizasyonu (GEO), markanızın yapay zeka cevaplarında anılıp anılmadığını ve kaynak gösterilip gösterilmediğini konu alır; görseller de bu görünürlüğün giderek büyüyen bir bileşenidir. Metin, varlık sinyalleri ve görsel birlikte çalıştığında makinenin sizi anlaması ve önermesi kolaylaşır. Görsel tek başına bir sinyal değil; metin ve varlık sinyalleriyle birlikte anlam kazanan bir katmandır.

Peki emeğiniz işe yarıyor mu? Görünürlük varsayımla değil, ölçümle yönetilir. Hangi soruları yanıtladığınızı, cevaplarda adınızın geçip geçmediğini ve rakibinizin nerede öne çıktığını izlemeye bugün başlayabilirsiniz. Rocketly GEO Suite bugün Google AI Overviews üzerinde markanızın anılma ve kaynak gösterilme durumunu ölçer; ChatGPT ve Perplexity gibi motorlar için çok motorlu ölçüm ise yol haritasındadır. Görselleriniz makineye net bir hikâye anlattığında, bu ölçümlerde yerinizi görmek de kolaylaşır.

Sık Sorulan Sorular

Görsel yapay zekası bu kadar gelişmişken alt metin hâlâ gerekli mi?

Evet. Alt metin öncelikle erişilebilirlik için gereklidir ve bu başlı başına yeterli bir sebeptir. Bunun ötesinde, her motor bir görselin piksellerini aynı derinlikte işleyemez; alt metin, dosya adı ve çevredeki metin, makineye görselin ne olduğunu belirsizliğe yer bırakmadan anlatan en güvenilir ipuçlarıdır. Ayrıca alt metin, görselin yüklenemediği durumlarda sayfada beliren yedek açıklamadır; yani hem erişilebilirlik hem dayanıklılık için işe yarar. Görsel modelleri güçlense bile alt metin, anlamı sağlama alan bir sigortadır.

Stok görseller yapay zeka görünürlüğüme zarar verir mi?

Doğrudan bir ceza söz konusu değildir, ama stok görseller sizi rakiplerinizden ayırmaz. Aynı fotoğraf onlarca sitede yer aldığında makineye markanıza özgü hiçbir şey anlatmaz. Kendi ürününüzü ve işinizi gösteren özgün görseller ise daha güçlü bir güven ve özgünlük sinyali taşır. Stok bir görsel yasak değildir; ama markanıza dair özgün bir şey söyleyen kendi görselinizin yanında, ödünç alınmış bir kare olarak kalır; mümkün olduğunda özgün görsele yatırım yapmak neredeyse her zaman daha iyi sonuç verir.

Rocketly görsellerimin yapay zeka tarafından görülüp görülmediğini ölçüyor mu?

Rocketly GEO Suite tek tek görsellerinizi taramaz; asıl ölçtüğü şey, takip ettiğiniz alıcı sorularında yapay zekanın markanızı anıp anmadığı ve kaynak gösterip göstermediğidir —bugün Google AI Overviews üzerinde. Görseller bu görünürlüğü besleyen girdilerden biridir; doğru hazırlanmış görseller cevaplarda daha görünür olmanıza katkı sağlar. Bu yüzden görselleri, ölçtüğünüz görünürlüğü besleyen bir yatırım olarak düşünün; sonucu panoda anılma ve kaynak gösterilme olarak izlersiniz.