Categories: Yapay Zeka

Yapay Zekâ Modellerinin Görsel Yetenekleri: Gemini, ChatGPT ve DeepSeek

Günümüzde yapay zekâ dünyasında öne çıkan üç büyük model olan Gemini, ChatGPT ve DeepSeek, sadece metin işleme yetenekleriyle değil, aynı zamanda görsel verileri işleme konusunda da birbirleriyle rekabet içindedir. Görsel verilerin yapay zekâ tarafından işlenmesi, kullanıcı deneyimini zenginleştiren önemli bir unsur haline gelmiştir. Özellikle ChatGPT, GPT-4V entegrasyonu sayesinde fotoğraflardaki nesneleri tanımlama yeteneğine sahipken, Google Gemini, çoklu modal yaklaşımıyla görsel ve metni bir araya getirerek adeta “düşünen bir göz” işlevi görmektedir. Ancak DeepSeek, bu rekabette nerede durmaktadır? Bu üç modelin görsel işleme yeteneklerini ayrıntılı bir şekilde test ettik.

Yapay Zekâ Modellerinin Görsel Yetenekleri: Gemini, ChatGPT ve DeepSeekYapay Zekâ Modellerinin Görsel Yetenekleri: Gemini, ChatGPT ve DeepSeek

Test Senaryoları

Test SenaryolarıTest Senaryoları

Gemini, ChatGPT ve DeepSeek için tamamen aynı promptları kullanarak görsel içerikler oluşturduk. Şimdi, hangi modelin görsel işleme yeteneğinin diğerlerinden daha üstün olduğunu inceleyelim.

Gün Batımında Göl Manzarası

İlk olarak, gün batımında, sakin bir gölün etrafında yeşilliklerle kaplı dağlar, gökyüzünde turuncu ve pembe tonlar, suyun üzerinde hafif bir sis ve göl kenarında rengarenk çiçeklerle gerçekçi ve huzur dolu bir atmosfer oluşturmalarını istedik.


Sonuçlar:

  • Gemini: Göz alıcı renk paleti ve detaylı manzara ile etkileyici bir görsel sundu.
  • ChatGPT: Gerçekçiliği ön planda tutarak, sakin bir atmosfer yarattı.
  • DeepSeek: Görsel işleme yeteneği, diğer iki modele göre biraz daha geride kaldı.

Sevimli Bir Golden Retriever

İkinci test senaryomuzda, “Güneşli bir parkta oturan dost canlısı ve oyuncu bir Golden Retriever yavrusunun ayrıntılı bir görüntüsünü” oluşturmalarını talep ettik. Köpeğin Güneş ışığında parıldayan yumuşak, meraklı gözleri ve şakacı bir şekilde dışarı çıkmış dili, etrafındaki yeşil çimenler, rengarenk çiçekler ve dağınık oyuncaklarla birlikte temsil edilmeliydi.

Sonuçlar:

  • Gemini: Hayvanın canlılığını ve neşesini mükemmel bir şekilde yansıttı.
  • ChatGPT: Detaylı ve sevimli bir görsel yarattı, ancak bazı unsurlar daha az belirgin oldu.
  • DeepSeek: Görseldeki detay eksikliği dikkat çekti.

Kapadokya’nın Güzellikleri

Üçüncü testte, Türkiye’nin kültürel ve doğal güzelliklerini sergileyen bir manzara oluşturmalarını istedik. Özellikle eşsiz kaya oluşumları ve gün doğumunda Kapadokya üzerinde süzülen sıcak hava balonları ile sahneyi aydınlatan yumuşak altın ışık, ön planda karmaşık desenli bir halı ve dumanı tüten bir fincan Türk çayı gibi unsurlar yer almalıydı.


Sonuçlar:

  • Gemini: Zengin detaylarla dolu bir görsel ortaya koydu, Kapadokya’nın ruhunu mükemmel yansıttı.
  • ChatGPT: Güzel bir kompozisyon sundu, ancak bazı unsurlar daha az belirgin kaldı.
  • DeepSeek: Görsellikte diğerlerinden daha zayıf bir performans sergiledi.

Hayali Bir Uzay Manzarası

Son olarak, hayal gücümüzü konuşturmak adına “Uzak bir gezegendeki uzaylı manzarası” talep ettik. Sahnede mavi ve morun canlı tonlarıyla parlayan, biyolüminesan bitkilerle çevrili yüksek kristal yapılar, ruhani bir ışık saçan iki Güneş ile dolu bir gökyüzü ve havada zarafetle hareket eden canlılar tasvir edilmeliydi.

Sonuçlar:

  • Gemini: Gerçeküstü ve ilgi çekici bir atmosfer yarattı.
  • ChatGPT: Yaratıcılığı ön planda tutarak oldukça etkileyici bir görsel sundu.
  • DeepSeek: Detay eksikliği ve görsel uyumsuzluklar gözlemlendi.

Sonuç ve Değerlendirme

Metin odaklı bir çıkış yapan DeepSeek, görsel işleme konusunda Gemini ve ChatGPT’nin gerisinde kalıyor. Ancak, gelecekte geliştirilen versiyonları ile bu açığı kapatabilir mi, bunu zaman gösterecek. Sizler, bu üç modelin görsel işleme yeteneklerini nasıl değerlendiriyorsunuz? Yorumlarınızı bizimle paylaşmayı unutmayın!


İlginizi çekebilir:

Kaynak: Webtekno

İnanç Can Çekmez

Recent Posts

GTA 6 Fiyatı Hakkında Güncel ve Detaylı Bilgiler

GTA 6 fiyatı hakkında güncel ve detaylı bilgiler burada! En son fiyatlandırma ve çıkış detaylarını…

3 saat ago

Apple’ın Geleceğine Dair Çarpıcı Tahminler: iPhone’un Sonu Mu Geliyor?

Apple'ın geleceği ve iPhone'un olası sonu hakkında çarpıcı tahminler. Teknolojinin yeni dönemine hazır olun, gelişmeleri…

3 saat ago

GTA 6 Fragmanı ve Rockstar Games’in Resmi Açıklaması

GTA 6 fragmanı ve Rockstar Games'in resmi açıklamasıyla ilgili en güncel detaylar, heyecan verici gelişmeler…

4 saat ago

Apple, Google’ın Yerine Yapay Zeka Destekli Arama Motorları Arıyor

Apple, Google'ın yerine yapay zeka destekli yeni arama motorları geliştiriyor. Güncel teknolojik gelişmeleri ve yenilikleri…

4 saat ago

GTA 6 Fragmanı ve Eski Karakterlerin Dönüşü İpuçları

GTA 6 fragmanı ve eski karakterlerin dönüşüyle ilgili ipuçlarını keşfedin. Heyecan verici detaylar ve sürprizler…

5 saat ago

Samsung’un One UI 8 Güncellemesi ile Now Bar’da Yeni Özellikler

Samsung’un One UI 8 güncellemesiyle Now Bar’da yeni özellikler ve geliştirmeler sizi bekliyor. Hemen keşfedin…

5 saat ago