Categories: Yapay Zeka

Yapay Zekâ Modellerinin Görsel Yetenekleri: Gemini, ChatGPT ve DeepSeek

Günümüzde yapay zekâ dünyasında öne çıkan üç büyük model olan Gemini, ChatGPT ve DeepSeek, sadece metin işleme yetenekleriyle değil, aynı zamanda görsel verileri işleme konusunda da birbirleriyle rekabet içindedir. Görsel verilerin yapay zekâ tarafından işlenmesi, kullanıcı deneyimini zenginleştiren önemli bir unsur haline gelmiştir. Özellikle ChatGPT, GPT-4V entegrasyonu sayesinde fotoğraflardaki nesneleri tanımlama yeteneğine sahipken, Google Gemini, çoklu modal yaklaşımıyla görsel ve metni bir araya getirerek adeta “düşünen bir göz” işlevi görmektedir. Ancak DeepSeek, bu rekabette nerede durmaktadır? Bu üç modelin görsel işleme yeteneklerini ayrıntılı bir şekilde test ettik.

Test Senaryoları

Gemini, ChatGPT ve DeepSeek için tamamen aynı promptları kullanarak görsel içerikler oluşturduk. Şimdi, hangi modelin görsel işleme yeteneğinin diğerlerinden daha üstün olduğunu inceleyelim.

Gün Batımında Göl Manzarası

İlk olarak, gün batımında, sakin bir gölün etrafında yeşilliklerle kaplı dağlar, gökyüzünde turuncu ve pembe tonlar, suyun üzerinde hafif bir sis ve göl kenarında rengarenk çiçeklerle gerçekçi ve huzur dolu bir atmosfer oluşturmalarını istedik.


Sonuçlar:

  • Gemini: Göz alıcı renk paleti ve detaylı manzara ile etkileyici bir görsel sundu.
  • ChatGPT: Gerçekçiliği ön planda tutarak, sakin bir atmosfer yarattı.
  • DeepSeek: Görsel işleme yeteneği, diğer iki modele göre biraz daha geride kaldı.

Sevimli Bir Golden Retriever

İkinci test senaryomuzda, “Güneşli bir parkta oturan dost canlısı ve oyuncu bir Golden Retriever yavrusunun ayrıntılı bir görüntüsünü” oluşturmalarını talep ettik. Köpeğin Güneş ışığında parıldayan yumuşak, meraklı gözleri ve şakacı bir şekilde dışarı çıkmış dili, etrafındaki yeşil çimenler, rengarenk çiçekler ve dağınık oyuncaklarla birlikte temsil edilmeliydi.

Sonuçlar:

  • Gemini: Hayvanın canlılığını ve neşesini mükemmel bir şekilde yansıttı.
  • ChatGPT: Detaylı ve sevimli bir görsel yarattı, ancak bazı unsurlar daha az belirgin oldu.
  • DeepSeek: Görseldeki detay eksikliği dikkat çekti.

Kapadokya’nın Güzellikleri

Üçüncü testte, Türkiye’nin kültürel ve doğal güzelliklerini sergileyen bir manzara oluşturmalarını istedik. Özellikle eşsiz kaya oluşumları ve gün doğumunda Kapadokya üzerinde süzülen sıcak hava balonları ile sahneyi aydınlatan yumuşak altın ışık, ön planda karmaşık desenli bir halı ve dumanı tüten bir fincan Türk çayı gibi unsurlar yer almalıydı.


Sonuçlar:

  • Gemini: Zengin detaylarla dolu bir görsel ortaya koydu, Kapadokya’nın ruhunu mükemmel yansıttı.
  • ChatGPT: Güzel bir kompozisyon sundu, ancak bazı unsurlar daha az belirgin kaldı.
  • DeepSeek: Görsellikte diğerlerinden daha zayıf bir performans sergiledi.

Hayali Bir Uzay Manzarası

Son olarak, hayal gücümüzü konuşturmak adına “Uzak bir gezegendeki uzaylı manzarası” talep ettik. Sahnede mavi ve morun canlı tonlarıyla parlayan, biyolüminesan bitkilerle çevrili yüksek kristal yapılar, ruhani bir ışık saçan iki Güneş ile dolu bir gökyüzü ve havada zarafetle hareket eden canlılar tasvir edilmeliydi.

Sonuçlar:

  • Gemini: Gerçeküstü ve ilgi çekici bir atmosfer yarattı.
  • ChatGPT: Yaratıcılığı ön planda tutarak oldukça etkileyici bir görsel sundu.
  • DeepSeek: Detay eksikliği ve görsel uyumsuzluklar gözlemlendi.

Sonuç ve Değerlendirme

Metin odaklı bir çıkış yapan DeepSeek, görsel işleme konusunda Gemini ve ChatGPT’nin gerisinde kalıyor. Ancak, gelecekte geliştirilen versiyonları ile bu açığı kapatabilir mi, bunu zaman gösterecek. Sizler, bu üç modelin görsel işleme yeteneklerini nasıl değerlendiriyorsunuz? Yorumlarınızı bizimle paylaşmayı unutmayın!


İlginizi çekebilir:

Kaynak: Webtekno

İnanç Can Çekmez

Recent Posts

Meta, Limitless’i Satın Alarak Akıllı Giyilebilirlikte Yeni Bir Kategori Hedefliyor

Meta, Limitless’i satın alarak akıllı giyilebilirlikte yenilikçi bir kategori hedefliyor ve geleceğin teknolojisini keşfe davet…

13 saat ago

Geçmişin Absürt Telefon Tasarımları: Dairesel Tuşlardan Ruj Telefonuna Kadar

Geçmişin absürt telefon tasarımlarını keşfedin: dairesel tuşlardan ruj telefonuna uzanan bir yolculukla teknoloji geçmişini eğlenceli…

13 saat ago

FC 26 Profesyonel Taktikler: Sahada Kontrolü Elinde Tutmanın İncelikleri

FC 26 Profesyonel Taktikler: Sahada kontrolü elinde tutmanın inceliklerini keşfedin; pratiğe dönüştürülen strateji ve oyun…

14 saat ago

Görsel ve İşitsel Yapay Zekâ Üzerine Akışkan Bir İnceleme: Algı, Kaçınılmazlık ve Evrimsel Bir Bakış

Görsel ve işitsel yapay zekâ hakkında akışkan bir inceleme: algı, kaçınılmazlık ve evrimsel bakışla yön…

16 saat ago

Kapaklı Telefonların Altın Çağı: Unutulmaz Tasarımlar ve Efsane Modeller

Kapaklı telefonların nostaljisini yaşatırken, unutulmaz tasarımlar ve efsane modellerle altın çağını keşfedin.

19 saat ago

PS6 Beklentileri ve Özelliklerine Yeni Bir Bakış: Yayınlanmaya Hazırlanan Nesil Hakkında Güncel İzlenimler

PS6 beklentileri ve özellikleri üzerine güncel izlenimler: yayınlanmaya hazırlanan nesle dair güçlü bir önizleme ve…

19 saat ago