Home Haber Sora, Yapay Zeka Video Modellerinin Görsel Zekası

Sora, Yapay Zeka Video Modellerinin Görsel Zekası

0

Sora, Yapay Zeka Video Modellerinin Görsel Zekası. Görüntülerle Düşünebilen Yapay Zeka SORA

OpenAI’ın metinden videoya dönüştüren yeni yapay zeka uygulaması Sora, sadece eğlenceli videolar üretmekle kalmıyor, aynı zamanda görsel zekaya sahip yeni nesil yapay zeka modellerinin de habercisi olabilir. The Economist’ten alınan bilgilere göre, Sora’nın TikTok benzeri arayüzü ilk bakışta “yapay zeka tarafından üretilmiş saçmalıklar” sunsa da, altında yatan teknoloji çok daha derin ve devrim niteliğinde.

Haberi PodCast olarak dinlemek isterseniz;

https://www.teknosafari.com/wp-content/uploads/2025/10/Sora-Yapay-Zeka-Video-Modellerinin-Gorsel-Zekasi.mp3

Sora uygulaması, şu an için yalnızca davetiye ile erişilebilir olmasına rağmen, eBay gibi platformlarda 35 dolara varan fiyatlarla davetiye kodlarının satılması, teknolojiye olan yoğun ilgiyi gösteriyor. Ancak bu başarının bir bedeli var: Tahminlere göre, platformda üretilen her video OpenAI’a yaklaşık 1 dolarlık işlem gücüne mal oluyor, bu da uygulamanın ekonomik sürdürülebilirliği konusunda soru işaretleri yaratıyor.


“Sıfır Atışlı Akıl Yürütücülerin” Doğuşu

Sora ve Google’ın benzer video modelleri olan Veo 3’ün gerçek değeri, ürettikleri eğlenceli içeriklerin ötesinde yatıyor. Google DeepMind araştırmacılarının yayınladığı bir makaleye göre, bu tür sistemler özel bir eğitime ihtiyaç duymadan bir dizi görsel ve uzamsal problemi çözebilme yeteneğine sahip.

Yapay zeka video modelleri, rastgele “gürültü”den yola çıkarak adım adım anlamlı görseller oluşturur. Bu süreçte, modelin her adımı “Bana verilen komutla daha çok nasıl benzeyebilirim?” sorusuna yanıt arar. Araştırmacılar, bu yeteneğin artık sadece içerik üretmekle sınırlı kalmadığını belirtiyor. Örneğin:

  • Kenar Algılama: Bir papağan fotoğrafından, yalnızca kenar hatlarını gösteren bir video oluşturulabiliyor.
  • Problem Çözme: Tamamlanmamış bir Sudoku bulmacasının nasıl tamamlanacağını gösteren bir video üretebiliyor.
  • Fiziksel Akıl Yürütme: Bir kavanozu tutan robot ellerin fotoğrafından yola çıkarak, kavanozu açma hareketini gösteren bir video oluşturabiliyor.

Bu yetenekler, bu modelleri “sıfır atışlı akıl yürütücüler” haline getiriyor. “Sıfır atışlı” çünkü daha önce hiç görmedikleri ve özel olarak eğitilmedikleri görevleri bile çözebiliyorlar. “Akıl yürütücüler” ise, labirent çözme gibi karmaşık görevleri adım adım çözebildikleri için bu ismi hak ediyorlar.


Tarih Tekerrür Eder mi?

Bu iddialı bulgular, 2022’deki bir araştırmayı akıllara getiriyor. O dönemde Google ve Tokyo Üniversitesi‘nden bir ekip, büyük dil modellerinin (LLM) “sıfır atışlı akıl yürütücüler” olduğunu ve keşfedilmemiş yeteneklere sahip olduklarını savunmuştu. Bu makaleden sadece altı ay sonra, yapay zeka patlamasını başlatan ChatGPT piyasaya sürüldü.

Tarihsel paralellikler, video modellerinin de benzer bir heyecan dalgasıyla olgunlaşacağına işaret ediyor. Bu durum, Sora’nın ilk aşamasının, sadece bir eğlence aracı olmaktan çok, görsel zekanın geleceğini şekillendirecek temel bir teknoloji olarak tarihe geçebileceği anlamına geliyor. Video modelleri, metnin ardından yapay zekanın bir sonraki büyük gelişmesi olabilir ve görsel dünyanın kapılarını bambaşka bir şekilde aralayabilir.

Bu haber ilgini çekebilir.

NO COMMENTS

LEAVE A REPLY

Please enter your comment!
Please enter your name here

Exit mobile version