“`html
İngiltere merkezli yapay zeka laboratuvarı Odyssey, video üretimini etkileşimli dünyalara dönüştüren bir modelin araştırma önizlemesini duyurdu. İlk olarak film ve oyun prodüksiyonu için dünya modellerine odaklanan Odyssey ekibi, tamamen yeni bir eğlence ortamına ulaşma yolunda önemli bir buluş gerçekleştirdi.
Odyssey’nin Etkileşimli Video Modeli
Odyssey’nin yapay zeka modeli, gerçek zamanlı olarak girişlere yanıt veriyor. Klavye, telefon, kontrol cihazı veya sesli komutlarla etkileşimde bulunmak mümkün. Odyssey ekipleri bunu “Holodeck’in erken versiyonu” olarak tanıtıyor.
Bu yapay zeka, her 40 milisaniyede gerçekçi video kareleri üretebiliyor. Bu sayede, bir tuşa bastığınızda video hemen tepki veriyor. Böylelikle dijital dünyayı etkilediğiniz hissi yaratıyor.
Odyssey, “Deneyim şu an, bozuk bir rüyayı keşfetmek gibi—ham, dengesiz ama kesinlikle yeni,” diyor. Ancak burada henüz pürüzsüz, AAA oyun kalitesinde görseller yok.
Standart Video Teknolojisinden Farkı
Şimdi biraz teknik detaylara bakalım. Odyssey’nin bu yapay zeka destekli etkileşimli video teknolojisi, standart video oyunları veya CGI’lerden neyiyle farklı? Bunun sebebi, Odyssey’nin “dünya modeli” adını verdiği bir kavramdır.
Geleneksel video modellerinin aksine, dünya modelleri her kareyi tahmin ederek çalışıyor. Kullanıcı girdileri ve mevcut durum üzerinden bir sonraki adımı belirliyor. Bu, büyük dil modellerinin sıradaki kelimeyi tahmin etmesine benziyor, ancak yüksek çözünürlüklü video kareleri söz konusu olduğunda çok daha karmaşık hale geliyor.
Odyssey’ye göre, “Bir dünya modeli, temelde bir eylem şartlı dinamik modeldir.” Her etkileşimde, mevcut durumu, eylemi ve geçmiş durumu göz önünde bulundurarak bir sonraki video karesini oluşturuyor.
Sonuç olarak, geleneksel bir oyundan daha organik ve öngörülemeyen bir deneyim sunuyor. Burada, “eğer oyuncu X yaparsa, Y olur” şeklinde önceden programlanmış bir mantık yok. Yapay zeka, izlediği sayısız videodan öğrendikleriyle devam eden en iyi tahmini yapıyor.
Odyssey, Tarihi Zorluklarla Mücadele Ediyor
Bu tür bir ürün geliştirmek kolay değil. Yapay zeka ile etkileşimli video oluşturmanın en büyük zorluklarından biri, zaman içinde istikrarı sağlamaktır. Her kareyi önceki karelere göre oluşturmak, küçük hataların hızla büyümesine yol açabiliyor.
Odyssey bu sorunu aşmak için “dar dağılım modeli” kullanmış. Genel video görüntüleri üzerinde önceden eğitim aldıktan sonra daha küçük bir ortam seti üzerinde ince ayar yapıyor. Bu yaklaşım, daha az çeşitlilik anlamına geliyor, ancak her şeyin kaotik bir hale gelmesini önlüyor.
Şirket, bir sonraki nesil model üzerinde hızlı ilerlediğini ve bunun daha zengin piksel, dinamikler ve eylemler sunacağını belirtiyor.
Bu gelişmiş yapay zeka teknolojisini gerçek zamanlı çalıştırmak ise maliyetli. Şu anda, bu deneyimi destekleyen altyapı, kullanıcı başına saatlik 0.80-1.60 £ arasında bir maliyete sahip ve ABD ve AB’de dağılmış H100 GPU kümelerine dayanıyor.
Bu maliyet, video akışı için yüksek görünebilir ancak geleneksel oyun veya film içeriği üretimine kıyasla oldukça ucuz. Odyssey bu maliyetlerin daha verimli hale geldikçe düşmesini bekliyor.
Etkileşimli Video: Geleceğin Hikaye Anlatım Yöntemi mi?
Tarih boyunca yeni teknolojiler, yeni hikaye anlatım biçimlerini de beraberinde getirmiştir. Odyssey, yapay zeka destekli etkileşimli videonun bu evrimin bir sonraki adımı olduğunu düşünüyor.
Eğer haklılarsa, eğlence, eğitim, reklamcılık ve daha fazlasını dönüştürecek bir prototip ile karşı karşıyayız. Örneğin, öğretici videolarınızı uygulayarak etkileşimli hale getirebilir veya koltuğunuzdan destinasyonları keşfetme imkanı sunabilirsiniz.
Mevcut araştırma önizlemesi, bu vizyonun sadece küçük bir adımı. Fakat yapay zeka ile üretilen dünyaların etkileşimli oyun alanları haline gelmesinin mümkün olacağına dair ilginç bir bakış açısı sunuyor.
Bu araştırma önizlemesini denemek isterseniz buraya tıklayın.
Haberin orijinalini okumak isterseniz tıklayın.
“`