“`html
İngiltere merkezli AI laboratuvarı Odyssey, video görüntülerini etkileşimli dünyalara dönüştüren bir modelin araştırma önizlemesini yayınladı. Başlangıçta film ve oyun üretimi için dünya modellerine odaklanan Odyssey ekibi, yeni bir eğlence ortamı keşfetmiş olabilir.
Odyssey’nin AI modeliyle üretilen etkileşimli video, gerçek zamanlı olarak girdilere yanıt veriyor. Klavye, telefon, kontrol cihazı veya hatta sesli komutlarla etkileşimde bulunabilirsiniz. Odyssey ekibi bunu “Erken versiyon Holodeck” olarak adlandırıyor.
Temeldeki AI, her 40 milisaniyede bir gerçekçi görünümlü video kareleri üretebiliyor. Yani bir tuşa bastığınızda veya bir jest yaptığınızda, video anında tepki veriyor; böylelikle bu dijital dünyayı etkileyebiliyormuşsunuz gibi bir illüzyon yaratıyor.
Odyssey’e göre, “Bugünkü deneyim, bozuk bir rüya gibi—ham, dengesiz ama kesinlikle yeni.” Henüz yalnızca ince işçilikli AAA oyun kalitesinde görsellerden bahsetmiyoruz.
Standart Video Teknolojisinden Farklı
Bu AI tarafından üretilen etkileşimli video teknolojisinin standart video oyunlarından veya CGI’dan ne farkı var? Bütün bunlar, Odyssey’in “dünya modeli” dediği şeye dayanıyor.
Geleneksel video modellerinin tüm kesitleri bir anda oluşturmasının aksine, dünya modelleri her karede kullanıcı girdileri ve mevcut duruma dayanarak ne olacağına dair tahmin yapıyor. Büyük dil modellerinin dizideki sonraki kelimeyi tahmin etmesine benziyor, ancak karmaşıklığı yüksek çözünürlüklü video kareleri olduğu için kat kat daha fazladır.
Odyssey’in ifadeleriyle, “Bir dünya modeli, temelinde, bir eylem koşullu dinamik modelidir.” Her etkileşimde model, mevcut durumu, eyleminizi ve geçmişteki durumu alır; ardından bir sonraki video karesini ona göre oluşturur.
Sonuç, geleneksel bir oyun deneyiminden daha organik ve öngörülemez bir şey hissettiriyor. Önceden programlanmış bir mantık yok; AI, izlediği sayısız videodan öğrendiklerine dayalı olarak en iyi tahminini yapıyor.
Odyssey, AI-Üretilen Video ile Tarihi Zorlukları Aşmaya Çalışıyor
Bunu inşa etmek kolay değil. AI tarafından üretilen etkileşimli videonun en büyük zorluklarından biri zamanla stabilitesini korumaktır. Her kareyi önceki karelere dayanarak ürettiğinizde, küçük hatalar hızla birikir (AI araştırmacılarının “kayma” dediği bir fenomen).
Bu sorunu çözmek için Odyssey, “dar dağılım modeli” adı verilen bir yaklaşım kullanıyor. Temel video görüntülerinde önceden eğitim verip, ardından daha küçük ortam setleri üzerinde ince ayar yapıyor. Bu değiş tokuş, daha az çeşitlilik sağlıyor ama her şeyin garip bir kargaşamaya dönüşmemesi için daha iyi bir stabilite sunuyor.
Şirket, bir sonraki nesil model üzerinde “hızlı ilerleme” sağladıklarını belirtiyor. Bu modelin “daha zengin piksel, dinamik ve eylemler” sunduğu söyleniyor.
Tüm bu gelişmiş AI teknolojisini gerçek zamanlı çalıştırmak ucuz değil. Bu deneyimi destekleyen altyapının maliyeti, kullanıcı başına saatte 0.80-1.60 £ (1-2) arasında değişiyor ve ABD ile AB’deki H100 GPU kümelerine dayanıyor.
Maliyetler video akışı için pahalı görünse de, geleneksel oyun veya film içeriği üretiminden önemli ölçüde daha ucuz. Ayrıca Odyssey, bu maliyetlerin modeller daha verimli hale geldikçe daha da düşmesini bekliyor.
Etkileşimli Video: Bir Sonraki Hikaye Anlatım Ortamı mı?
Tarih boyunca, yeni teknolojiler yeni hikaye anlatım biçimlerini doğurmuştur. Odyssey, AI tarafından üretilen etkileşimli videonun bu evrimin bir sonraki adımı olduğuna inanıyor.
Eğer haklılarsa, bu durum eğlence, eğitim ve reklam gibi alanları dönüştürecek bir protip görüyor olabiliriz. Öğretilen becerileri pratiğe dökebileceğiniz eğitim videolarını veya koltuğunuzdan keşfedebileceğiniz seyahat deneyimlerini hayal edin.
Şu an mevcut olan araştırma önizlemesi, bu vizyona doğru sadece küçük bir adım. Daha çok bir konsept kanıtı niteliğinde. Ancak, AI-üretimi dünyaların etkileşimli alanlar haline gelme potansiyelini gösteriyor.
Bu araştırma önizlemesini burada deneyebilirsiniz.
Ayrıca: Telegram ve xAI ortaklık kurdu
Haberin orijinalini okumak isterseniz tıklayın.
“`