“`html

Londra merkezli AI laboratuvarı Odyssey, video içeriklerini etkileşimli dünya haline dönüştüren bir modelin araştırma önizlemesini duyurdu. İlk aşamada film ve oyun projeleri için dünyaya özgü modeller üzerinde çalışan Odyssey ekibi, yeni bir eğlence ortamı keşfetti.

Odyssey’nin AI modeli tarafından üretilen etkileşimli video, gerçek zamanlı olarak verilen komutlara tepki veriyor. Klavye, telefon, kontrol cihazı veya sesli komutlarla interaksiyon sağlanabiliyor. Odyssey ekibi bunu “Holodeck’in erken versiyonu” olarak tanımlıyor.

Temel AI, her 40 milisaniyede gerçekçi video kareleri oluşturabiliyor. Butona basıldığında veya bir hareket yapıldığında video neredeyse anında tepki veriyor. Bu da izleyicinin dijital dünyayı etkilediği izlenimi yaratıyor.

Odyssey’ye göre, “Bugünkü deneyim, hatalı bir rüyayı keşfetmek gibi—ham, kararsız ama kesinlikle yeni.” Henüz rafine, AAA oyun kalitesinde görsellerden bahsetmiyoruz.

Standart video teknolojisi değil

Biraz teknik hale gelelim. Bu AI destekli etkileşimli video, sıradan bir video oyunu veya CGI’den neden farklı? Odyssey bunu “dünya modeli” olarak adlandırıyor.

Geleneksel video modelleri, tüm klipleri bir seferde üretirken, dünya modelleri her kareyi tahmin edebiliyor. Mevcut duruma ve kullanıcı girişlerine dayanarak bir sonraki adımı belirliyor. Bu, büyük dil modellerinin bir kelimenin sonrasını tahmin etmesine benziyor ama video karelerinin yüksek çözünürlükte olması nedeniyle çok daha karmaşık.

Odyssey’ye göre, “Dünya modeli, temelde eylem koşuluna bağlı dinamik bir modeldir.” Her etkileşimde model, mevcut durumu, kullanıcı eylemini ve geçmiş verileri kullanarak bir sonraki video karesini üretiyor.

Sonuç, geleneksel oyunlardan daha organik ve tahmin edilemez bir deneyim sunuyor. Önceden programlanmış bir mantık yok; AI daha önce izlediği videolardan öğrenerek en iyi tahminde bulunuyor.

Odyssey tarihi zorluklarla AI destekli video ile mücadele ediyor

Bunları inşa etmek kolay bir iş değil. AI destekli etkileşimli video ile ilgili en büyük zorluklardan biri sürekliliği sağlamak. Her kare, önceki karelerden türetilirken, küçük hatalar hızla birikir. AI araştırmacıları buna “kayma” diyor.

Bunu aşmak için Odyssey, “dar dağılım modeli” kullanıyor. Bu, AI’yi genel video görüntüleri üzerinde önceden eğitip, daha dar bir ortamda ince ayar yapmayı içeriyor. Bu seçim, çeşitliliği azaltıyor ama daha iyi bir denge sağlıyor.

Şirket, bir sonraki nesil modelinde “daha zengin piksel, dinamik ve eylem yelpazesi” olduğunu belirtiyor.

Tüm bu gelişmiş AI teknolojisini gerçek zamanlı çalıştırmak pek ucuz değil. Şu anda bu deneyimi destekleyen altyapı, kullanıcı başına saatte 0,80-1,60 sterlin arasında değişiyor ve ABD ile AB’de dağıtılmış H100 GPU kümesine dayanıyor.

Streaming video için pahalı görünebilir ama geleneksel oyun veya film üretiminden daha uygun. Odyssey, bu maliyetlerin modeller geliştikçe daha da düşeceğini öngörüyor.

Etkileşimli video: Yeni anlatım biçimi mi?

Tarih boyunca yeni teknolojiler, yeni anlatım biçimleri doğurmuştur. Odyssey, AI destekli etkileşimli videonun bu evrimdeki bir sonraki adım olduğuna inanıyor.

Eğer haklıysalar, bu durum eğlence, eğitim, reklam gibi birçok alanda dönüşüm sağlayacak bir prototip olabilir. Eğitim videolarında pratiğin yapılabileceği veya koltukta oturarak keşfe çıkılabilecek deneyimler hayal edin.

Şu anki araştırma önizlemesi, bu vizyonun sadece küçük bir adımı ve daha çok bir kavramsal test niteliğinde. Ancak, AI destekli dünyaların interaktif oyun alanlarına dönüşmesiyle nelerin mümkün olabileceğine dair ilginç bir bakış sunuyor.

Araştırma önizlemesini denemek için buraya tıklayın.

Ayrıca: Telegram ve xAI Grok AI anlaşmasını yaptı

Haberin orijinalini okumak isterseniz tıklayın.

“`