Meta Muse Video -tekoälymalli tuottaa jopa 10 sekunnin videoita
Meta on kehittämässä uutta Muse Video -tekoälymallia, joka pystyy luomaan enintään 10 sekunnin pituisia videoita tekstikehotteiden perusteella. Malli on parhaillaan beta-testauksessa valittujen kumppaneiden kanssa.

Meta, teknologiayritys, on kehittämässä tekoälymallia nimeltä Muse Video, joka kykenee generoimaan lyhyitä videoklippejä tekstikuvauksista. Uusimpien raporttien mukaan malli on tällä hetkellä beta-vaiheessa, ja se voi tuottaa yksittäisiä videoita jopa 10 sekunnin pituisina.
Muse Video on suunniteltu ymmärtämään ja visualisoimaan monimutkaisiakin kehotteita, kuten kuvauksia ihmisistä, ympäristöistä ja toiminnoista. Alustavat testit ovat osoittaneet mallin potentiaalin yksityiskohtien esittämisessä ja kohteen sekä ympäristön suhteen ymmärtämisessä. Myös videon ajallisessa vakaudessa on havaittu lupaavia merkkejä.
Meta on kuitenkin tunnustanut, että malli ei ole vielä täydellinen. Haasteita on havaittu erityisesti äänen ja kuvan synkronoinnissa sekä nopeiden liikkeiden fysiikan tarkkuudessa. Nykyiset 10 sekunnin testivideot eivät riitä osoittamaan, kuinka malli suoriutuu pidempien narratiivien, jatkuvien hahmojen tai intensiivisten toimintakohtausten luomisessa.
Mallin kyvykkyydestä on julkaistu esimerkkivideoita, jotka perustuvat erilaisiin tekstikehotteisiin. Näihin kuuluvat muun muassa kuvaukset ihmisistä ruuhkaisilla kaduilla, rakettien laukaisuista, eläimistä ja abstrakteista visuaalisista efekteistä. Vaikka nämä esimerkit näyttävät mallin kykyä tulkita ohjeita, niiden perusteella on vielä liian aikaista arvioida sen laajempia sovellusmahdollisuuksia.
Muse Videon kehitys on osa laajempaa tekoälyn nopeutunutta kehitystä videoiden luomisen alalla. Kun malli kehittyy ja sen rajoituksia pystytään ylittämään, se voi tulevaisuudessa tarjota uusia työkaluja sisällöntuottajille ja luoville aloille.