Meta Muse Video AI-modell kan generera videoklipp upp till 10 sekunder
Meta utvecklar AI-modellen Muse Video, som kan skapa videoklipp upp till 10 sekunder långa baserat på textbeskrivningar. Modellen testas för närvarande i en betaversion med utvalda partners.

Meta, teknikföretaget, håller på att utveckla en AI-modell kallad Muse Video som kan generera korta videoklipp från textbeskrivningar. Enligt de senaste rapporterna befinner sig modellen för närvarande i en betafas och kan producera enskilda videor på upp till 10 sekunder.
Muse Video är utformad för att förstå och visualisera även komplexa uppmaningar, såsom beskrivningar av människor, miljöer och handlingar. Preliminära tester har visat modellens potential att presentera detaljer och förstå relationen mellan objekt och deras omgivning. Lovande tecken har också observerats gällande videons tidsmässiga stabilitet.
Meta har dock medgett att modellen ännu inte är perfekt. Utmaningar har identifierats, särskilt gällande synkronisering mellan ljud och bild, samt den fysikaliska noggrannheten hos snabba rörelser. De nuvarande 10-sekunders testvideorna är otillräckliga för att avgöra hur väl modellen presterar vid skapandet av längre berättelser, konsekventa karaktärer eller intensiva actionscener.
Exempelvideor har släppts som visar modellens kapacitet, baserade på olika textuppmaningar. Dessa inkluderar beskrivningar av människor i folktäta gator, raketuppskjutningar, djur och abstrakta visuella effekter. Även om dessa exempel visar modellens förmåga att tolka instruktioner, är det för tidigt att bedöma dess bredare tillämpningsmöjligheter baserat på dem.
Utvecklingen av Muse Video är en del av den snabba framsteg inom AI för videogenerering. När modellen fortsätter att utvecklas och dess begränsningar övervinns, kan den i framtiden erbjuda nya verktyg för innehållsskapare och kreativa branscher.