📣 Senden Sie uns Ihre Pressemitteilung
Seite aktualisiert sich alle 15 Minuten
Technologie

Meituan Veröffentlicht LongCat-Video Als Open-Source-Modell

Meituan hat sein LongCat-Video-Modell als Open-Source veröffentlicht. Das Modell kann Videos aus Text, Bildern und vorhandenen Videoclips generieren.

3. Oktober 2026
Meituan Veröffentlicht LongCat-Video Als Open-Source-Modell

Das chinesische Technologieunternehmen Meituan hat sein LongCat-Video-Modell unter einer Open-Source-MIT-Lizenz veröffentlicht, was eine breite Nutzung und Modifikation ermöglicht.

Das Modell ist in der Lage, Videoinhalte aus verschiedenen Eingaben zu generieren, darunter Textaufforderungen, Bilder und durch Fortsetzung vorhandener Videosequenzen. Eine herausragende Eigenschaft ist seine Fähigkeit, Videos von mehreren Minuten Länge zu produzieren, was für viele frühere Open-Source-Modelle eine bedeutende Herausforderung darstellte.

LongCat-Video basiert auf einer dichten Transformer-Architektur mit 13,6 Milliarden Parametern. Es unterstützt Text-zu-Video (T2V), Bild-zu-Video (I2V) und Videofortsetzungsaufgaben in einem einheitlichen Framework. Seine Fähigkeit zur Videofortsetzung wird besonders für die Vermeidung gängiger Probleme wie Farbabweichungen und inkonsistente Bewegungen gelobt.

Die Effizienz des Modells ist seinem Block Sparse Attention-Mechanismus zu verdanken, der die Erzeugung längerer Videos ohne exponentielle Steigerung der Rechenkosten ermöglicht. Meituans Entscheidung, das Modell als Open Source freizugeben, zielt darauf ab, die Entwicklung durch die Community zu fördern und Innovationen in der Videogenerierungstechnologie zu beschleunigen.

Das Modell ist auf GitHub und Hugging Face verfügbar, und sein technischer Bericht wurde ebenfalls veröffentlicht.

Originalquelle: crepal.ai