Meta veröffentlicht Muse Image und Muse Video: Vervollständigung der multimodalen Matrix „Verstehen + Generieren“.
Meta veröffentlichte am 7. Juli Muse Image und Muse Video, neue Modelle der Muse-Serie für die Bild- bzw. Videogenerierung. Zusammen mit Muse Spark (multimodales Verstehen/Begründen) bilden sie eine multimodale Matrix „Verstehen + Generieren“ und führen damit die Doppelstrategie „Open Source + Cutting-Edge“ fort.
Am 7. Juli veröffentlichte Meta zwei neue Modelle: Muse Image und Muse Video für die Bild- und Videogenerierung. Die Bedeutung dieser beiden Modelle lässt sich nur im multimodalen Layout von Meta deutlich erkennen – sie sind nicht isoliert „ein weiteres generatives Modell“, sondern füllen die Lücke auf der „generativen“ Seite der Muse-Reihe und machen Metas multimodale Matrix zum ersten Mal vollständig.
Eine vollständige Matrix von „Verstehen + Generieren“
Wenn man die Muse-Reihe zusammenfasst, ist die Layoutlogik von Meta sehr klar:
| Modell | Orientierung | Charakter |
|---|
Bewertungen