LTX 2.5-Testbericht: Geschwindigkeit, Mehrfachaufnahmen und Vergleich mit MiniMax H3

E
Emma Chen·7 Min. Lesezeit·Aug 19, 2026
Auf X teilen
LTX 2.5-Testbericht: Geschwindigkeit, Mehrfachaufnahmen und Vergleich mit MiniMax H3

KI-Überblick

Was ist LTX 2.5 – und was ist im Vergleich zu LTX 2.3 neu?

LTX 2.5 ist ein offenes Audio-Video-Modell mit 22 Mrd. Parametern (open weights), das native Mehrfachaufnahme-Generierung, Diffusion Fidelity Rendering, automatische Dauerbestimmung, 4K-HDR-Ausgabe und präzise Videobearbeitung unterstützt. Das Update zielt auf weichere Gesichter, schwache Feindetails und Einzelclip-Workflows ab.

Wie schnell ist LTX 2.5 im Vergleich zu anderen KI-Videomodellen?

LTX generiert einen 10-Sekunden-Clip in 6,8 Sekunden auf zwei NVIDIA GB200-GPUs. Damit beweist der „Fast“-Pfad extrem hohe Geschwindigkeit auf Flagship-Servern – doch dies ist keine Garantie für Consumer-GPUs; die lokale Laufzeit hängt von Auflösung, Speicher, Decoder und Quantisierung ab.

Ist LTX 2.5 besser als MiniMax H3 für die lokale Generierung?

LTX 2.5 ist die stärkere Wahl für schnelle lokale Iterationen und native Mehrfachaufnahme-Entwürfe. MiniMax H3 bleibt zuverlässiger bei komplexen Prompts, scharfen Endframes, kohärenter Bewegung und qualitätsorientierter Auslieferung.

Bereit, es selbst auszuprobieren?

Kostenlose Credits bei der Anmeldung. Tarife ab $20/Monat.

Seedance kostenlos testen

Kann ich LTX 2.5 in ComfyUI ausführen und die Gewichte feinjustieren?

Ja. LTX 2.5 verfügt über offene Gewichte, offizielle ComfyUI-Unterstützung und einen trainierbaren Entwicklungs-Pfad. Beginnen Sie mit der offiziellen Vorlage, passen Sie den Decoder an den Workflow an und prüfen Sie vor einer kommerziellen Bereitstellung die aktuelle Lizenz.

Was LTX 2.5 tatsächlich ist – und welches Problem es löst

LTX hat sich stets durch Offenheit und Geschwindigkeit hervorgetan. LTX 2.5 bewahrt diese Identität, adressiert aber zwei Einschränkungen früherer Versionen, die deren Einsatz in fertigen Produktionen erschwert haben: Feindetails wirkten oft unscharf, und jede Generierung verhielt sich meist wie eine isolierte Einzelaufnahme. Die neue Version wurde entwickelt, um Subjekt, Ort, Beleuchtungskonzept und Stimme durch eine zusammenhängende Sequenz hindurch zu tragen.

Die praktische Frage lautet daher nicht mehr, ob LTX einen schnellen Clip erzeugen kann. Vielmehr geht es darum, ob diese Geschwindigkeit auch einer professionellen Review-Phase standhält. Dieser Testbericht bewertet fünf Aspekte: Kontinuität bei Mehrfachaufnahmen, Frame-Detailgenauigkeit, Audio-Video-Kohärenz, Kosten des lokalen Workflows sowie den Vergleich der Ergebnisse mit H3. Für Hintergrundinformationen zur vorherigen Generation siehe unser Seedance 2.0 vs. LTX Video-Vergleich.

Neue Funktionen in LTX 2.5 – Was hat sich geändert?

Das Upgrade ist mehr als nur ein größerer Checkpoint. Jede herausgestellte Funktion beseitigt einen spezifischen Produktionsengpass:

  • Diffusion Fidelity Rendering: Erstellt eine Szene aus hochauflösenden Keyframes und konzentriert Detailgenauigkeit dort, wo die Aufnahme sie benötigt – mit Verbesserungen bei Gesichtern, Texturen und Bewegungsgrenzen.
  • Native Mehrfachaufnahme: Generiert Weit-, Mittel- und Nahaufnahmen in einer zusammenhängenden Sequenz, wobei Charakter, Umgebung, Licht und Ton nahtlos durch Schnitte hindurch erhalten bleiben.
  • Automatische Dauerbestimmung: Ermittelt die Clip-Länge anhand der beschriebenen Aktion statt jedes Konzept in dieselbe Timing-Vorgabe zu zwingen.
  • „Fast“- und „Pro“-Pfade: „Fast“ dient kostengünstigen Vorschauen und Storyboards; „Pro“ priorisiert Detailgenauigkeit und Bewegungsstabilität. Die derzeit veröffentlichten Konfigurationen unterstützen 1080p, 1440p und 4K, wobei die Dauerbegrenzung vom gewählten Pfad und der Auflösung abhängt.
  • Präzise Bearbeitung: „Retake“ und „Extend“ ermöglichen die Überarbeitung eines Bereichs oder die Fortsetzung einer Szene, ohne die gesamte Sequenz von Grund auf neu zu generieren.

Offizielles LTX-Ergebnis mit feinen Textilfasern auf einem handgefertigten gelben Vogel

Ein natives 16:9-Frame aus einer offiziellen LTX-Ausgabe. Die sichtbaren Fasern, die flache Tiefenschärfe und die klare Silhouette erleichtern die visuelle Beurteilung der Feindetail-Rendering-Qualität auf einen Blick.

Bevor Sie sich für einen lokalen Graphen entscheiden, können Sie das Aufnahmekonzept in unserem Text-zu-Video-Workflow validieren und das genehmigte Briefing direkt in LTX übernehmen.

Geschwindigkeits-Benchmark – Die Behauptung „6,8 Sekunden“, getestet

Die Angabe von 6,8 Sekunden ist real – innerhalb der angegebenen Konfiguration: eine 10-Sekunden-Generierung auf zwei NVIDIA GB200-GPUs. Dabei handelt es sich um Flagship-Beschleuniger für Rechenzentren; die Zahl demonstriert also die Architektur-Effizienz, nicht die erwartete Leistung auf Laptop oder Desktop. Der gleiche veröffentlichte Vergleich nennt 180 Sekunden für MiniMax H3 und 317 Sekunden für Seedance 2.5 über ihre jeweiligen Testpfade.

Nutzen Sie diese Angabe als relativen Indikator – nicht als Stoppuhr-Garantie:

Hardware und Pfad Was zu erwarten ist Beste Verwendung
Dual GB200, Fast Veröffentlichter Best-Case von 6,8 Sekunden Server-Benchmarking und Hochdurchsatz-Vorschauen
Hochspeicherarbeitsstation oder Cloud-GPU Deutlicher Geschwindigkeitsvorteil, aber langsamer als die Schlagzeile Tägliche lokale oder private Generierung
Setup mit ca. 32 GB RAM und offizieller Offloading-Unterstützung Praktikable Kurzform-Iteration; Decoder-Auswahl ist entscheidend Prompt- und Kompositionstests
Consumer-Setup mit geringerem Speicher Quantisierung und Offloading bestimmen den Workflow Entwürfe vor einer gehosteten Finalrenderung

Führen Sie Ihren eigenen Benchmark mit einem festen Prompt, einem festen Seed, einer festen Dauer und einer festen Auflösung durch. Änderungen am Decoder oder der Wechsel vom „Fast“- zum „Pro“-Pfad machen den Vergleich ungültig. Für ein reproduzierbares H3-Vergleichsergebnis beginnen Sie mit dem Leitfaden zu den besten MiniMax H3-Einstellungen.

Offizielles LTX-Kamera-Control-Ergebnis mit einem DJ, eingerahmt von konvergierenden cyanfarbenen Lichtern

Das zentrierte Subjekt und die starken Leitlinien stammen aus einer offiziellen LTX-Kamera-Control-Ausgabe, hier als vollständiges natives Breitbild-Frame – nicht als Ausschnitt – dargestellt.

LTX 2.5 in ComfyUI – Setup und wichtige Einstellungen

LTX 2.5 ist in die aktuelle ComfyUI-Workflow-Familie integriert. Ein sauberes Setup ist zuverlässiger als das Importieren eines alten Graphen und das bloße Ersetzen eines Checkpoints:1. Aktualisieren Sie ComfyUI und öffnen Sie Template-Bibliothek → Video.
2. Wählen Sie die aktuelle LTX 2.5 Text-zu-Video- oder Bild-zu-Video-Vorlage aus, damit Audio-, Decoder- und Modell-Knoten übereinstimmen.
3. Laden Sie die von dieser Vorlage angeforderten Checkpoint-, Text-Encoder- und Decoder-Dateien herunter.
4. Verwenden Sie den Diffusions-Decoder für qualitätsorientierte Gesichter, Texturen und Endframes; verwenden Sie den faltungs-basierten (konvolutionalen) Decoder, wenn Vorschau-Geschwindigkeit wichtiger ist als maximale Detailgenauigkeit.
5. Beginnen Sie mit „Fast“, einer kurzen Dauer und 1080p. Verschieben Sie ausschließlich den freigegebenen Shot in „Pro“ oder eine höhere Auflösung.

Halten Sie die Prompts chronologisch: Beschreiben Sie nacheinander die Eröffnungsaufnahme, die Aktion, den Schnitt und die nächste Bildkomposition. Der MiniMax H3-Prompting-Leitfaden bietet eine nützliche Struktur, um lange Regieanweisungen in Aufnahme-für-Aufnahme-Anweisungen zu überführen. Falls sich die Figur zwischen den Aufnahmen ändert, vereinfachen Sie Garderobe und Umgebung, bevor Sie die Auflösung erhöhen. Das Ziel des ersten Durchlaufs ist Kontinuität – kein 4K-Master.

LTX 2.5 vs. MiniMax H3 – Ehrlicher Vergleich

LTX 2.5 gewinnt bei der Iterationsschleife; MiniMax H3 bietet nach wie vor eine sicherere Qualitäts-Obergrenze für anspruchsvolle Endaufnahmen. Die richtige Wahl hängt davon ab, wo Ihr Engpass liegt.

Dimension LTX 2.5 MiniMax H3
Lokale Geschwindigkeit Deutlich schneller, insbesondere mit „Fast“ Langsamere Standard-Pipeline
Bilddetail Verbessert, doch bleiben einige Szenen weich Schärfere Feindetails und sauberere Endframes
Prompt-Verständnis Stark bei direkten, chronologischen Kurzanweisungen Präziser bei langen, komplexen Regieanweisungen
Native Multi-Shot-Unterstützung Ja; ein zentrales Feature von Version 2.5 Ja; besser geeignet für qualitätsorientierte Sequenzen
Native Audio-Unterstützung Gemeinsame Audio-Video-Generierung Native 32 kHz Stereo-Audio-Generierung
Offene Gewichte (Open Weights) Herunterladbar und feinjustierbar Herunterladbare offene Gewichte
Ideal geeignet für Schnelle Iteration, Storyboards, kurze Sequenzen Endauslieferung, dichte Szenen, komplexe Narrative

Offizielles LTX-Stil-Konsistenz-Ergebnis: Ein Mädchen steuert bei Sonnenuntergang ein Segelboot

Ein natives 1920×1080-Frame aus einem offiziellen LTX-Stil-Konsistenz-Ergebnis. Figur, Boot, Wasser und Sonnenuntergangsbeleuchtung bleiben innerhalb derselben Aufnahme klar und lesbar.

Für einen fairen Test verwenden Sie denselben kreativen Brief – nicht identische technische Einstellungen erzwingen. LTX ist das bessere Skizzenbuch; H3 ist der stärkere Abschlusspfad, wenn kleine Fehler weiterhin sichtbar bleiben.

Offene Gewichte, Lizenzierung und Feinjustierung

LTX 2.5 veröffentlicht seine Gewichte und den Quellcode, sodass Teams privat betreiben, die Pipeline prüfen und das Modell an eine visuelle Domäne anpassen können. Feinjustierung ist am sinnvollsten, wenn eine Produktion wiederholt dieselbe Figur, dasselbe Produkt, dieselbe Umgebung oder denselben taktilen Stil benötigt – nicht als Reparaturwerkzeug für einen schwachen Prompt.

Offene Gewichte bedeuten nicht automatisch uneingeschränkte kommerzielle Nutzung. Prüfen Sie die aktuelle Lizenz hinsichtlich Unternehmensumsatz, Weiterverteilung, Hosted-Service-Nutzung und Anforderungen an abgeleitete Modelle, bevor Sie in Produktion gehen. Kalkulieren Sie zudem Speicherplatz für das Modell, GPU-Speicher, Tests und Wartung mit ein; der Checkpoint ist nur ein Teil der Betriebskosten.

Falls Ihr Ziel ein wiederverwendbarer, markenspezifischer Video-Adapter ist, übertragen sich Dataset und Validierungsprinzipien aus unserem MiniMax H3 LoRA-Trainingsleitfaden gut: konsistente Captions, kontrollierte Aufnahmenvielfalt und ein separater, reservierter Prompt-Satz sind wichtiger als bloßes Hinzufügen weiterer Clips.

Fazit – Für wen ist LTX 2.5 geeignet?

Wählen Sie LTX 2.5, wenn schnelle lokale Iteration, offene Gewichte, Multi-Shot-Entwürfe und benutzerdefinierte Bereitstellung im Vordergrund stehen. Wählen Sie MiniMax H3, wenn die Endauslieferung stärkere Details, striktere Befolgung langer Prompts und weniger sichtbare Kontinuitätsfehler erfordert. Kreative mit bescheidenen Hardware-Ressourcen können das Konzept zunächst validieren, bevor sie hochskalieren; Teams, die keine Checkpoints, Decoder oder ComfyUI-Graphen selbst verwalten möchten, können mit optimierten Modellen auf Seedance generieren →.

Bereit, es selbst auszuprobieren?

Setzen Sie die Schritte aus diesem Leitfaden direkt in Seedance um und verwandeln Sie Prompts oder Bilder in wenigen Minuten in fertige Videos.

Kostenlose Credits bei der Anmeldung. Tarife ab $20/Monat.