@-Referenzsystem“@Image1 geht durch @Image2 mit Kamerabewegung von @Video1 und Hintergrundmusik von @Audio1”
Multi-Referenz-Prompt mit allen Modalitäten
ByteDances nächste Generation des KI-Videomodells mit dem revolutionären @-Referenzsystem. Kombinieren Sie Text, Bilder, Videoclips und Audio in einer einzigen Eingabe. Native Audio-Video-Synchronisation, V2V-Bearbeitung und bis zu 2K-Auflösung bei 30fps – alles in einer einheitlichen Generierung.
Seedance 2.0 ist ByteDances fortschrittlichstes KI-Videogenerierungsmodell, das im Februar 2026 vorgestellt wurde. Es verwendet eine einheitliche multimodale Audio-Video-Joint-Generierungsarchitektur, die gleichzeitig 4 Eingabemodalitäten unterstützt – Text, bis zu 9 Bilder, bis zu 3 Videoclips und bis zu 3 Audiospuren. Das bahnbrechende @-Referenzsystem ermöglicht es Ihnen, bestimmte Elemente in Ihrer Eingabe zu markieren und mit hochgeladenen Referenzen zu verknüpfen, um eine präzise Kontrolle über Kamerabewegungen, Charakterdarstellung, Audiorhythmus und visuellen Stil zu erhalten. Die Ausgabe erreicht bis zu 2K-Auflösung mit nativem synchronisiertem Audio, einschließlich mehrsprachiger Lippen synchronisation, Soundeffekten und Hintergrundmusik.
@-Referenzsystem, 4-Modalitäten-Eingabe, native Audiosynchronisation, V2V-Bearbeitung, 2K-Auflösung
Das @-Referenzsystem ist Seedance 2.0s bahnbrechende Innovation. Sie markieren Elemente in Ihrem Text-Prompt mit @Image1, @Video1, @Audio1 und binden sie an hochgeladene Referenzdateien. Das Modell extrahiert Kamerabewegungen aus Videoreferenzen, Beat-Rhythmen und Stimmcharakteristiken aus Audio-Referenzen sowie Komposition und Stile aus Bildreferenzen. Dies ermöglicht eine beispiellose Kontrolle: ‚Eine @Image1 geht durch @Image2, während @Video1 Kamerabewegung abgespielt wird und @Audio1 die Stimmung vorgibt.'
@Image1 geht durch @Image2 mit Kamerabewegung von @Video1 und Hintergrundmusik von @Audio1
Multi-Referenz-Prompt mit allen Modalitäten

@Image1 Charakter tanzt mit Rhythmus von @Audio1 in @Image3 Umgebung
Charakterbewegung durch Audio-Beat-Referenz gesteuert

Seedance 2.0 verwendet eine Dual-Branch-Diffusion-Transformer-Architektur, die Video- und Audio-Latents parallel mit gemeinsamer Cross-Attention verarbeitet. Das bedeutet, dass Audio nicht als Nachbearbeitungsschritt hinzugefügt wird – es wird gleichzeitig mit den Bildern generiert, was eine millisekundengenaue Synchronisation gewährleistet. Das Modell kann mehrsprachige lippensynchrone Dialoge, aktionsangepasste Soundeffekte und stimmungsangepasste Hintergrundmusik erzeugen, die alle durch Text-Prompts oder Audio-Referenzen gesteuert werden.
Eine Person hält eine Präsentation mit synchronisierter englischer Sprache und Folienübergängen
Lippensynchrone Dialoge mit visuellem Inhalt

Koch-Tutorial mit Schritt-für-Schritt-Erzählung und Küchenatmosphäre
Erzählung synchronisiert mit Kochaktionen

Entdecken Sie Seedance 2.0s Fähigkeiten in multimodaler Referenzsteuerung, nativer Audiogenerierung und Videobearbeitung
@-Referenzsystem“@Image1 geht durch @Image2 mit Kamerabewegung von @Video1 und Hintergrundmusik von @Audio1”
Multi-Referenz-Prompt mit allen Modalitäten
@-Referenzsystem“@Image1 Charakter tanzt mit Rhythmus von @Audio1 in @Image3 Umgebung”
Charakterbewegung durch Audio-Beat-Referenz gesteuert
Native Audiogenerierung“Eine Person hält eine Präsentation mit synchronisierter englischer Sprache und Folienübergängen”
Lippensynchrone Dialoge mit visuellem Inhalt
Native Audiogenerierung“Koch-Tutorial mit Schritt-für-Schritt-Erzählung und Küchenatmosphäre”
Erzählung synchronisiert mit Kochaktionen
Seedance 2.0 FAQ
Das @-Referenzsystem ermöglicht es Ihnen, Elemente in Ihrem Prompt mit @Image1-, @Video1- und @Audio1-Labels zu markieren und mit hochgeladenen Referenzdateien zu verknüpfen. Seedance 2.0 extrahiert Kamerabewegungen aus Videoreferenzen, Beat-Rhythmen aus Audio und Kompositionsstile aus Bildern. Dies gibt Ihnen eine präzise Kontrolle über jeden Aspekt des generierten Videos.
Seedance 2.0 unterstützt gleichzeitig 4 Eingabemodalitäten: Text-Prompts (unbegrenzte Länge), bis zu 9 Referenzbilder (≤30MB pro Datei), bis zu 3 Videoclips (2-15s Gesamtdauer, ≤50MB pro Datei) und bis zu 3 Audiospuren (≤15s gesamt, ≤15MB pro Datei). Dateilimit insgesamt: 12 Dateien pro Anfrage.
Seedance 2.0 gibt in nativer 2K-Auflösung (2048x1080) bei 30fps mit mehreren Qualitätsstufen aus: 480p, 720p und 1080p. Die Videodauer beträgt 4 bis 15 Sekunden pro Generierung. Unterstützte Seitenverhältnisse umfassen Querformat, Hochformat und 21:9 Ultraweit.
Seedance 2.0 verwendet eine Dual-Branch-Architektur, die Video- und Audio-Latents parallel verarbeitet. Audio wird gleichzeitig mit den Bildern generiert, was eine millisekundengenaue Synchronisation gewährleistet. Es unterstützt mehrsprachige lippensynchrone Dialoge, aktionsangepasste Soundeffekte und stimmungsangepasste Hintergrundmusik. Sie können auch Audio-Referenzen als Eingabe hochladen.
V2V-Bearbeitung ermöglicht es Ihnen, vorhandene Videoclips als Referenz hochzuladen und neue Videos zu generieren, die deren Bewegungsmuster, Kamerapfade und Tempo übernehmen. Sie können bestimmte Elemente wie Outfits, Aktionen oder Szenendetails ändern, während die ursprüngliche Bewegungsstruktur erhalten bleibt.
Seedance 2.0 fügt Video- und Audio-Referenzeingaben hinzu, erhöht die Bildreferenzen von 1 auf 9, führt das @-Referenzsystem für multimodale Steuerung ein, ergänzt V2V-Videobearbeitung, erweitert die maximale Auflösung von 1080p auf 2K, verlängert die Dauer von 12s auf 15s und ist etwa 30% schneller als 1.5 Pro.
Seedance 2.0 verwendet sekundenbasierte dynamische Preisgestaltung basierend auf der Auflösung: 480p (14-28 Credits/Sekunde), 720p (28,5-57 Credits/Sekunde) und 1080p (640-3.810 Credits/Sekunde). Es gibt zwei Geschwindigkeitsvarianten: Standard und Fast, wobei Fast etwa 30% schneller ist.
Seedance 2.0 ist ideal für Videoregisseure, die präzise Bewegungskontrolle benötigen, Content-Ersteller, die native Audiosynchronisation ohne Nachbearbeitung wünschen, Werbetreibende, die markierte Videoinhalte produzieren, Pädagogen, die erklärende Tutorials erstellen, und alle, die professionelle KI-Videos mit synchronisiertem Ton benötigen.
“Das @-Referenzsystem ist wirklich revolutionär. Ich kann Kamerabewegungen aus einem Referenzclip extrahieren und sofort anwenden – das ist ein völlig neuer kreativer Workflow.”
Alex Kim: “Das @-Referenzsystem ist wirklich revolutionär. Ich kann Kamerabewegungen aus einem Referenzclip extrahieren und sofort anwenden – das ist ein völlig neuer kreativer Workflow.”
Priya Sharma: “Native Audiosynchronisation spart Stunden an Nachbearbeitung. Die Lippensynchronisation ist selbst bei nicht-englischen Dialogen überraschend präzise.”
Lucas Müller: “V2V-Bearbeitung ermöglicht es mir, vorhandenes Material zu verbessern, ohne neu drehen zu müssen. Seedance 2.0 ist jetzt ein Kernwerkzeug in unserer Produktionspipeline.”
Yuki Tanaka: “Die 4-Modalitäten-Eingabe ist ein Game-Changer. Ich kann ein Charakterdesign, eine Kamerabewegungsreferenz und Hintergrundmusik in einen einzigen Prompt bringen und genau das erhalten, was ich mir vorgestellt habe.”
Erleben Sie Seedance 2.0 – den fortschrittlichsten Videogenerator von ByteDance, kostenlos online
10,000+ users