Sistema de referencia @“@Image1 camina por @Image2 con movimiento de cámara de @Video1 y música de fondo de @Audio1”
Instrucción multi-referencia que combina todas las modalidades
El modelo de video con IA de próxima generación de ByteDance con el revolucionario sistema de referencia @. Combine texto, imágenes, clips de video y audio en una sola instrucción. Sincronización nativa de audio y video, edición V2V y hasta resolución 2K a 30fps, todo en una generación unificada.
Seedance 2.0 es el modelo de generación de video con IA más avanzado de ByteDance, presentado en febrero de 2026. Adopta una arquitectura unificada de generación conjunta de audio y video multimodal que admite 4 modalidades de entrada simultáneamente: texto, hasta 9 imágenes, hasta 3 clips de video y hasta 3 pistas de audio. El innovador sistema de referencia @ le permite etiquetar elementos específicos en su instrucción y vincularlos a referencias cargadas para un control granular sobre el movimiento de cámara, la apariencia de los personajes, el ritmo del audio y el estilo visual. Las salidas alcanzan hasta resolución 2K con audio sincronizado nativo que incluye sincronización de labios multilingüe, efectos de sonido y música de fondo.
Sistema de referencia @, entrada de 4 modalidades, sincronización de audio nativa, edición V2V, resolución 2K
El sistema de referencia @ es la innovación distintiva de Seedance 2.0. Etiqueta elementos en tu instrucción de texto con @Image1, @Video1, @Audio1 y los vincula a archivos de referencia cargados. El modelo extrae movimientos de cámara de referencias de video, ritmos y características vocales de referencias de audio, y composición y estilos de referencias de imagen. Esto permite un control sin precedentes: 'Un @Image1 camina por @Image2 mientras se reproduce el movimiento de cámara de @Video1 y @Audio1 marca el ambiente.'
@Image1 camina por @Image2 con movimiento de cámara de @Video1 y música de fondo de @Audio1
Instrucción multi-referencia que combina todas las modalidades

El personaje @Image1 baila con el ritmo de @Audio1 en el entorno de @Image3
Movimiento de personaje guiado por referencia de ritmo de audio

Seedance 2.0 utiliza una arquitectura de transformer de difusión de doble rama que procesa latentes de video y audio en paralelo con atención cruzada compartida. Esto significa que el audio no se agrega como un paso de posprocesamiento, sino que se genera simultáneamente con lo visual, garantizando una sincronización a nivel de milisegundos. El modelo puede generar diálogos con sincronización de labios multilingüe, efectos de sonido adaptados a las acciones y música de fondo acorde al ambiente, todo controlado mediante instrucciones de texto o referencias de audio.
Una persona dando una presentación con discurso en inglés sincronizado y transiciones de diapositivas
Diálogo con sincronización de labios y contenido visual

Tutorial de cocina con narración paso a paso y sonidos ambientales de cocina
Narración sincronizada con acciones de cocina

Explore las capacidades de Seedance 2.0 en control de referencia multimodal, generación de audio nativa y edición de video
Sistema de referencia @“@Image1 camina por @Image2 con movimiento de cámara de @Video1 y música de fondo de @Audio1”
Instrucción multi-referencia que combina todas las modalidades
Sistema de referencia @“El personaje @Image1 baila con el ritmo de @Audio1 en el entorno de @Image3”
Movimiento de personaje guiado por referencia de ritmo de audio
Generación de audio nativa“Una persona dando una presentación con discurso en inglés sincronizado y transiciones de diapositivas”
Diálogo con sincronización de labios y contenido visual
Generación de audio nativa“Tutorial de cocina con narración paso a paso y sonidos ambientales de cocina”
Narración sincronizada con acciones de cocina
Seedance 2.0 FAQ
El sistema de referencia @ le permite etiquetar elementos en su instrucción con las marcas @Image1, @Video1, @Audio1 y vincularlos a archivos de referencia cargados. Seedance 2.0 extrae movimientos de cámara de referencias de video, ritmos de audio y estilos de composición de imágenes. Esto le brinda un control granular sobre cada aspecto del video generado.
Seedance 2.0 admite 4 modalidades de entrada simultáneamente: instrucciones de texto (sin límite de longitud), hasta 9 imágenes de referencia (≤30MB cada una), hasta 3 clips de video (2-15s de duración total, ≤50MB cada uno) y hasta 3 pistas de audio (≤15s en total, ≤15MB cada una). Límite total de archivos: 12 archivos por solicitud.
Seedance 2.0 genera en resolución nativa 2K (2048x1080) a 30fps con múltiples niveles de calidad: 480p, 720p y 1080p. La duración del video oscila entre 4 y 15 segundos por generación. Las relaciones de aspecto compatibles incluyen horizontal, vertical y ultra panorámica 21:9.
Seedance 2.0 utiliza una arquitectura de doble rama que procesa latentes de video y audio en paralelo. El audio se genera simultáneamente con lo visual, garantizando una sincronización a nivel de milisegundos. Admite diálogos con sincronización de labios multilingüe, efectos de sonido adaptados a las acciones y música de fondo acorde al ambiente. También puede cargar referencias de audio como entrada.
La edición V2V le permite cargar clips de video existentes como referencia y generar nuevos videos que heredan sus patrones de movimiento, trayectorias de cámara y ritmo. Puede cambiar elementos específicos como vestimenta, acciones o detalles de escena mientras conserva la estructura de movimiento original.
Seedance 2.0 agrega entradas de referencia de video y audio, aumenta las referencias de imagen de 1 a 9, introduce el sistema de referencia @ para control multimodal, añade edición de video V2V, amplía la resolución máxima de 1080p a 2K, aumenta la duración de 12s a 15s y es aproximadamente un 30% más rápido que 1.5 Pro.
Seedance 2.0 utiliza precios dinámicos por segundo según la resolución: 480p (14-28 créditos/segundo), 720p (28.5-57 créditos/segundo) y 1080p (640-3,810 créditos/segundo). Hay dos variantes de velocidad: Estándar y Rápida, siendo la Rápida aproximadamente un 30% más veloz.
Seedance 2.0 es ideal para directores de video que necesitan control preciso del movimiento, creadores de contenido que quieren sincronización de audio nativa sin posproducción, anunciantes que producen contenido de video de marca, educadores que crean tutoriales narrados y cualquier persona que necesite video profesional con IA y sonido sincronizado.
“El sistema de referencia @ es genuinamente revolucionario. Puedo extraer movimientos de cámara de un clip de referencia y aplicarlos al instante: es un flujo de trabajo creativo completamente nuevo.”
Alex Kim: “El sistema de referencia @ es genuinamente revolucionario. Puedo extraer movimientos de cámara de un clip de referencia y aplicarlos al instante: es un flujo de trabajo creativo completamente nuevo.”
Priya Sharma: “La sincronización de audio nativa ahorra horas de posproducción. La calidad del sincronizado de labios es sorprendentemente precisa incluso con diálogos que no son en inglés.”
Lucas Müller: “La edición V2V me permite mejorar el metraje existente sin necesidad de volver a grabar. Seedance 2.0 es ahora una herramienta central en nuestro flujo de producción.”
Yuki Tanaka: “La entrada de 4 modalidades cambia las reglas del juego. Puedo incluir un diseño de personaje, una referencia de movimiento de cámara y música de fondo en una sola instrucción y obtener exactamente lo que imaginé.”
Experimenta Seedance 2.0 — el generador de video más avanzado de ByteDance, gratis en línea
10,000+ users