¡Oferta por tiempo limitado! Desbloquea un año de creatividad sin límites con los planes anuales con HASTA 27% DE DESCUENTO.

Ver plan ›
Guías en video

El manual de Seedance 2.0

O
Equipo de OpenArt
Apr 24, 2026 · 7 minutos de lectura
The Seedance 2.0 Handbook

In February 2026, ByteDance dropped Seedance 2.0. Within 24 hours it was everywhere, because a filmmaker generated a Hollywood-quality fight scene with a two-line prompt. The Deadpool screenwriter saw it and publicly posted that it was likely over for screenwriters. Elon Musk replied. The Motion Picture Association issued a formal statement the same day. ByteDance pulled the ability to generate real celebrity likenesses, tightened the guardrails, and the internet held its breath wondering if the model had been gutted in the process.

No lo fue. La capacidad subyacente, la acción, la física, el movimiento, la interpretación emocional, todo sobrevivió intacto. Y sinceramente, esas conversaciones tienen que suceder. La IA generativa avanza más rápido de lo que cualquier marco legal puede seguir, y cómo la industria lo maneja importa. Pero ese es otro video. Lo que sí podemos decirte es que Seedance 2.0 es el modelo de video más capaz del mercado ahora mismo, y está disponible en OpenArt.

Ermin Monzon, nuestro Head of Content Media & Education, explicó por qué el modelo importa a nivel técnico. Nuestro creador interno Bob puso a prueba todos los tipos de referencia que se le ocurrieron. Y nuestra colaboradora Mia Meow armó una guía de flujo de trabajo con 10 tips tras semanas de pruebas. Este Manual reúne lo mejor de los tres para darte un panorama completo.

Lo que Seedance 2.0 puede hacer → Resumen de Ermin

Antes de entrar en los consejos de flujo de trabajo, vale la pena entender por qué este modelo está generando la reacción que provoca. Ermin mostró una serie de demos que revelan dónde Seedance 2.0 se despega de todo lo demás en el mercado.

The fight scene that broke the internet is the obvious headline, but the demo that surprised Ermin more was a dancer with neon light trails sweeping around them in orbital arcs. It looks like a Nike commercial or a music video with a serious production budget. The reason this is technically significant is that the light trails are not composited over the dancer. The model generated both simultaneously. The motion and the effect interact with each other: the trails bend around the dancer's body, and the lighting from the trails actually reflects on the floor beneath them. That is called coherent VFX generation. The model understands that light behaves physically. It does not just paint glowing lines on top of video. For anyone doing music video content, UGC ads, or anything with a visual effects component, this is where Seedance 2.0 stands apart.

Otra demo que vale la pena ver: un esquiador saltando desde una montaña con una cordillera alpina llenando el fondo. La física del rocío de nieve, la rotación del cuerpo, el aterrizaje. Todo generado, todo físicamente plausible. El modelo maneja acción y movimiento a un nivel que ninguna otra herramienta disponible al público está igualando ahora mismo.

Texto a video: la estructura de prompt de toma única → 0:50 en el video de Mia

Todo lo que escuchas en las demos de texto a video de Mia, el audio, el sonido ambiental, se generó al mismo tiempo que el video. Un solo prompt, una sola toma. Otros modelos batallan para sostener tantos detalles en una sola generación. Seedance 2.0 sí sigue lo que le das.

La estructura de prompt de Mia para tomas de una sola secuencia es sencilla. Empieza con "continuous single take" y las acciones de tu cámara. Luego describe lo que ve la cámara mientras se mueve. Termina con palabras clave de control y estilo: no cuts, seamless transition, cinematic, high definition. Solo esa fórmula te dará resultados sólidos.

Para escenas más complejas, como un secuencia de pelea en el 2:13, Mia recommends starting with a clear beginning and end state. Describe the fight scene, describe how it ends (everyone on the ground, for example), and let the model fill the middle. She also found that describing specific camera angles creates a more cinematic feel, and adding a film genre reference to the end of the prompt helps set the visual tone. One thing she discovered through iteration: if you describe your characters physically in the prompt rather than leaving it vague, the model does a better job designing the scene and keeping characters visually distinct.

La clave de Mia sobre los prompts: el modelo está bien entrenado en el lenguaje cinematográfico. Términos como "tracking shot", "crane shot", "whip pan" y referencias de género como "película de guerra cruda" o "thriller neo-noir" marcan una gran diferencia.

How to add references and tag UI 2fps.gif

El tutorial completo de Mia cubre sus 10 consejos de flujo de trabajo, incluidos los que hemos destilado a lo largo de este Manual. Míralo en paralelo o vuelve a él más tarde.

El sistema de referencias: etiqueta imágenes, video y audio en tu prompt → 4:27 en el video de Mia · → Análisis a fondo de referencias de Bob

Esta es la mecánica central que impulsa todo lo demás en Seedance 2.0 en OpenArt, y una vez que la entiendas, cada sección que sigue tendrá más sentido.

La idea es simple: puedes subir imágenes, videos y archivos de audio como referencias, y luego etiquetarlos directamente dentro de tu prompt de texto usando el símbolo @. Escribe @ y podrás elegir qué archivo subido quieres referenciar. Desde ahí, le dices al modelo exactamente qué hacer con cada uno. Usa la cara de la imagen uno. Usa el movimiento de cámara del video uno. Sincroniza los labios con el audio uno. El modelo lee tu prompt, mira los archivos etiquetados y combina todo en una sola generación.

De Mia tutorial multimodal en 4:27 es la explicación más clara de cómo funciona esto. Subió un video de baile, dos imágenes de personajes y una canción, luego le indicó al modelo que usara el video como referencia de movimiento de cámara, la imagen uno como la bailarina de la izquierda, la imagen dos como la de la derecha y el audio como música de fondo. Todo etiquetado con @, todo en un solo prompt.

Bob pushed this further. In one of his demos, he referenced four different files in a single prompt: the face from image one, the overalls from image three, the shirt from image four, and a location from a reference video. The prompt was: the man in image one is walking down the street from the video wearing the overalls from image three and carrying the shirt from image four, talking to the camera. The model held consistency across every element. That is a remarkable amount of compositing happening from a single text prompt.

Bob 4-element compositing demo.jpg

Algunas cosas que ambos creadores aprendieron sobre cómo se comportan las referencias:

Si tu video de referencia tiene audio y además etiquetas un archivo de audio separado, el modelo tiende a preferir el audio existente del video sobre la pista que subes. El truco de Mia: sube el video sin audio si quieres que tu propia música o voz en off tenga prioridad.

Las referencias no se limitan a elementos concretos. También puedes señalar un video y decir "quiero que se vea así" sin copiar nada más. Bob usó esto para transferir un estilo visual (lente ojo de pez, luz parpadeante) de un video a una escena completamente nueva.

No tienes que usar todos los tipos de referencia a la vez. Una sola imagen de personaje en un prompt de texto es un uso perfectamente válido del sistema. El poder crece según cuántos elementos vayas superponiendo, pero funciona bien en cualquier nivel de complejidad.

Seedance Reference system wiring diagram.gif

Sincronización labial, voz y actuación → 7:57 en el video de Mia · → Análisis a fondo del audio de Bob

El video completo de Bob cubre a fondo las referencias en imágenes, audio y video. Las secciones de lip-sync y clonación de voz son donde realmente brilla.

Esta es la sección con más consejos de más creadores, y con buena razón. Las capacidades de audio de Seedance 2.0 son la función que lo distingue de todo lo demás en el mercado ahora mismo.

El truco de la transcripción de Bob

Este es el consejo más útil de los tres videos. Cuando hagas lip sync con una referencia de audio, incluye en tu prompt la transcripción exacta de las palabras junto con el archivo de audio. Aquí te explicamos por qué.

Bob tested this with a clip of himself talking to camera. In his first attempt, he tagged the audio file and described the scene but did not include the exact words being spoken. The model listened to the audio and tried to replicate it, but got details wrong ("CGI 2.0" instead of "Seedance 2.0"). When he modified the prompt to explicitly spell out the words being said, the audio file combined with the written transcript produced dramatically better results. The lip sync was tighter, the words were accurate, and the overall performance was more convincing.

The transcript trick before after.jpg

La conclusión: siempre que hagas lip sync, incluye la transcripción real junto con el archivo de audio. Casi con seguridad obtendrás un mejor resultado.

Haz coincidir la duración de tu audio con la de tu video

Mia lo aprendió a las malas. Si tu audio de referencia dura 11 segundos y configuras el video a 15 segundos, el modelo se ve obligado a estirar o comprimir el audio para que encaje, y casi seguro perderás la sincronización. Siempre haz coincidir la duración configurada con la duración real de tu archivo de audio.

Clonación de voz

Bob demostró la clonación de voz con un clip de 15 segundos de la voz de Ermin (el tío Monz de la oficina de OpenArt). La configuración: graba unos 15 segundos de una voz de forma que capture las cualidades que quieres duplicar. Etiqueta ese audio como referencia de voz en lugar de fuente para sincronización labial. Luego escribe el diálogo real en el prompt y el modelo genera un nuevo audio con esa voz.

El primer intento fue demasiado rápido para la cadencia natural de Ermin. Bob le dio al modelo 14 segundos completos en lugar de 9 y el resultado sonó muchísimo más parecido a cómo Ermin hablaría de verdad. La lección: el ritmo importa tanto como la muestra de voz. Dale al modelo el tiempo suficiente para pronunciar las palabras a la velocidad correcta para esa voz.

Puedes reutilizar la misma referencia de voz en varios videos para mantener la consistencia vocal de un personaje.

Consejos de dirección de actuación de Mia → 12:20 en el video de Mia

Mia descubrió que puedes dirigir la actuación emocional y la energía de un personaje a través del prompt mismo. Las palabras que escribes influyen en cómo el personaje dice el diálogo, no solo en lo que dice. Si escribes "lo dice con emoción", el lenguaje corporal y la energía vocal del personaje cambian. Si escribes "ella susurra nerviosa", toda la actuación cambia.

Esto también aplica a varios personajes en la misma escena. En 11:10 en el video de Mia, ella muestra cómo darles a dos personajes personalidades vocales y estados emocionales distintos en un solo prompt, y el modelo los mantiene diferenciados.

Consejo de Mia sobre las barreras negativas

Cuando quieres transiciones limpias de una escena a otra sin morphing entre ellas (por ejemplo, narrando a través de cuatro imágenes distintas), Mia aprendió a agregar restricciones negativas al prompt: "no morphing, no ghosting, no camera cuts." Sin esto, el modelo a veces mezcla escenas de maneras que parecen fallas visuales. Con estas restricciones, obtienes transiciones nítidas de una escena a la siguiente.

Lip sync and voice tips.jpg

Referencias avanzadas: movimiento, storyboards y estilo → 13:22 en el video de Mia · → Referencias de video de Bob

Una vez que entiendas cómo funciona el sistema de referencias para rostros y voces, esto es lo demás a lo que puedes apuntarlo.

Transferencia de movimiento y cámara

Si tienes una toma donde te gusta cómo se mueve la cámara, puedes transferir ese movimiento a una escena completamente nueva. Bob lo demostró con un video de un perro saltando mientras la cámara hacía un dolly a su alrededor. Trajo ese video como referencia y dijo: "usa ese video como referencia para el movimiento de cámara y del personaje para guiar a un espantapájaros saltando en un trampolín". El resultado transfirió tanto el dolly de cámara como la acción de saltar al nuevo personaje y a la nueva escena.

También mostró transferencia de movimiento con material real. Usando un clip de Emily corriendo a las 19:15, dijo "reemplaza a la mujer del video uno con el hombre de la imagen uno y que esté nevando." El modelo cambió al personaje, agregó clima invernal y mantuvo intacto el movimiento de correr. Algunos detalles del fondo cambiaron (la atmósfera general pasó a ser gris e invernal), pero el movimiento central se mantuvo.

Character Swap Split Screen LRB.mp4

De storyboard a video → 13:22 en el video de Mia

Puedes subir una grilla estilo viñetas de cómic o un storyboard y el modelo intentará animarlo viñeta por viñeta. Mia lo probó con una grilla dibujada a mano y descubrió que el modelo seguía las viñetas en orden, pero la lógica direccional entre viñetas no siempre le resultaba obvia solo con los visuales.

Dos consejos que hicieron que esto funcionara mejor. Primero, describe la lógica narrativa entre los paneles en tu prompt. El modelo necesita entender el progreso de la historia, no solo la secuencia visual. Segundo, si tu storyboard tiene texto o subtítulos, agrega "text overlay no captions on screen" al prompt para evitar que el texto se filtre en el video generado.

Mia también señala que puedes usar páginas reales de cómics para esto, pero ten cuidado con cualquier cosa que involucre propiedad intelectual existente.

Referencias de estilo y replicación de plantillas → 14:45 en el video de Mia

Mia's template replication tip is a practical one for anyone producing content at volume. If you have a video with a visual style you like, you can reference it and tell the model to replicate just the style, not the content. She tested this by pointing to a video and saying she only wanted the fisheye lens effect and the flickering double-exposure look, then combined it with character images and outfit references to create a fashion sequence. The model picked up the abstract visual qualities without copying the specific content of the reference video.

Esto es útil para mantener una identidad visual consistente en una serie de videos. Crea un video que te guste y luego usa su estilo como referencia para cada generación siguiente.

Después de generar: extiende y edita → 16:06 en el video de Mia

Un video no está terminado cuando se genera. Seedance 2.0 te permite extender, editar y reescribir después.

Extend Video__Extend Video.gif

Extender. Sube el video que quieras continuar, elige extender hacia adelante (o hacia atrás), indica cuántos segundos, ajusta tu configuración de duración para que coincida y describe qué quieres que pase en la nueva parte. Mia extendió un video 10 segundos hacia adelante, luego lo extendió 10 segundos hacia atrás y los combinó en una escena continua más larga que el límite de generación de 15 segundos. Eso es un verdadero avance. El límite de 15 segundos solía ser un tope infranqueable. Ahora puedes seguir construyendo escenas continuas más largas sin cortes.

Edita. Si quieres cambiar algo que ya ocurrió en un video generado, puedes hablar con el modelo sobre el video existente y decirle qué modificar. Esto funciona parecido a la edición de video a video en Wan 2.7, pero con la comprensión más sólida de Seedance 2.0 sobre lo que hay en la escena.

En resumen

Seedance 2.0 is the most capable video model available on OpenArt right now, and the reference system is the reason to pay attention. The ability to tag images, video, and audio into a single prompt and have the model hold consistency across all of them is not something any other model is doing at this level. The lip sync is strong. The voice cloning works. The motion transfer is clean. The coherent VFX generation, where lighting and effects actually interact with the scene physically, is new territory entirely.

Tres creadores, tres videos y una misma conclusión: este modelo sabe escuchar. Sigue prompts complejos y con muchos elementos mejor que cualquier otra opción. Lo mejor que puedes hacer es empezar a pedirle lo que quieres, porque tiene una imaginación increíble. Palabras de Bob, y tiene toda la razón.

👉 Prueba Seedance 2.0 en OpenArt

Crea sin límites

Únete a millones de creadores que usan OpenArt para generar imágenes, videos, personajes e historias, todo en una sola plataforma.

Comienza gratis →