Cómo usar Seedance 2.0: Tutorial paso a paso para principiantes (2026)
2026/04/07

Cómo usar Seedance 2.0: Tutorial paso a paso para principiantes (2026)

Probé más de 300 prompts de Seedance 2.0 para que tú no tengas que hacerlo. Tutorial completo con 15 plantillas de prompts listas para copiar, guía del sistema de referencias @, y técnicas cinematográficas.

Pasé mi primera semana con Seedance 2.0 quemando créditos en rostros deformados, caminatas rígidas y escenas que parecían una presentación de diapositivas barata. El modelo claramente era potente, pero mis prompts eran el problema. Después de más de 300 generaciones, descubrí lo que realmente funciona: una estructura de prompt de tres capas, el sistema de referencias @ que la mayoría de los tutoriales se saltan, y un puñado de plantillas que producen resultados cinematográficos al primer intento. Este es el tutorial que me hubiera gustado tener el primer día.

Qué es Seedance 2.0 — Resumen en 30 segundos

Seedance 2.0 es el generador de video con IA más reciente de ByteDance, lanzado en febrero de 2026. Si ya usaste Seedance 1.5, estas son las tres mejoras que importan:

  • Entrada multimodal: Aliméntalo con texto + hasta 9 imágenes + 3 videos + 3 archivos de audio simultáneamente
  • Audio nativo: Efectos de sonido, música y diálogos con sincronización labial multilingüe integrados en el proceso de generación
  • Duración de 15 segundos: Un aumento respecto al límite anterior, con narrativa de múltiples tomas en una sola generación
EspecificaciónDetalles
Resolución480p, 720p, 1080p (Estándar); 480p, 720p (Fast)
Duración4–15 segundos
Relaciones de aspecto16:9, 9:16, 1:1, 4:3, 3:4, 21:9
Tipos de entradaTexto, imágenes, clips de video, pistas de audio
AudioSincronización nativa — efectos de sonido, música, diálogos

Para un análisis detallado de las funciones y cómo Seedance 2.0 se compara con Kling y Sora 2, lee la Guía completa de Seedance 2.0.

Cómo acceder a Seedance 2.0

No necesitas un número de teléfono chino ni VPN. La forma más rápida es usar la herramienta de Seedance 2.0 en SoraVideo.art directamente en tu navegador — texto a video, imagen a video y referencia a video, todo en un solo lugar.

Empieza a generar en 60 segundos

Ve a SoraVideo.art → Seedance 2.0 y comienza con texto a video. No necesitas una cuenta separada de ByteDance. Los usuarios nuevos pueden obtener un paquete inicial de $4.99 — suficientes créditos para probar cada plantilla de esta guía. Si encaja con tu flujo de trabajo, actualiza a un plan mensual después. Para otras opciones de acceso incluyendo Dreamina y BytePlus API, consulta la guía de acceso completa.

Tu primer video en 5 minutos

La mayoría de los tutoriales solo muestran texto a video. Eso es como aprender a manejar solo en primera velocidad. Seedance 2.0 tiene tres modos de generación — elige el que corresponda a lo que tengas disponible:

  • Texto a video → Tienes una idea en tu cabeza pero no tienes recursos visuales
  • Imagen a video → Tienes una foto y quieres darle vida
  • Referencia a video → Tienes imágenes + clips de video + audio y quieres mezclarlos todos

Aquí tienes el paso a paso para tu primera generación:

Comienza con Texto a video para tu primer intento. Configura estos parámetros amigables para principiantes:

ParámetroRecomendadoPor qué
Duración5 segundosIteración rápida, menor costo de créditos
Resolución720pMejor balance calidad-velocidad
Relación de aspecto16:9Formato universal
AudioActivadoLa fortaleza única de Seedance — no la desperdicies

Copia este prompt inicial y pégalo directamente:

A golden retriever runs through a sunlit meadow toward the camera.
Slow motion. Cinematic golden hour lighting. Shallow depth of field.
Camera tracks the dog at eye level, slight handheld movement.
Warm color grading, film grain texture.

Por qué funciona:

  • El sujeto es específico: "golden retriever" en vez de "a dog"
  • La acción es clara: "runs through a meadow toward the camera"
  • La cámara tiene dirección: "tracks at eye level, handheld movement"
  • El estilo está definido: "golden hour, shallow DOF, film grain"

Haz clic en Generar y espera de 30 a 60 segundos. Cuando aparezca el resultado, hazte tres preguntas:

  1. ¿El sujeto está bien? Si el perro se ve raro, sé más específico con la raza, el color y el tamaño.
  2. ¿El movimiento está bien? Si el movimiento se siente rígido, agrega palabras como "natural gait" o "energetic sprint."
  3. ¿La cámara está bien? Si el encuadre no está bien, especifica la distancia — "medium shot" o "close-up."

Cambia una sola variable a la vez. No reescribas todo el prompt — eso reinicia la interpretación del modelo y desperdicia créditos.

Tu primer video no será perfecto. Eso está bien. La iteración es la habilidad, no la suerte.

La estructura de prompt de tres capas

Después de probar cientos de prompts, siempre vuelvo a la misma estructura. Cada prompt efectivo de Seedance 2.0 tiene tres capas:

CapaQué escribirEjemplo
EscenaUbicación, hora, clima, atmósferarain-soaked neon alley at midnight, steam rising from grates
SujetoPersonaje, acción, expresión, vestuariowoman in black trench coat, walking fast, tense expression
Cámara y estiloLente, movimiento, grado de color, tipo de películatracking shot from behind, film noir palette, 35mm grain

Reglas que aprendí a las malas

El modelo lee de izquierda a derecha. Lo que escribes primero tiene más peso. Si tu sujeto sigue siendo opacado por el fondo, mueve la descripción del sujeto al principio de tu prompt.

150 palabras es el punto ideal. Con menos de 50, el modelo llena los espacios al azar. Con más de 300, empieza a ignorar la segunda mitad. Lo probé extensamente — entre 120 y 200 palabras consistentemente da los mejores resultados.

Usa descripciones positivas, nunca negativas. Escribe "sharp focus, clean details" en vez de "no blur, no artifacts." El modelo interpreta instrucciones positivas de forma mucho más confiable.

Mezcla inglés y chino cuando ayude. Las descripciones de acción funcionan mejor en inglés. Las palabras clave de estado de ánimo y atmósfera a veces producen resultados más fuertes en chino. Mi enfoque personal: inglés para el prompt principal, chino para palabras clave de estilo cuando busco una estética específica.

El sistema de referencias @ — Lo que la mayoría de tutoriales se saltan

Esta es la función que separa a Seedance 2.0 de cualquier otro generador de video con IA. La mayoría de tutoriales lo mencionan en una sola oración. Eso es un error — es la herramienta individual más poderosa para obtener resultados consistentes y controlables.

Qué puedes subir

TipoLímiteQué controla
Imágenes0–9Apariencia del personaje, entorno, estilo
Videos0–3 (total ≤ 15 segundos)Movimiento de cámara, estilo de movimiento, ritmo
Audio0–3 (total ≤ 15 segundos)Ritmo musical, sincronización labial de diálogos, sonido ambiental

Cómo funciona el sistema de prioridades

El modelo pondera las referencias en este orden:

  1. @Audio = Ancla rítmica — controla el timing del lip-sync y la edición sincronizada al ritmo
  2. @Video = Ancla de movimiento — copia las trayectorias de cámara y la coreografía de acción
  3. @Image = Ancla visual — fija el rostro del personaje, el vestuario y el estilo del entorno

Ejemplo completo de prompt

Character from @Image1 walks through the landscape in @Image2.
Camera follows from @Video1 perspective, smooth tracking movement.
Background music synced to @Audio1, beat-matched cuts.
Cinematic warm lighting, shallow depth of field, 35mm film texture.

Consejos prácticos

  • Empieza con 2–3 archivos, no con 12. Más referencias significa más señales en conflicto. Agrega complejidad de forma gradual.
  • Para imágenes de personajes, usa un retrato de medio cuerpo con fondo limpio. Los fondos recargados confunden el ancla visual.
  • Siempre especifica qué controla cada referencia en tu prompt. No solo subas archivos y esperes lo mejor — dile al modelo explícitamente: "face from @Image1" o "camera movement from @Video1."

15 plantillas de prompts que puedes copiar ahora mismo

Cada plantilla a continuación está lista para pegar. Incluyo el prompt, por qué funciona y los parámetros recomendados.

Prompts de texto a video

1. Comercial de producto

A sleek espresso machine sits on a marble kitchen counter.
Steam rises from a freshly pulled shot. Morning sunlight streams
through a window, casting warm highlights on brushed steel.
The camera performs a slow 180-degree orbit around the machine.
Shallow depth of field, product photography lighting,
warm neutral color grading, 4K commercial quality.

Por qué funciona: Producto específico + entorno natural + órbita de cámara controlada + lenguaje de iluminación comercial. Parámetros: 16:9 · 10 segundos · 720p · Audio activado


2. Escena de acción anime

Two samurai face each other in a bamboo forest at dawn.
Wind ripples their clothing. Leaves fall slowly between them.
In a sudden burst, both draw swords simultaneously.
Steel clashes with a brilliant spark. The camera whip-pans
between close-ups of their determined eyes and the
impact point. Anime cel-shading style, dramatic speed lines,
saturated color palette, dynamic composition.

Por qué funciona: Preparación clara → golpe de acción → instrucción de cámara + palabras clave de estilo específicas del anime. Parámetros: 16:9 · 8 segundos · 720p · Audio activado


3. Coreografía de escena de pelea

A martial artist in a white gi executes a spinning roundhouse kick
in an industrial warehouse. Dust particles explode from the impact
point. The camera captures the kick in slow motion from a low angle,
then snaps to real-time as the fighter lands and transitions into
a defensive stance. Dramatic side lighting with deep shadows.
Cinematic action film style, sharp focus on the fighter,
motion blur on the kick arc.

Por qué funciona: Movimiento de artes marciales específico + reacción ambiental (polvo) + cambio de velocidad (cámara lenta → tiempo real) + dirección de iluminación fuerte. Parámetros: 16:9 · 10 segundos · 720p · Audio activado


4. Apertura de cortometraje

A lone figure in a worn overcoat walks through an abandoned
train station at twilight. Broken glass crunches under each step.
Pigeons scatter from the rafters. Volumetric light shafts cut
through dusty air from shattered skylights. The camera begins
with a wide establishing shot, then slowly dollies forward,
following the figure deeper into the station.
Desaturated teal-and-amber color grade, anamorphic lens flares,
melancholic atmosphere, film grain.

Por qué funciona: Detalles sensoriales (vidrio crujiendo, palomas, polvo) + clásico dolly forward de apertura + grado de color específico + tono emocional. Parámetros: 21:9 · 8 segundos · 720p · Audio activado


5. Gancho para redes sociales (vertical)

Extreme close-up of latte art being poured into a ceramic mug.
Milk swirls into a perfect rosetta pattern. Steam rises gently.
The camera is locked overhead, shooting straight down.
Warm morning light from the left. Cozy café aesthetic,
soft bokeh background, ASMR-quality detail.
Slow motion, satisfying visual rhythm.

Por qué funciona: Cámara fija cenital = encuadre estable para video vertical + gancho de contenido ASMR/satisfactorio + patrón específico de latte art. Parámetros: 9:16 · 5 segundos · 720p · Audio activado

Prompts de imagen a video

6. Foto de producto → Video promocional

Sube tu foto de producto como imagen de referencia, luego usa este prompt:

The product in @Image1 sits on a clean surface.
The camera slowly orbits 180 degrees around it.
Soft studio lighting highlights surface textures and materials.
A subtle reflection appears on the surface below.
Product photography style, premium aesthetic,
smooth continuous camera movement.

Por qué funciona: @Image1 fija la apariencia del producto + cámara orbital muestra todos los ángulos + lenguaje de iluminación de estudio activa un renderizado profesional. Parámetros: 16:9 · 8 segundos · 720p · Audio desactivado


7. Retrato → Animación de personaje

Sube una foto tipo retrato, luego:

The person in @Image1 turns their head slowly from left to right,
as if noticing something in the distance. A gentle breeze moves
their hair. Natural expression transitions from neutral to
a slight smile. The camera holds a medium close-up, steady.
Soft natural lighting, cinematic skin tones,
shallow depth of field on the background.

Por qué funciona: Movimiento simple y controlado (giro de cabeza) + interacción ambiental natural (brisa) + cámara fija evita distorsión. Parámetros: 16:9 · 5 segundos · 720p · Audio desactivado


8. Paisaje → Paneo cinematográfico

Sube una foto de paisaje, luego:

The landscape in @Image1 comes alive with subtle motion.
Clouds drift slowly across the sky. Grass sways in a gentle wind.
Light shifts as the sun moves behind a cloud.
The camera performs a slow horizontal pan from left to right,
revealing the full scene. Epic cinematic scale,
golden hour warmth, wide-angle lens perspective.

Por qué funciona: Pide movimiento ambiental (nubes, pasto, luz) en vez de movimiento de personajes, lo cual los paisajes manejan bien. Parámetros: 21:9 · 10 segundos · 720p · Audio activado


9. Control de primer y último fotograma

Sube dos imágenes — el modelo automáticamente usa la primera como el fotograma de apertura y la segunda como el fotograma de cierre:

Smooth cinematic transition from @Image1 to @Image2.
The camera slowly pushes forward as the scene transforms.
Lighting transitions naturally between the two environments.
Maintain visual continuity and fluid motion throughout.
Dreamlike quality, gentle pace, soft color blending.

Por qué funciona: Subir dos imágenes activa automáticamente el modo de primer-último fotograma de Seedance 2.0. El prompt guía el estilo de la transición. Parámetros: 16:9 · 6 segundos · 720p · Audio activado


10. Personaje consistente entre tomas

Sube tu imagen de referencia del personaje, luego usa este prompt para cada generación en tu proyecto:

Character from @Image1 walks down a busy city street at night.
Maintain facial features and wardrobe fully consistent with @Image1:
short black hair, blue denim jacket, white sneakers.
Natural walking pace, confident posture.
The camera tracks from a side angle at waist height.
Urban night atmosphere, neon reflections on wet pavement.

Por qué funciona: Doble ancla — referencia visual de @Image1 + descripción textual explícita de rasgos clave. Esta redundancia es esencial para la consistencia entre múltiples generaciones. Parámetros: 16:9 · 8 segundos · 720p · Audio activado

Prompts de referencia a video (exclusivos de Seedance 2.0)

Estas plantillas usan la capacidad multimodal completa que solo Seedance 2.0 ofrece.

11. Mezcla multimodal — Imagen + Video + Audio

Sube: foto de personaje + clip de video de referencia + pista de música de fondo.

Use the first-person perspective framing of @Video1 throughout.
Use @Audio1 as background music throughout, beat-synced editing.
Character from @Image1 walks through a neon-lit street market.
Camera follows the character from behind, matching the movement
style in @Video1. The character pauses to examine a food stall,
turns to the camera, and smiles. Cinematic night photography,
rich saturated colors, shallow depth of field.

Por qué funciona: Cada referencia @ tiene un rol claramente definido — @Video1 para la cámara, @Audio1 para el ritmo, @Image1 para el personaje. Parámetros: 16:9 · 10 segundos · 720p · Audio activado


12. Edición de video — Reemplazar elementos

Sube: video original + imagen del producto de reemplazo.

Replace the object being held in @Video1 with the product
shown in @Image1. Keep the original camera movement,
lighting, and hand gestures unchanged.
Maintain natural interaction between the hand and the new product.
Seamless integration, matching color temperature and shadows.

Por qué funciona: Le dice al modelo exactamente qué preservar (cámara, iluminación, gestos) y qué reemplazar (el objeto). Parámetros: Coincidir con la relación de aspecto del video original · Coincidir con la duración original · 720p · Audio activado


13. Extensión de video — Continuación multisegmento

Sube: 2–3 segmentos de video que quieras conectar.

Continue the narrative from @Video1 into @Video2.
Maintain consistent character appearance, lighting direction,
and color grade across the transition. The camera movement
flows naturally between segments without jump cuts.
Smooth temporal blending at transition points.
Cinematic continuity, professional editing feel.

Por qué funciona: Las instrucciones explícitas de continuidad previenen los cambios bruscos de estilo que ocurren al unir clips. Parámetros: Coincidir con la relación de aspecto original · 8 segundos · 720p · Audio activado


14. Video musical — Generación dirigida por audio

Sube: foto de personaje + pista musical.

Character from @Image1 performs to the rhythm of @Audio1.
Movement intensity follows the music dynamics: subtle sway during
quiet sections, energetic motion during the chorus.
Camera cuts sync to beat drops. Lighting pulses with the rhythm.
Music video aesthetic, high contrast, dramatic color grading,
concert-style spotlights.

Por qué funciona: Vincula comportamientos visuales específicos (movimiento, cortes, iluminación) con eventos de audio específicos (beats, coro, secciones suaves). Parámetros: 9:16 · 15 segundos · 720p · Audio activado


15. Busto parlante — Diálogo con sincronización labial

Sube: foto de personaje + grabación de audio del diálogo.

Character from @Image1 speaks the dialogue from @Audio1.
Precise lip-sync matching the audio. Natural head micro-movements:
slight nods when emphasizing points, occasional blink,
subtle eyebrow raises. Professional presenter framing,
medium close-up, clean background.
Three-point studio lighting, warm skin tones, sharp focus on face.

Por qué funciona: Las instrucciones específicas de micro-movimientos (asentimientos, parpadeos, cejas levantadas) previenen el problema de "cara congelada" en videos de busto parlante. Parámetros: 16:9 · Coincidir con la duración del audio · 720p · Audio activado

Guía rápida de lenguaje cinematográfico

No necesitas ser cineasta. Solo elige un término de cámara de esta tabla y agrégalo a tu prompt. Mejora instantánea.

TérminoQué haceCuándo usarlo
Dolly inLa cámara avanza hacia el sujetoPara aumentar la intensidad emocional
Dolly outLa cámara se aleja del sujetoPara revelar contexto o entorno
Tracking shotLa cámara sigue al sujeto lateralmenteSecuencias de acción, escenas de caminata
Crane downLa cámara desciende verticalmenteGrandes tomas de establecimiento
HandheldLigero temblor naturalSensación documental, urgencia
360° orbitLa cámara gira alrededor del sujetoRevelaciones de personajes, tomas de productos
Whip panGiro horizontal ultra-rápido de cámaraTransiciones entre sujetos
Rack focusEl enfoque cambia del primer plano al fondoPara dirigir la atención entre elementos
Dutch angleLa cámara inclinada sobre su ejeTensión, incomodidad, tomas estilizadas
POVLa cámara representa los ojos del personajePerspectiva inmersiva en primera persona

Mantener la consistencia de personajes

La consistencia de personajes es la parte más difícil del video con IA. Aquí está el sistema que funciona:

  1. Siempre usa el mismo @Image1 en cada prompt de tu proyecto. Este es tu ancla visual.
  2. Repite los rasgos físicos clave en texto incluso cuando tengas una imagen de referencia. Escribe "short silver hair, scar on right cheek, black leather jacket" cada vez. El modelo necesita ambas anclas: visual y textual.
  3. Mantén el diseño del personaje simple. Menos accesorios y atuendos más sencillos producen resultados más estables entre generaciones.
  4. Usa un retrato limpio de medio cuerpo como tu imagen de referencia. Los fondos recargados o los ángulos extremos confunden el sistema de ancla visual.

Errores comunes en prompts y cómo corregirlos

ErrorMal ejemploCorrección
Demasiado vago"a nice video of nature"Agrega especificidad: "red fox crossing a frozen river at dawn, wide shot"
Instrucciones contradictorias"fast-paced slow motion"Elige uno: "slow motion" o "fast-paced editing"
Prompt demasiado largo300+ palabrasReduce a 120–200 palabras — pon lo importante primero
Sin dirección de cámaraCompletamente ausenteAgrega al menos uno: "tracking shot" o "static medium shot"
Encuadre negativo"no blur, no artifacts"Reescribe como: "sharp focus, clean output, crisp details"
Sobrecarga de referencias12 archivos subidos a la vezEmpieza con 2–3 archivos. Agrega más solo si es necesario

Preguntas frecuentes

¿Cuál es la longitud ideal de prompt para Seedance 2.0? 150 palabras es el punto ideal al que siempre vuelvo. Con menos de 50, el modelo adivina demasiado. Con más de 300, empieza a ignorar la segunda mitad. Pon los elementos más importantes primero — sujeto y acción al inicio, estilo y cámara después.

¿Puedo usar prompts en chino en Seedance 2.0? Sí, y a veces producen resultados más fuertes para estado de ánimo y atmósfera. Yo mezclo ambos — inglés para las descripciones de sujeto y acción, chino para palabras clave de estilo cuando busco una estética específica. Ambos idiomas funcionan de forma nativa.

¿Cómo mantengo la consistencia de personajes entre múltiples videos? Siempre usa la misma referencia @Image1. Luego repite los rasgos clave en texto cada vez: "short silver hair, mole under left eye, blue jacket." El modelo necesita ambas anclas: visual y textual. Los diseños de personajes simples son más estables que los complejos.

¿Cuál es la diferencia entre hacer prompts para Seedance 2.0 y Sora 2? Diferentes herramientas responden a diferentes estilos de prompts. Sora 2 lee palabras de atmósfera y emoción de forma más efectiva. Seedance 2.0 responde mejor a descripciones de acción específicas e instrucciones de referencia @. Escribí una guía separada de prompts para Sora 2 por si quieres comparar enfoques.

¿Cuánto tarda la generación? Un clip de 5 segundos a 720p normalmente tarda de 30 a 60 segundos. Un clip de 15 segundos con audio activado puede tardar de 90 a 120 segundos. Una resolución más baja (480p) genera más rápido si estás iterando sobre el lenguaje del prompt.

¿Puedo usar los videos de Seedance 2.0 comercialmente? Las licencias varían según la plataforma. En SoraVideo.art, el contenido generado es tuyo para uso comercial. Revisa los términos específicos de cada plataforma antes de publicar contenido comercial.

¿Seedance 2.0 soporta prompts negativos? No como un campo separado como los generadores de imágenes. En su lugar, usa encuadre positivo: "sharp focus" en vez de "no blur," "stable composition" en vez de "no shaking." El modelo sigue instrucciones afirmativas de forma más confiable.

Conclusión

Seedance 2.0 es el generador de video con IA más capaz que he usado en 2026 — pero solo si sabes cómo hablarle. La estructura de prompt de tres capas, el sistema de referencias @, y las 15 plantillas de arriba son todo lo que uso a diario.

Empieza con una plantilla. Genera. Revisa. Cambia una cosa. Genera otra vez. Estarás produciendo clips cinematográficos dentro de tu primera sesión.

¿Nuevo en Seedance 2.0? Lee la guía de acceso para configurar todo, luego vuelve aquí para los prompts. ¿Quieres entender los costos antes de escalar? Consulta el desglose de precios de Seedance 2.0. ¿Tienes curiosidad sobre todas las funciones? La guía completa de Seedance 2.0 cubre todo lo que hay bajo el capó.

Empieza a crear con Seedance 2.0

Accede a Seedance 2.0, Sora 2 Storyboard, Kling Motion Control, y más en SoraVideo.art — todas tus herramientas de video con IA en un solo lugar. Ver planes.

Boletín

Únete a la comunidad

Suscríbete a nuestro boletín para las últimas noticias y actualizaciones