- Blog
- Cómo usar Seedance 2.0: Tutorial paso a paso para principiantes (2026)

Cómo usar Seedance 2.0: Tutorial paso a paso para principiantes (2026)
Probé más de 300 prompts de Seedance 2.0 para que tú no tengas que hacerlo. Tutorial completo con 15 plantillas de prompts listas para copiar, guía del sistema de referencias @, y técnicas cinematográficas.
Pasé mi primera semana con Seedance 2.0 quemando créditos en rostros deformados, caminatas rígidas y escenas que parecían una presentación de diapositivas barata. El modelo claramente era potente, pero mis prompts eran el problema. Después de más de 300 generaciones, descubrí lo que realmente funciona: una estructura de prompt de tres capas, el sistema de referencias @ que la mayoría de los tutoriales se saltan, y un puñado de plantillas que producen resultados cinematográficos al primer intento. Este es el tutorial que me hubiera gustado tener el primer día.
Qué es Seedance 2.0 — Resumen en 30 segundos
Seedance 2.0 es el generador de video con IA más reciente de ByteDance, lanzado en febrero de 2026. Si ya usaste Seedance 1.5, estas son las tres mejoras que importan:
- Entrada multimodal: Aliméntalo con texto + hasta 9 imágenes + 3 videos + 3 archivos de audio simultáneamente
- Audio nativo: Efectos de sonido, música y diálogos con sincronización labial multilingüe integrados en el proceso de generación
- Duración de 15 segundos: Un aumento respecto al límite anterior, con narrativa de múltiples tomas en una sola generación
| Especificación | Detalles |
|---|---|
| Resolución | 480p, 720p, 1080p (Estándar); 480p, 720p (Fast) |
| Duración | 4–15 segundos |
| Relaciones de aspecto | 16:9, 9:16, 1:1, 4:3, 3:4, 21:9 |
| Tipos de entrada | Texto, imágenes, clips de video, pistas de audio |
| Audio | Sincronización nativa — efectos de sonido, música, diálogos |
Para un análisis detallado de las funciones y cómo Seedance 2.0 se compara con Kling y Sora 2, lee la Guía completa de Seedance 2.0.
Cómo acceder a Seedance 2.0
No necesitas un número de teléfono chino ni VPN. La forma más rápida es usar la herramienta de Seedance 2.0 en SoraVideo.art directamente en tu navegador — texto a video, imagen a video y referencia a video, todo en un solo lugar.
Empieza a generar en 60 segundos
Ve a SoraVideo.art → Seedance 2.0 y comienza con texto a video. No necesitas una cuenta separada de ByteDance. Los usuarios nuevos pueden obtener un paquete inicial de $4.99 — suficientes créditos para probar cada plantilla de esta guía. Si encaja con tu flujo de trabajo, actualiza a un plan mensual después. Para otras opciones de acceso incluyendo Dreamina y BytePlus API, consulta la guía de acceso completa.
Tu primer video en 5 minutos
La mayoría de los tutoriales solo muestran texto a video. Eso es como aprender a manejar solo en primera velocidad. Seedance 2.0 tiene tres modos de generación — elige el que corresponda a lo que tengas disponible:
- Texto a video → Tienes una idea en tu cabeza pero no tienes recursos visuales
- Imagen a video → Tienes una foto y quieres darle vida
- Referencia a video → Tienes imágenes + clips de video + audio y quieres mezclarlos todos
Aquí tienes el paso a paso para tu primera generación:
Comienza con Texto a video para tu primer intento. Configura estos parámetros amigables para principiantes:
| Parámetro | Recomendado | Por qué |
|---|---|---|
| Duración | 5 segundos | Iteración rápida, menor costo de créditos |
| Resolución | 720p | Mejor balance calidad-velocidad |
| Relación de aspecto | 16:9 | Formato universal |
| Audio | Activado | La fortaleza única de Seedance — no la desperdicies |
Copia este prompt inicial y pégalo directamente:
A golden retriever runs through a sunlit meadow toward the camera.
Slow motion. Cinematic golden hour lighting. Shallow depth of field.
Camera tracks the dog at eye level, slight handheld movement.
Warm color grading, film grain texture.Por qué funciona:
- El sujeto es específico: "golden retriever" en vez de "a dog"
- La acción es clara: "runs through a meadow toward the camera"
- La cámara tiene dirección: "tracks at eye level, handheld movement"
- El estilo está definido: "golden hour, shallow DOF, film grain"
Haz clic en Generar y espera de 30 a 60 segundos. Cuando aparezca el resultado, hazte tres preguntas:
- ¿El sujeto está bien? Si el perro se ve raro, sé más específico con la raza, el color y el tamaño.
- ¿El movimiento está bien? Si el movimiento se siente rígido, agrega palabras como "natural gait" o "energetic sprint."
- ¿La cámara está bien? Si el encuadre no está bien, especifica la distancia — "medium shot" o "close-up."
Cambia una sola variable a la vez. No reescribas todo el prompt — eso reinicia la interpretación del modelo y desperdicia créditos.
Tu primer video no será perfecto. Eso está bien. La iteración es la habilidad, no la suerte.
La estructura de prompt de tres capas
Después de probar cientos de prompts, siempre vuelvo a la misma estructura. Cada prompt efectivo de Seedance 2.0 tiene tres capas:
| Capa | Qué escribir | Ejemplo |
|---|---|---|
| Escena | Ubicación, hora, clima, atmósfera | rain-soaked neon alley at midnight, steam rising from grates |
| Sujeto | Personaje, acción, expresión, vestuario | woman in black trench coat, walking fast, tense expression |
| Cámara y estilo | Lente, movimiento, grado de color, tipo de película | tracking shot from behind, film noir palette, 35mm grain |
Reglas que aprendí a las malas
El modelo lee de izquierda a derecha. Lo que escribes primero tiene más peso. Si tu sujeto sigue siendo opacado por el fondo, mueve la descripción del sujeto al principio de tu prompt.
150 palabras es el punto ideal. Con menos de 50, el modelo llena los espacios al azar. Con más de 300, empieza a ignorar la segunda mitad. Lo probé extensamente — entre 120 y 200 palabras consistentemente da los mejores resultados.
Usa descripciones positivas, nunca negativas. Escribe "sharp focus, clean details" en vez de "no blur, no artifacts." El modelo interpreta instrucciones positivas de forma mucho más confiable.
Mezcla inglés y chino cuando ayude. Las descripciones de acción funcionan mejor en inglés. Las palabras clave de estado de ánimo y atmósfera a veces producen resultados más fuertes en chino. Mi enfoque personal: inglés para el prompt principal, chino para palabras clave de estilo cuando busco una estética específica.
El sistema de referencias @ — Lo que la mayoría de tutoriales se saltan
Esta es la función que separa a Seedance 2.0 de cualquier otro generador de video con IA. La mayoría de tutoriales lo mencionan en una sola oración. Eso es un error — es la herramienta individual más poderosa para obtener resultados consistentes y controlables.
Qué puedes subir
| Tipo | Límite | Qué controla |
|---|---|---|
| Imágenes | 0–9 | Apariencia del personaje, entorno, estilo |
| Videos | 0–3 (total ≤ 15 segundos) | Movimiento de cámara, estilo de movimiento, ritmo |
| Audio | 0–3 (total ≤ 15 segundos) | Ritmo musical, sincronización labial de diálogos, sonido ambiental |
Cómo funciona el sistema de prioridades
El modelo pondera las referencias en este orden:
- @Audio = Ancla rítmica — controla el timing del lip-sync y la edición sincronizada al ritmo
- @Video = Ancla de movimiento — copia las trayectorias de cámara y la coreografía de acción
- @Image = Ancla visual — fija el rostro del personaje, el vestuario y el estilo del entorno
Ejemplo completo de prompt
Character from @Image1 walks through the landscape in @Image2.
Camera follows from @Video1 perspective, smooth tracking movement.
Background music synced to @Audio1, beat-matched cuts.
Cinematic warm lighting, shallow depth of field, 35mm film texture.Consejos prácticos
- Empieza con 2–3 archivos, no con 12. Más referencias significa más señales en conflicto. Agrega complejidad de forma gradual.
- Para imágenes de personajes, usa un retrato de medio cuerpo con fondo limpio. Los fondos recargados confunden el ancla visual.
- Siempre especifica qué controla cada referencia en tu prompt. No solo subas archivos y esperes lo mejor — dile al modelo explícitamente: "face from @Image1" o "camera movement from @Video1."
15 plantillas de prompts que puedes copiar ahora mismo
Cada plantilla a continuación está lista para pegar. Incluyo el prompt, por qué funciona y los parámetros recomendados.
Prompts de texto a video
1. Comercial de producto
A sleek espresso machine sits on a marble kitchen counter.
Steam rises from a freshly pulled shot. Morning sunlight streams
through a window, casting warm highlights on brushed steel.
The camera performs a slow 180-degree orbit around the machine.
Shallow depth of field, product photography lighting,
warm neutral color grading, 4K commercial quality.Por qué funciona: Producto específico + entorno natural + órbita de cámara controlada + lenguaje de iluminación comercial. Parámetros: 16:9 · 10 segundos · 720p · Audio activado
2. Escena de acción anime
Two samurai face each other in a bamboo forest at dawn.
Wind ripples their clothing. Leaves fall slowly between them.
In a sudden burst, both draw swords simultaneously.
Steel clashes with a brilliant spark. The camera whip-pans
between close-ups of their determined eyes and the
impact point. Anime cel-shading style, dramatic speed lines,
saturated color palette, dynamic composition.Por qué funciona: Preparación clara → golpe de acción → instrucción de cámara + palabras clave de estilo específicas del anime. Parámetros: 16:9 · 8 segundos · 720p · Audio activado
3. Coreografía de escena de pelea
A martial artist in a white gi executes a spinning roundhouse kick
in an industrial warehouse. Dust particles explode from the impact
point. The camera captures the kick in slow motion from a low angle,
then snaps to real-time as the fighter lands and transitions into
a defensive stance. Dramatic side lighting with deep shadows.
Cinematic action film style, sharp focus on the fighter,
motion blur on the kick arc.Por qué funciona: Movimiento de artes marciales específico + reacción ambiental (polvo) + cambio de velocidad (cámara lenta → tiempo real) + dirección de iluminación fuerte. Parámetros: 16:9 · 10 segundos · 720p · Audio activado
4. Apertura de cortometraje
A lone figure in a worn overcoat walks through an abandoned
train station at twilight. Broken glass crunches under each step.
Pigeons scatter from the rafters. Volumetric light shafts cut
through dusty air from shattered skylights. The camera begins
with a wide establishing shot, then slowly dollies forward,
following the figure deeper into the station.
Desaturated teal-and-amber color grade, anamorphic lens flares,
melancholic atmosphere, film grain.Por qué funciona: Detalles sensoriales (vidrio crujiendo, palomas, polvo) + clásico dolly forward de apertura + grado de color específico + tono emocional. Parámetros: 21:9 · 8 segundos · 720p · Audio activado
5. Gancho para redes sociales (vertical)
Extreme close-up of latte art being poured into a ceramic mug.
Milk swirls into a perfect rosetta pattern. Steam rises gently.
The camera is locked overhead, shooting straight down.
Warm morning light from the left. Cozy café aesthetic,
soft bokeh background, ASMR-quality detail.
Slow motion, satisfying visual rhythm.Por qué funciona: Cámara fija cenital = encuadre estable para video vertical + gancho de contenido ASMR/satisfactorio + patrón específico de latte art. Parámetros: 9:16 · 5 segundos · 720p · Audio activado
Prompts de imagen a video
6. Foto de producto → Video promocional
Sube tu foto de producto como imagen de referencia, luego usa este prompt:
The product in @Image1 sits on a clean surface.
The camera slowly orbits 180 degrees around it.
Soft studio lighting highlights surface textures and materials.
A subtle reflection appears on the surface below.
Product photography style, premium aesthetic,
smooth continuous camera movement.Por qué funciona: @Image1 fija la apariencia del producto + cámara orbital muestra todos los ángulos + lenguaje de iluminación de estudio activa un renderizado profesional. Parámetros: 16:9 · 8 segundos · 720p · Audio desactivado
7. Retrato → Animación de personaje
Sube una foto tipo retrato, luego:
The person in @Image1 turns their head slowly from left to right,
as if noticing something in the distance. A gentle breeze moves
their hair. Natural expression transitions from neutral to
a slight smile. The camera holds a medium close-up, steady.
Soft natural lighting, cinematic skin tones,
shallow depth of field on the background.Por qué funciona: Movimiento simple y controlado (giro de cabeza) + interacción ambiental natural (brisa) + cámara fija evita distorsión. Parámetros: 16:9 · 5 segundos · 720p · Audio desactivado
8. Paisaje → Paneo cinematográfico
Sube una foto de paisaje, luego:
The landscape in @Image1 comes alive with subtle motion.
Clouds drift slowly across the sky. Grass sways in a gentle wind.
Light shifts as the sun moves behind a cloud.
The camera performs a slow horizontal pan from left to right,
revealing the full scene. Epic cinematic scale,
golden hour warmth, wide-angle lens perspective.Por qué funciona: Pide movimiento ambiental (nubes, pasto, luz) en vez de movimiento de personajes, lo cual los paisajes manejan bien. Parámetros: 21:9 · 10 segundos · 720p · Audio activado
9. Control de primer y último fotograma
Sube dos imágenes — el modelo automáticamente usa la primera como el fotograma de apertura y la segunda como el fotograma de cierre:
Smooth cinematic transition from @Image1 to @Image2.
The camera slowly pushes forward as the scene transforms.
Lighting transitions naturally between the two environments.
Maintain visual continuity and fluid motion throughout.
Dreamlike quality, gentle pace, soft color blending.Por qué funciona: Subir dos imágenes activa automáticamente el modo de primer-último fotograma de Seedance 2.0. El prompt guía el estilo de la transición. Parámetros: 16:9 · 6 segundos · 720p · Audio activado
10. Personaje consistente entre tomas
Sube tu imagen de referencia del personaje, luego usa este prompt para cada generación en tu proyecto:
Character from @Image1 walks down a busy city street at night.
Maintain facial features and wardrobe fully consistent with @Image1:
short black hair, blue denim jacket, white sneakers.
Natural walking pace, confident posture.
The camera tracks from a side angle at waist height.
Urban night atmosphere, neon reflections on wet pavement.Por qué funciona: Doble ancla — referencia visual de @Image1 + descripción textual explícita de rasgos clave. Esta redundancia es esencial para la consistencia entre múltiples generaciones. Parámetros: 16:9 · 8 segundos · 720p · Audio activado
Prompts de referencia a video (exclusivos de Seedance 2.0)
Estas plantillas usan la capacidad multimodal completa que solo Seedance 2.0 ofrece.
11. Mezcla multimodal — Imagen + Video + Audio
Sube: foto de personaje + clip de video de referencia + pista de música de fondo.
Use the first-person perspective framing of @Video1 throughout.
Use @Audio1 as background music throughout, beat-synced editing.
Character from @Image1 walks through a neon-lit street market.
Camera follows the character from behind, matching the movement
style in @Video1. The character pauses to examine a food stall,
turns to the camera, and smiles. Cinematic night photography,
rich saturated colors, shallow depth of field.Por qué funciona: Cada referencia @ tiene un rol claramente definido — @Video1 para la cámara, @Audio1 para el ritmo, @Image1 para el personaje. Parámetros: 16:9 · 10 segundos · 720p · Audio activado
12. Edición de video — Reemplazar elementos
Sube: video original + imagen del producto de reemplazo.
Replace the object being held in @Video1 with the product
shown in @Image1. Keep the original camera movement,
lighting, and hand gestures unchanged.
Maintain natural interaction between the hand and the new product.
Seamless integration, matching color temperature and shadows.Por qué funciona: Le dice al modelo exactamente qué preservar (cámara, iluminación, gestos) y qué reemplazar (el objeto). Parámetros: Coincidir con la relación de aspecto del video original · Coincidir con la duración original · 720p · Audio activado
13. Extensión de video — Continuación multisegmento
Sube: 2–3 segmentos de video que quieras conectar.
Continue the narrative from @Video1 into @Video2.
Maintain consistent character appearance, lighting direction,
and color grade across the transition. The camera movement
flows naturally between segments without jump cuts.
Smooth temporal blending at transition points.
Cinematic continuity, professional editing feel.Por qué funciona: Las instrucciones explícitas de continuidad previenen los cambios bruscos de estilo que ocurren al unir clips. Parámetros: Coincidir con la relación de aspecto original · 8 segundos · 720p · Audio activado
14. Video musical — Generación dirigida por audio
Sube: foto de personaje + pista musical.
Character from @Image1 performs to the rhythm of @Audio1.
Movement intensity follows the music dynamics: subtle sway during
quiet sections, energetic motion during the chorus.
Camera cuts sync to beat drops. Lighting pulses with the rhythm.
Music video aesthetic, high contrast, dramatic color grading,
concert-style spotlights.Por qué funciona: Vincula comportamientos visuales específicos (movimiento, cortes, iluminación) con eventos de audio específicos (beats, coro, secciones suaves). Parámetros: 9:16 · 15 segundos · 720p · Audio activado
15. Busto parlante — Diálogo con sincronización labial
Sube: foto de personaje + grabación de audio del diálogo.
Character from @Image1 speaks the dialogue from @Audio1.
Precise lip-sync matching the audio. Natural head micro-movements:
slight nods when emphasizing points, occasional blink,
subtle eyebrow raises. Professional presenter framing,
medium close-up, clean background.
Three-point studio lighting, warm skin tones, sharp focus on face.Por qué funciona: Las instrucciones específicas de micro-movimientos (asentimientos, parpadeos, cejas levantadas) previenen el problema de "cara congelada" en videos de busto parlante. Parámetros: 16:9 · Coincidir con la duración del audio · 720p · Audio activado
Guía rápida de lenguaje cinematográfico
No necesitas ser cineasta. Solo elige un término de cámara de esta tabla y agrégalo a tu prompt. Mejora instantánea.
| Término | Qué hace | Cuándo usarlo |
|---|---|---|
| Dolly in | La cámara avanza hacia el sujeto | Para aumentar la intensidad emocional |
| Dolly out | La cámara se aleja del sujeto | Para revelar contexto o entorno |
| Tracking shot | La cámara sigue al sujeto lateralmente | Secuencias de acción, escenas de caminata |
| Crane down | La cámara desciende verticalmente | Grandes tomas de establecimiento |
| Handheld | Ligero temblor natural | Sensación documental, urgencia |
| 360° orbit | La cámara gira alrededor del sujeto | Revelaciones de personajes, tomas de productos |
| Whip pan | Giro horizontal ultra-rápido de cámara | Transiciones entre sujetos |
| Rack focus | El enfoque cambia del primer plano al fondo | Para dirigir la atención entre elementos |
| Dutch angle | La cámara inclinada sobre su eje | Tensión, incomodidad, tomas estilizadas |
| POV | La cámara representa los ojos del personaje | Perspectiva inmersiva en primera persona |
Mantener la consistencia de personajes
La consistencia de personajes es la parte más difícil del video con IA. Aquí está el sistema que funciona:
- Siempre usa el mismo @Image1 en cada prompt de tu proyecto. Este es tu ancla visual.
- Repite los rasgos físicos clave en texto incluso cuando tengas una imagen de referencia. Escribe "short silver hair, scar on right cheek, black leather jacket" cada vez. El modelo necesita ambas anclas: visual y textual.
- Mantén el diseño del personaje simple. Menos accesorios y atuendos más sencillos producen resultados más estables entre generaciones.
- Usa un retrato limpio de medio cuerpo como tu imagen de referencia. Los fondos recargados o los ángulos extremos confunden el sistema de ancla visual.
Errores comunes en prompts y cómo corregirlos
| Error | Mal ejemplo | Corrección |
|---|---|---|
| Demasiado vago | "a nice video of nature" | Agrega especificidad: "red fox crossing a frozen river at dawn, wide shot" |
| Instrucciones contradictorias | "fast-paced slow motion" | Elige uno: "slow motion" o "fast-paced editing" |
| Prompt demasiado largo | 300+ palabras | Reduce a 120–200 palabras — pon lo importante primero |
| Sin dirección de cámara | Completamente ausente | Agrega al menos uno: "tracking shot" o "static medium shot" |
| Encuadre negativo | "no blur, no artifacts" | Reescribe como: "sharp focus, clean output, crisp details" |
| Sobrecarga de referencias | 12 archivos subidos a la vez | Empieza con 2–3 archivos. Agrega más solo si es necesario |
Preguntas frecuentes
¿Cuál es la longitud ideal de prompt para Seedance 2.0? 150 palabras es el punto ideal al que siempre vuelvo. Con menos de 50, el modelo adivina demasiado. Con más de 300, empieza a ignorar la segunda mitad. Pon los elementos más importantes primero — sujeto y acción al inicio, estilo y cámara después.
¿Puedo usar prompts en chino en Seedance 2.0? Sí, y a veces producen resultados más fuertes para estado de ánimo y atmósfera. Yo mezclo ambos — inglés para las descripciones de sujeto y acción, chino para palabras clave de estilo cuando busco una estética específica. Ambos idiomas funcionan de forma nativa.
¿Cómo mantengo la consistencia de personajes entre múltiples videos? Siempre usa la misma referencia @Image1. Luego repite los rasgos clave en texto cada vez: "short silver hair, mole under left eye, blue jacket." El modelo necesita ambas anclas: visual y textual. Los diseños de personajes simples son más estables que los complejos.
¿Cuál es la diferencia entre hacer prompts para Seedance 2.0 y Sora 2? Diferentes herramientas responden a diferentes estilos de prompts. Sora 2 lee palabras de atmósfera y emoción de forma más efectiva. Seedance 2.0 responde mejor a descripciones de acción específicas e instrucciones de referencia @. Escribí una guía separada de prompts para Sora 2 por si quieres comparar enfoques.
¿Cuánto tarda la generación? Un clip de 5 segundos a 720p normalmente tarda de 30 a 60 segundos. Un clip de 15 segundos con audio activado puede tardar de 90 a 120 segundos. Una resolución más baja (480p) genera más rápido si estás iterando sobre el lenguaje del prompt.
¿Puedo usar los videos de Seedance 2.0 comercialmente? Las licencias varían según la plataforma. En SoraVideo.art, el contenido generado es tuyo para uso comercial. Revisa los términos específicos de cada plataforma antes de publicar contenido comercial.
¿Seedance 2.0 soporta prompts negativos? No como un campo separado como los generadores de imágenes. En su lugar, usa encuadre positivo: "sharp focus" en vez de "no blur," "stable composition" en vez de "no shaking." El modelo sigue instrucciones afirmativas de forma más confiable.
Conclusión
Seedance 2.0 es el generador de video con IA más capaz que he usado en 2026 — pero solo si sabes cómo hablarle. La estructura de prompt de tres capas, el sistema de referencias @, y las 15 plantillas de arriba son todo lo que uso a diario.
Empieza con una plantilla. Genera. Revisa. Cambia una cosa. Genera otra vez. Estarás produciendo clips cinematográficos dentro de tu primera sesión.
¿Nuevo en Seedance 2.0? Lee la guía de acceso para configurar todo, luego vuelve aquí para los prompts. ¿Quieres entender los costos antes de escalar? Consulta el desglose de precios de Seedance 2.0. ¿Tienes curiosidad sobre todas las funciones? La guía completa de Seedance 2.0 cubre todo lo que hay bajo el capó.
Empieza a crear con Seedance 2.0
Accede a Seedance 2.0, Sora 2 Storyboard, Kling Motion Control, y más en SoraVideo.art — todas tus herramientas de video con IA en un solo lugar. Ver planes.
Autor

Categorías
Más publicaciones

Cómo usar Kling 3.0: Motion Control, Multi-Shot y guía de prompts
Guía paso a paso para usar el generador de video con IA Kling 3.0. Domina el motion control, escribe prompts efectivos, crea secuencias multi-shot y logra consistencia de personajes.


Genie 3: Modelo mundial de IA de Google DeepMind - Cómo usarlo
Genie 3 es el modelo mundial de IA en tiempo real de Google DeepMind que crea mundos 3D interactivos. Aprende cómo usar Genie 3, prueba la demo de Project Genie y explora todas sus funciones.


Manual de prompts de Sora 2: Escribiendo tomas que realmente se renderizan
Una guía de campo para crear prompts de texto que produzcan video cinematográfico de Sora 2 al primer intento.

Boletín
Únete a la comunidad
Suscríbete a nuestro boletín para las últimas noticias y actualizaciones