Como usar o Seedance 2.0: Tutorial passo a passo para iniciantes (2026)
2026/04/07

Como usar o Seedance 2.0: Tutorial passo a passo para iniciantes (2026)

Testei mais de 300 prompts do Seedance 2.0 para que você não precise. Tutorial completo com 15 modelos de prompts prontos para copiar, guia do sistema de referências @, e técnicas cinematográficas.

Passei minha primeira semana com o Seedance 2.0 desperdiçando créditos com rostos deformados, caminhadas travadas e cenas que pareciam uma apresentação de slides barata. O modelo claramente era poderoso — mas meus prompts eram o problema. Depois de mais de 300 gerações, descobri o que realmente funciona: uma estrutura de prompt em três camadas, o sistema de referências @ que a maioria dos tutoriais ignora, e um punhado de modelos que produzem resultados cinematográficos de primeira. Este é o tutorial que eu gostaria de ter tido no primeiro dia.

O que é o Seedance 2.0 — Visão Geral em 30 Segundos

O Seedance 2.0 é o mais recente gerador de vídeo por IA da ByteDance, lançado em fevereiro de 2026. Se você já usou o Seedance 1.5, aqui estão as três melhorias que importam:

  • Entrada multimodal: Alimente com texto + até 9 imagens + 3 vídeos + 3 arquivos de áudio simultaneamente
  • Áudio nativo: Efeitos sonoros, música e diálogo com lip-sync multilíngue integrados ao pipeline de geração
  • Duração de 15 segundos: Aumento em relação ao limite anterior, com narrativa multi-cena em uma única geração
EspecificaçãoDetalhes
Resolução480p, 720p, 1080p (Padrão); 480p, 720p (Fast)
Duração4–15 segundos
Proporções de tela16:9, 9:16, 1:1, 4:3, 3:4, 21:9
Tipos de entradaTexto, imagens, clipes de vídeo, faixas de áudio
ÁudioSincronização nativa — efeitos sonoros, música, diálogo

Para um mergulho profundo nos recursos e como o Seedance 2.0 se compara ao Kling e ao Sora 2, leia o Guia Completo do Seedance 2.0.

Como Acessar o Seedance 2.0

Você não precisa de um número de telefone chinês ou VPN. O caminho mais rápido é usar a ferramenta Seedance 2.0 do SoraVideo.art diretamente no seu navegador — texto-para-vídeo, imagem-para-vídeo e referência-para-vídeo, tudo em um só lugar.

Comece a gerar em 60 segundos

Acesse SoraVideo.art → Seedance 2.0 e comece com texto-para-vídeo. Não é necessário uma conta separada da ByteDance. Novos usuários podem aproveitar um pacote inicial de $4.99 — créditos suficientes para testar todos os modelos deste guia. Se encaixar no seu fluxo de trabalho, faça upgrade para um plano mensal depois. Para outras opções de acesso, incluindo Dreamina e API BytePlus, veja o guia de acesso completo.

Seu Primeiro Vídeo em 5 Minutos

A maioria dos tutoriais só mostra texto-para-vídeo. Isso é como aprender a dirigir só na primeira marcha. O Seedance 2.0 tem três modos de geração — escolha o que combina com o que você tem:

  • Texto-para-Vídeo → Você tem uma ideia na cabeça, mas nenhum material
  • Imagem-para-Vídeo → Você tem uma foto e quer que ela ganhe vida
  • Referência-para-Vídeo → Você tem imagens + clipes de vídeo + áudio e quer misturar tudo

Aqui está o passo a passo para a sua primeira geração:

Comece com Texto-para-Vídeo na sua primeira tentativa. Defina estes parâmetros amigáveis para iniciantes:

ParâmetroRecomendadoPor quê
Duração5 segundosIteração rápida, menor custo de créditos
Resolução720pMelhor equilíbrio entre qualidade e velocidade
Proporção de tela16:9Formato universal
ÁudioLigadoPonto forte exclusivo do Seedance — não desperdice

Copie este prompt inicial e cole diretamente:

A golden retriever runs through a sunlit meadow toward the camera.
Slow motion. Cinematic golden hour lighting. Shallow depth of field.
Camera tracks the dog at eye level, slight handheld movement.
Warm color grading, film grain texture.

Por que funciona:

  • O sujeito é específico: "golden retriever" e não "a dog"
  • A ação é clara: "runs through a meadow toward the camera"
  • A câmera tem direção: "tracks at eye level, handheld movement"
  • O estilo é definido: "golden hour, shallow DOF, film grain"

Clique em Gerar e aguarde 30–60 segundos. Quando o resultado aparecer, faça três perguntas:

  1. O sujeito está correto? Se o cachorro parecer errado, seja mais específico sobre raça, cor e tamanho.
  2. O movimento está correto? Se o movimento parecer travado, adicione palavras como "natural gait" ou "energetic sprint."
  3. A câmera está correta? Se o enquadramento estiver errado, especifique a distância — "medium shot" ou "close-up."

Mude uma variável por vez. Não reescreva o prompt inteiro — isso reseta a interpretação do modelo e desperdiça créditos.

Seu primeiro vídeo não vai ficar perfeito. Tudo bem. Iteração é a habilidade, não sorte.

A Estrutura de Prompt em Três Camadas

Depois de testar centenas de prompts, eu sempre volto para a mesma estrutura. Todo prompt eficaz do Seedance 2.0 tem três camadas:

CamadaO que escreverExemplo
CenaLocal, horário, clima, atmosferarain-soaked neon alley at midnight, steam rising from grates
SujeitoPersonagem, ação, expressão, vestuáriowoman in black trench coat, walking fast, tense expression
Câmera e EstiloLente, movimento, correção de cor, filmetracking shot from behind, film noir palette, 35mm grain

Regras que aprendi na prática

O modelo lê da esquerda para a direita. O que você escreve primeiro tem mais peso. Se o seu sujeito sempre fica ofuscado pelo cenário, mova a descrição do sujeito para o início do prompt.

150 palavras é o ponto ideal. Com menos de 50 palavras, o modelo preenche as lacunas aleatoriamente. Com mais de 300, ele começa a ignorar a segunda metade. Testei isso extensivamente — de 120 a 200 palavras consistentemente dá os melhores resultados.

Use descrições positivas, nunca negativas. Escreva "sharp focus, clean details" em vez de "no blur, no artifacts." O modelo interpreta instruções positivas de forma muito mais confiável.

Misture inglês e chinês quando ajudar. Descrições de ação funcionam melhor em inglês. Palavras-chave de atmosfera e clima às vezes produzem resultados mais fortes em chinês. Minha abordagem pessoal: inglês para o prompt principal, chinês para palavras-chave de estilo quando busco uma estética específica.

O Sistema de Referências @ — A Maioria dos Tutoriais Ignora Isso

Este é o recurso que separa o Seedance 2.0 de todos os outros geradores de vídeo por IA. A maioria dos tutoriais menciona em uma frase. Isso é um erro — é a ferramenta mais poderosa para resultados consistentes e controláveis.

O que você pode enviar

TipoLimiteO que controla
Imagens0–9Aparência do personagem, ambiente, estilo
Vídeos0–3 (total ≤ 15 segundos)Movimento de câmera, estilo de movimento, ritmo
Áudio0–3 (total ≤ 15 segundos)Ritmo musical, lip-sync de diálogo, som ambiente

Como o sistema de prioridade funciona

O modelo prioriza referências nesta ordem:

  1. @Audio = Âncora rítmica — controla o timing do lip-sync e a edição sincronizada com a batida
  2. @Video = Âncora de movimento — copia trajetórias de câmera e coreografia de ação
  3. @Image = Âncora visual — fixa o rosto do personagem, vestuário e estilo do ambiente

Exemplo completo de prompt

Character from @Image1 walks through the landscape in @Image2.
Camera follows from @Video1 perspective, smooth tracking movement.
Background music synced to @Audio1, beat-matched cuts.
Cinematic warm lighting, shallow depth of field, 35mm film texture.

Dicas práticas

  • Comece com 2–3 arquivos, não 12. Mais referências significam mais sinais conflitantes. Adicione complexidade gradualmente.
  • Para imagens de personagem, use um retrato de corpo médio com fundo limpo. Fundos complexos confundem a âncora visual.
  • Sempre especifique o que cada referência controla no seu prompt. Não apenas envie arquivos e torça — diga ao modelo explicitamente: "face from @Image1" ou "camera movement from @Video1."

15 Modelos de Prompts Prontos Para Copiar

Cada modelo abaixo está pronto para colar. Eu incluo o prompt, por que funciona, e os parâmetros recomendados.

Prompts de Texto-para-Vídeo

1. Comercial de Produto

A sleek espresso machine sits on a marble kitchen counter.
Steam rises from a freshly pulled shot. Morning sunlight streams
through a window, casting warm highlights on brushed steel.
The camera performs a slow 180-degree orbit around the machine.
Shallow depth of field, product photography lighting,
warm neutral color grading, 4K commercial quality.

Por que funciona: Produto específico + ambiente natural + órbita de câmera controlada + linguagem de iluminação comercial. Parâmetros: 16:9 · 10 segundos · 720p · Áudio ligado


2. Cena de Ação Anime

Two samurai face each other in a bamboo forest at dawn.
Wind ripples their clothing. Leaves fall slowly between them.
In a sudden burst, both draw swords simultaneously.
Steel clashes with a brilliant spark. The camera whip-pans
between close-ups of their determined eyes and the
impact point. Anime cel-shading style, dramatic speed lines,
saturated color palette, dynamic composition.

Por que funciona: Setup claro → momento de ação → instrução de câmera + palavras-chave específicas de anime. Parâmetros: 16:9 · 8 segundos · 720p · Áudio ligado


3. Coreografia de Luta

A martial artist in a white gi executes a spinning roundhouse kick
in an industrial warehouse. Dust particles explode from the impact
point. The camera captures the kick in slow motion from a low angle,
then snaps to real-time as the fighter lands and transitions into
a defensive stance. Dramatic side lighting with deep shadows.
Cinematic action film style, sharp focus on the fighter,
motion blur on the kick arc.

Por que funciona: Golpe marcial específico + reação do ambiente (poeira) + mudança de velocidade (câmera lenta → tempo real) + direção de iluminação forte. Parâmetros: 16:9 · 10 segundos · 720p · Áudio ligado


4. Abertura de Curta-Metragem

A lone figure in a worn overcoat walks through an abandoned
train station at twilight. Broken glass crunches under each step.
Pigeons scatter from the rafters. Volumetric light shafts cut
through dusty air from shattered skylights. The camera begins
with a wide establishing shot, then slowly dollies forward,
following the figure deeper into the station.
Desaturated teal-and-amber color grade, anamorphic lens flares,
melancholic atmosphere, film grain.

Por que funciona: Detalhes sensoriais (vidro quebrando, pombos, poeira) + clássica abertura com dolly-forward + correção de cor específica + tom emocional. Parâmetros: 21:9 · 8 segundos · 720p · Áudio ligado


5. Gancho para Redes Sociais (Vertical)

Extreme close-up of latte art being poured into a ceramic mug.
Milk swirls into a perfect rosetta pattern. Steam rises gently.
The camera is locked overhead, shooting straight down.
Warm morning light from the left. Cozy café aesthetic,
soft bokeh background, ASMR-quality detail.
Slow motion, satisfying visual rhythm.

Por que funciona: Câmera fixa de cima = enquadramento estável para vídeo vertical + conteúdo ASMR/satisfatório + padrão específico de latte art. Parâmetros: 9:16 · 5 segundos · 720p · Áudio ligado

Prompts de Imagem-para-Vídeo

6. Foto de Produto → Vídeo Promocional

Envie sua foto do produto como imagem de referência e use este prompt:

The product in @Image1 sits on a clean surface.
The camera slowly orbits 180 degrees around it.
Soft studio lighting highlights surface textures and materials.
A subtle reflection appears on the surface below.
Product photography style, premium aesthetic,
smooth continuous camera movement.

Por que funciona: @Image1 fixa a aparência do produto + câmera em órbita mostra todos os ângulos + linguagem de iluminação de estúdio aciona renderização profissional. Parâmetros: 16:9 · 8 segundos · 720p · Áudio desligado


7. Retrato → Animação de Personagem

Envie uma foto de retrato e então:

The person in @Image1 turns their head slowly from left to right,
as if noticing something in the distance. A gentle breeze moves
their hair. Natural expression transitions from neutral to
a slight smile. The camera holds a medium close-up, steady.
Soft natural lighting, cinematic skin tones,
shallow depth of field on the background.

Por que funciona: Movimento simples e controlado (virar a cabeça) + interação natural com o ambiente (brisa) + câmera fixa evita distorção. Parâmetros: 16:9 · 5 segundos · 720p · Áudio desligado


8. Paisagem → Panorâmica Cinematográfica

Envie uma foto de paisagem e então:

The landscape in @Image1 comes alive with subtle motion.
Clouds drift slowly across the sky. Grass sways in a gentle wind.
Light shifts as the sun moves behind a cloud.
The camera performs a slow horizontal pan from left to right,
revealing the full scene. Epic cinematic scale,
golden hour warmth, wide-angle lens perspective.

Por que funciona: Pede movimento ambiental (nuvens, grama, luz) em vez de movimento de personagem, o que paisagens lidam bem. Parâmetros: 21:9 · 10 segundos · 720p · Áudio ligado


9. Controle de Primeiro Quadro + Último Quadro

Envie duas imagens — o modelo automaticamente usa a primeira como quadro inicial e a segunda como quadro final:

Smooth cinematic transition from @Image1 to @Image2.
The camera slowly pushes forward as the scene transforms.
Lighting transitions naturally between the two environments.
Maintain visual continuity and fluid motion throughout.
Dreamlike quality, gentle pace, soft color blending.

Por que funciona: O upload de duas imagens ativa automaticamente o modo primeiro-último quadro do Seedance 2.0. O prompt guia o estilo da transição. Parâmetros: 16:9 · 6 segundos · 720p · Áudio ligado


10. Personagem Consistente Entre Cenas

Envie sua imagem de referência do personagem e use este prompt para cada geração no seu projeto:

Character from @Image1 walks down a busy city street at night.
Maintain facial features and wardrobe fully consistent with @Image1:
short black hair, blue denim jacket, white sneakers.
Natural walking pace, confident posture.
The camera tracks from a side angle at waist height.
Urban night atmosphere, neon reflections on wet pavement.

Por que funciona: Âncora dupla — referência visual @Image1 + descrição textual explícita dos traços principais. Essa redundância é essencial para consistência entre múltiplas gerações. Parâmetros: 16:9 · 8 segundos · 720p · Áudio ligado

Prompts de Referência-para-Vídeo (Exclusivo do Seedance 2.0)

Estes modelos utilizam a capacidade multimodal completa que só o Seedance 2.0 oferece.

11. Mix Multimodal — Imagem + Vídeo + Áudio

Envie: foto do personagem + clipe de vídeo de referência + faixa de música de fundo.

Use the first-person perspective framing of @Video1 throughout.
Use @Audio1 as background music throughout, beat-synced editing.
Character from @Image1 walks through a neon-lit street market.
Camera follows the character from behind, matching the movement
style in @Video1. The character pauses to examine a food stall,
turns to the camera, and smiles. Cinematic night photography,
rich saturated colors, shallow depth of field.

Por que funciona: Cada referência @ tem um papel claramente definido — @Video1 para câmera, @Audio1 para ritmo, @Image1 para personagem. Parâmetros: 16:9 · 10 segundos · 720p · Áudio ligado


12. Edição de Vídeo — Substituir Elementos

Envie: vídeo original + imagem do produto substituto.

Replace the object being held in @Video1 with the product
shown in @Image1. Keep the original camera movement,
lighting, and hand gestures unchanged.
Maintain natural interaction between the hand and the new product.
Seamless integration, matching color temperature and shadows.

Por que funciona: Diz ao modelo exatamente o que preservar (câmera, iluminação, gestos) e o que substituir (o objeto). Parâmetros: Proporção do vídeo original · Mesma duração do original · 720p · Áudio ligado


13. Extensão de Vídeo — Continuação Multi-Segmento

Envie: 2–3 segmentos de vídeo que você deseja conectar.

Continue the narrative from @Video1 into @Video2.
Maintain consistent character appearance, lighting direction,
and color grade across the transition. The camera movement
flows naturally between segments without jump cuts.
Smooth temporal blending at transition points.
Cinematic continuity, professional editing feel.

Por que funciona: Instruções explícitas de continuidade evitam as mudanças bruscas de estilo que acontecem ao unir clipes. Parâmetros: Proporção do original · 8 segundos · 720p · Áudio ligado


14. Videoclipe Musical — Geração Guiada por Áudio

Envie: foto do personagem + faixa musical.

Character from @Image1 performs to the rhythm of @Audio1.
Movement intensity follows the music dynamics: subtle sway during
quiet sections, energetic motion during the chorus.
Camera cuts sync to beat drops. Lighting pulses with the rhythm.
Music video aesthetic, high contrast, dramatic color grading,
concert-style spotlights.

Por que funciona: Vincula comportamentos visuais específicos (movimento, cortes, iluminação) a eventos sonoros específicos (batidas, refrão, partes calmas). Parâmetros: 9:16 · 15 segundos · 720p · Áudio ligado


15. Talking Head — Diálogo com Lip-Sync

Envie: foto do personagem + gravação de áudio do diálogo.

Character from @Image1 speaks the dialogue from @Audio1.
Precise lip-sync matching the audio. Natural head micro-movements:
slight nods when emphasizing points, occasional blink,
subtle eyebrow raises. Professional presenter framing,
medium close-up, clean background.
Three-point studio lighting, warm skin tones, sharp focus on face.

Por que funciona: Instruções específicas de micro-movimentos (acenos, piscadas, levantar de sobrancelhas) evitam o problema do "rosto congelado" em vídeos de talking head. Parâmetros: 16:9 · Mesma duração do áudio · 720p · Áudio ligado

Tabela de Referência de Linguagem de Câmera

Você não precisa ser cineasta. Basta escolher um termo de câmera desta tabela e adicioná-lo ao seu prompt. Upgrade instantâneo.

TermoO que fazQuando usar
Dolly inA câmera avança em direção ao sujeitoPara construir intensidade emocional
Dolly outA câmera recua, afastando-se do sujeitoPara revelar contexto ou ambiente
Tracking shotA câmera segue o sujeito lateralmenteSequências de ação, cenas de caminhada
Crane downA câmera desce verticalmenteGrandes planos de estabelecimento
HandheldLeve tremor naturalSensação de documentário, urgência
360° orbitA câmera gira ao redor do sujeitoRevelações de personagem, tomadas de produto
Whip panMovimento horizontal ultrarrápido da câmeraTransições entre sujeitos
Rack focusO foco muda do primeiro plano para o fundoPara direcionar atenção entre elementos
Dutch angleCâmera inclinada em seu eixoTensão, desconforto, tomadas estilizadas
POVA câmera representa os olhos do personagemPerspectiva imersiva em primeira pessoa

Mantendo Personagens Consistentes

Consistência de personagem é a parte mais difícil do vídeo por IA. Aqui está o sistema que funciona:

  1. Sempre use a mesma @Image1 em cada prompt do seu projeto. Esta é sua âncora visual.
  2. Repita os traços físicos principais no texto mesmo quando tiver uma imagem de referência. Escreva "short silver hair, scar on right cheek, black leather jacket" todas as vezes. O modelo precisa de âncoras visuais e textuais.
  3. Mantenha o design do personagem simples. Menos acessórios e roupas mais simples produzem resultados mais estáveis entre gerações.
  4. Use um retrato limpo de corpo médio como imagem de referência. Fundos complexos ou ângulos extremos confundem o sistema de âncora visual.

Erros Comuns em Prompts e Como Corrigir

ErroExemplo ruimCorreção
Muito vago"a nice video of nature"Adicione detalhes: "red fox crossing a frozen river at dawn, wide shot"
Instruções contraditórias"fast-paced slow motion"Escolha um: "slow motion" ou "fast-paced editing"
Prompt muito longo300+ palavrasCorte para 120–200 palavras — priorize as partes importantes no início
Sem direção de câmeraCompletamente ausenteAdicione pelo menos um: "tracking shot" ou "static medium shot"
Formulação negativa"no blur, no artifacts"Reescreva como: "sharp focus, clean output, crisp details"
Excesso de referências12 arquivos enviados de uma vezComece com 2–3 arquivos. Adicione mais somente se necessário

Perguntas Frequentes

Qual o melhor comprimento de prompt para o Seedance 2.0? 150 palavras é o ponto ideal ao qual sempre volto. Com menos de 50, o modelo adivinha demais. Com mais de 300, começa a ignorar a segunda metade. Priorize os elementos mais importantes no início — sujeito e ação primeiro, estilo e câmera depois.

Posso usar prompts em chinês no Seedance 2.0? Sim, e às vezes eles produzem resultados mais fortes para clima e atmosfera. Eu misturo os dois — inglês para descrições de sujeito e ação, chinês para palavras-chave de estilo quando busco uma estética específica. Ambos os idiomas funcionam nativamente.

Como manter personagens consistentes em múltiplos vídeos? Sempre use a mesma referência @Image1. Depois repita os traços principais no texto toda vez: "short silver hair, mole under left eye, blue jacket." O modelo precisa de âncoras visuais e textuais. Designs de personagem simples são mais estáveis do que complexos.

Qual a diferença entre os prompts do Seedance 2.0 e do Sora 2? Ferramentas diferentes respondem a estilos de prompt diferentes. O Sora 2 lê palavras de atmosfera e emoção de forma mais eficaz. O Seedance 2.0 responde melhor a descrições de ação específicas e instruções de referência @. Escrevi um guia separado de prompts para o Sora 2 se quiser comparar as abordagens.

Quanto tempo leva a geração? Um clipe de 5 segundos a 720p normalmente leva 30–60 segundos. Um clipe de 15 segundos com áudio ativado pode levar 90–120 segundos. Resolução mais baixa (480p) gera mais rápido se você estiver iterando na linguagem do prompt.

Posso usar vídeos do Seedance 2.0 comercialmente? O licenciamento varia por plataforma. No SoraVideo.art, o conteúdo gerado é seu para uso comercial. Verifique os termos específicos de cada plataforma antes de publicar conteúdo comercial.

O Seedance 2.0 suporta prompts negativos? Não como um campo separado como nos geradores de imagem. Em vez disso, use formulação positiva: "sharp focus" ao invés de "no blur," "stable composition" ao invés de "no shaking." O modelo segue instruções afirmativas com mais confiabilidade.

Conclusão

O Seedance 2.0 é o gerador de vídeo por IA mais capaz que usei em 2026 — mas somente se você souber como se comunicar com ele. A estrutura de prompt em três camadas, o sistema de referências @, e os 15 modelos acima são tudo que uso diariamente.

Comece com um modelo. Gere. Analise. Mude uma coisa. Gere novamente. Você estará produzindo clipes cinematográficos na sua primeira sessão.

Novo no Seedance 2.0? Leia o guia de acesso para se configurar, depois volte aqui para os prompts. Quer entender os custos antes de escalar? Confira a análise de preços do Seedance 2.0. Curioso sobre o conjunto completo de recursos? O guia completo do Seedance 2.0 cobre tudo em detalhes.

Comece a criar com o Seedance 2.0

Acesse o Seedance 2.0, Sora 2 Storyboard, Kling Motion Control e mais no SoraVideo.art — todas as suas ferramentas de vídeo por IA em um só lugar. Veja os planos.

Newsletter

Junte-se à comunidade

Assine nossa newsletter para as últimas notícias e atualizações