Guia de Criação do Seedance 2.0

De uma inspiração a um vídeo controlável

Domine referência multimodal, definição de sujeito, sequência de storyboard, movimentos de câmera, edição de vídeo e técnicas de extensão. A página inclui exemplos completos e perguntas frequentes. Veja e copie para usar imediatamente na geração.

A série Doubao Seedance 2.0 (doravante referida como série Seedance 2.0) suporta nativamente a geração conjunta de áudio e vídeo, possuindo excelente compreensão semântica e capacidade de interação multimodal. Este artigo apresenta métodos de uso e dicas relacionadas aos prompts da série Seedance 2.0, ajudando você a utilizar o modelo de forma mais eficiente para gerar vídeos de alta qualidade que atendam às suas necessidades.

Aviso
Todos os materiais visuais (imagens, vídeos) e de áudio apresentados neste guia foram gerados de forma autônoma pela série de modelos de geração visual Seedance/Seedream.

Fórmula básica

A série Seedance 2.0 suporta a referência simultânea a materiais multimodais como vídeo, imagem e áudio, permitindo capturar com precisão características como aparência de personagens, efeitos de ação, estilo visual e timbre de voz, reduzindo significativamente a dificuldade de escrever prompts. Com base nessa vantagem, podemos usar uma fórmula básica simples para guiar o modelo, aproveitando as características dos materiais multimodais para gerar rapidamente vídeos que atendam a necessidades específicas.

A geração de vídeo com referência pode ser dividida em três tipos de tarefas: referência multimodal, edição de vídeo e extensão de vídeo. Você pode escolher a fórmula básica de prompt de acordo com o tipo de tarefa.

Referência multimodal

Extrair alguns elementos (como sujeito, estilo, cena, efeito sonoro) do material para gerar um novo vídeo.

Cenários de aplicação: Transferência de movimento, reutilização de sujeito, empréstimo de atmosfera, etc.
Estrutura recomendada:
Referência de imagem: Referencie<Imagem N>em<Sujeito N>, gere...
Referência de vídeo: Referencie<Vídeo N>em<Ação/Movimento de câmera/Estilo/Efeito sonoro>, gere...
Referência de áudio: Referencie<Áudio N>no timbre, gere...

Edição de vídeo

Fazer modificações parciais ou globais com base no vídeo original. As partes não mencionadas permanecem inalteradas por padrão.

Cenários de aplicação: Substituição local, remoção de sujeito, modificação de atributos, etc.
Estrutura recomendada:
Adicionar elemento: Descreva claramente<Característica do elemento> + <Momento de aparecimento> + <Posição de aparecimento>
Modificar elemento: Edite estritamente<Vídeo N>, alterando<Característica original>para<Nova característica>
Remover elemento: Indique claramente o elemento a ser removido. Para elementos que permanecem inalterados, enfatize-os no prompt para obter melhores resultados.

Estender vídeo

Estender o vídeo original na dimensão temporal, exigindo consistência no estilo audiovisual, sujeito e narrativa.

Cenários de aplicação: Continuação da trama, extensão da ação, complementação de trechos, etc.
Estrutura recomendada:
Estender vídeo: Estender para frente/para trás<Vídeo N>, gere...
Preenchimento de trilha:<Vídeo 1> + <Descrição da transição> + seguido por <Vídeo 2> + <Descrição da transição> + seguido por <Vídeo 3>
Aviso
Para tarefas de edição/extensão de vídeo, use diretamente "<Vídeo N>" para se referir ao vídeo. Não use "referência<Vídeo N>" para evitar ser mal interpretado como uma tarefa de referência.

Tarefas combinadas

Os 3 tipos de tarefas acima também podem ser usados em combinação.

Cenários de aplicação: Referencie um material e edite outro.
Estrutura recomendada:
Referencie<Imagem/Vídeo N>em[Dimensão de referência], edite estritamente<Vídeo X>,[Conteúdo específico da edição]

Fórmula avançada

O Seedance 2.0 é essencialmente um diretor de IA multimodal: ele lê simultaneamente seus prompts de texto, imagens, vídeos e áudios, e internamente os divide em duas dimensões — "camada espacial" (o que está na cena) e "camada temporal" (como as coisas mudam ao longo do tempo) — para entender e gerar as imagens.

Portanto, um bom prompt não é uma mera "descrição textual", mas sim uma "instrução de engenharia": quem, em que cena, fazendo qual ação, como a câmera se move, em que ordem temporal ocorre, tudo isso é enviado para a camada espacial e temporal. A fórmula específica é a seguinte:

Fórmula avançada de prompt: Sujeito preciso + Detalhes da ação + Ambiente da cena + Tom de luz e cor + Movimento da câmera + Estilo visual + Qualidade da imagem + Condições de restrição

Simplificando, primeiro defina "quem" está "fazendo o quê", depois especifique "onde" e "qual atmosfera", em seguida diga ao modelo "como filmar", e finalmente use estilo, qualidade e restrições para refinar o resultado. Abaixo, detalhamos cada elemento.

1 Definir o sujeito

Em materiais de referência reais, uma imagem geralmente contém vários sujeitos. Para referenciar com precisão um objeto específico no material, é necessário definir claramente o sujeito. O sujeito pode ser uma pessoa, um objeto, uma cena, etc.

Modo de definição básica
Estrutura recomendada: Defina <Imagem/Vídeo N>em[Característica central do sujeito] definido como <Sujeito N>
Requisito de característica central : Use 2–3 características estáticas claras e estáveis (como vestuário, penteado, aparência, categoria) para descrever, garantindo identificabilidade única.
Exemplo:
Substitua o perfume em Imagem1 A mulher de vestido vermelho e chapéu de palha em é definida como Sujeito 1
Substitua o perfume em Imagem1 A mulher de vestido vermelho e chapéu de palha em é definida como Zhang Hong
Mesmo sujeito em múltiplos materiais

Quando objetos de múltiplos materiais se referem ao mesmo sujeito, eles devem ser vinculados uniformemente:

Estrutura recomendada: Defina Imagem1 em[...] ,Imagem2 em[...] definido como ** <Sujeito N>**
Cena com múltiplos sujeitos

Quando houver vários sujeitos no vídeo, cada um deve ser definido separadamente e identificado com tags. As tags devem ser únicas e estáveis, e as tags correspondentes devem ser usadas consistentemente nas descrições subsequentes para evitar confusão de referência.

Estrutura recomendada: Defina a [característica principal do sujeito 1] em <Imagem/Vídeo N> como <Sujeito 1>, defina a [característica principal do sujeito 2] em <Imagem/Vídeo N> como <Sujeito 2>...
Exemplo: Defina vídeo1comopolicial, e o outro homem baixo comoladrão. O cenário é um mercado diurno lotado, com sol brilhante, muitas barracas de frutas e pedestres densos, cheio de atmosfera de vida urbana. ladrãoCorre desesperadamente para frente no meio da multidão do mercado lotado, policialpersegue em alta velocidade logo atrás, os dois se movendo rapidamente entre as barracas. Câmera na mão acompanha rapidamente para frente, a imagem tem uma leve sensação de tremor realista, criando uma atmosfera tensa de perseguição.
Aviso
Cada vez que um sujeito é mencionado, deve ser claramente referenciado, evitando omissões. São suportados os dois usos a seguir:
Para cenas simples sem sujeitos predefinidos, cada vez que um sujeito é mencionado, use<Sujeito N>@<Imagem N>, enfatizando a relação de vínculo entre sujeito e material. Por exemplo: Zhang San@imagem1.
Para cenas com sujeitos predefinidos, cada vez que um sujeito é mencionado, use o mesmo rótulo. Por exemplo: defina o homem alto emvídeo1comopolicial, e o outro homem baixo comoladrão. Em descrições subsequentes, continue usando "policial" para se referir ao homem alto e "ladrão" para o homem baixo.
Ao usar um Asset ID, ainda é necessário usar<Imagem/Vídeo N>para se referir ao sujeito. Como o modelo não pode associar diretamente o Asset ID ao conteúdo de referência, não substitua<Imagem/Vídeo N>.
Mantenha as descrições concisas, evite redundâncias e conflitos semânticos (como características contraditórias para o mesmo sujeito).
Recomenda-se expressar relações espaciais preferencialmente por meio de imagens de referência, reduzindo descrições textuais complexas.

2 Usar sequência de storyboard

A modelagem interna do modelo é desacoplada entre espaço e tempo. Portanto, a forma ideal de um prompt para um vídeo complexo é um storyboard temporal: divida o vídeo em vários storyboards e descreva dinamicamente cada um na ordem dos eventos: quem + onde + faz o quê + como a câmera se move.

Dica prática

Use a ordem das tomadas. Escreva um storyboard simples "Tomada 1 / Tomada 2 / Tomada 3" para cada segmento de vídeo e depois combine-os em um prompt completo.

Exemplo negativo: "Um homem corre nervosamente pela rua, a cena tem um toque cinematográfico."
Exemplo positivo:
Tomada 1: Filmagem lateral da rua, o homem começa a correr lentamente, com uma sensação de respiração ofegante.
Tomada 2: O homem derruba uma barraca de frutas, a câmera balança rapidamente e dá um close-up no rosto assustado do homem.
Tomada 3: O homem salta um muro baixo e desaparece, a câmera se afasta lentamente e para em uma rua vazia.

Regras específicas

Use identificadores comoTomada1,Tomada2,Tomada3, organizando o conteúdo na ordem dos eventos (do principal ao secundário). Não é obrigatório limitar a duração de cada segmento; deixe o modelo gerar o ritmo naturalmente com base na trama.
Observação
O suporte do modelo para tempos precisos (como 0–3 segundos) é instável; forçar a limitação de duração pode resultar em anomalias na geração.
Recomenda-se organizar cada tomada conforme a seguinte lógica:
Movimento de câmera ou modo de transição: Como "aproximação lenta em plano geral", "câmera fixa", "corte para...", etc.
Ação e expressão do sujeito: Descreva as ações e mudanças de expressão principais do personagem/objeto central.
Mudança de posição ou espaço: Indique a cena, posição ou relação espacial do sujeito.
Informação de áudio: Descreva os efeitos sonoros, vozes ou música de fundo correspondentes à tomada.

3 Requisitos para descrição de ação

Detalhamento de membros + Quantificação de grau
A ação deve ser específica para partes do corpo como mãos, pernas, cabeça, ombros e costas, complementada com descrições deamplitude, velocidade, intensidade;
Exemplo: levantar a mão lentamente, virar a cabeça rapidamente, empurrar o chão com força, abaixar a cabeça levemente.
Priorizar movimentos pequenos, lentos e contínuos
Priorize movimentos sutis, suaves e contínuos, evitando ao máximo ações de alta intensidade e grande dinâmica, como corridas, saltos ou cambalhotas violentas.
Exemplo: andar lentamente, levantar a mão suavemente, abaixar a cabeça levemente, sentar-se naturalmente
Complementar transições de ação
Descreva a inércia e a relação de continuidade entre as ações anteriores e posteriores, garantindo que a ação na cena seja fluida e natural.
Exemplo: aproveitar a inércia da virada para levantar a mão, transitar naturalmente de uma pausa para levantar a mão.
Expressão externalizada de emoções
Use detalhes físicos específicos para expressar emoções, em vez de palavras abstratas como "muito triste" ou "extremamente irritado".
Veja exemplos específicos na tabela abaixo:

Emoção abstrata

Externalizado em ações e detalhes

Tristeza

Cabeça baixa, ombros tremendo levemente, olhos levemente avermelhados, dedos inconscientemente apertando a barra da roupa, lágrimas nos olhos mas sem cair.

Alegria

Canto da boca se levanta incontrolavelmente, sobrancelhas e olhos se suavizam, passos ficam leves, começa a cantarolar uma canção inconscientemente, não resiste a dar uma volta no lugar.

Nervosismo / Ansiedade

Olha o relógio com frequência, tamborila os dedos na mesa, respiração ofegante, desvia o olhar, rói as unhas inconscientemente.

Raiva

Punhos cerrados, mandíbula tensa, peito ofegante violentamente, olhar afiado como uma lâmina, palavras saem entre os dentes.

Alívio

Suspira profundamente, ombros tensos relaxam completamente, um sorriso leve e há muito não visto surge no rosto, levanta o olhar para o horizonte.

4 Escrita de movimentos de câmera

O modelo tem forte compreensão de termos de movimento de câmera, bastando usar termos padrão como “plano médio, close-up, plano geral, câmera lenta, movimento horizontal suave, câmera fixa”.

Aviso
Em uma tomada, especifique apenas 1 tipo de movimento de câmera; não exija simultaneamente zoom, panorâmica e tilt, pois isso pode aumentar a instabilidade da imagem.

5 Qualidade, estilo e palavras de restrição

Qualidade, estilo e palavras de restrição são fundamentais para controlar o efeito de geração de vídeo, definindo limites criativos para o modelo, uniformizando a qualidade e o tom artístico, além de evitar imperfeições e desvios aleatórios na imagem, sendo uma configuração necessária para garantir resultados estáveis e conformes.

1 Qualidade

Define a nitidez da imagem, detalhes de textura e qualidade de luz e sombra, melhorando a qualidade básica do vídeo gerado.

Exemplo: Alta definição, detalhes ricos, qualidade cinematográfica, cores naturais, luz e sombra suaves

2 Estilo

Define o estilo artístico geral e o tom visual, unificando a atmosfera artística da imagem.

Exemplo: Cyberpunk com tons frios de azul e roxo, filme vintage,清新 japonês

3 Palavras de restrição

As palavras de restrição são muito importantes para evitar efetivamente imperfeições na imagem, deformações e elementos irracionais, restringindo os limites de geração e a estabilidade.

Modelo comum de palavras de restrição:

Evitar gerar legendas: "Manter sem legendas", "Evitar gerar qualquer texto ou legenda"
Evitar gerar logotipo: "Não gerar logotipo"
Evitar gerar marca d'água: "Não gerar marca d'água"

6 Caso prático

Mostra como usar a fórmula avançada e os elementos apresentados acima para escrever prompts.

Exemplo 1: Drama emocional de dormitório (com ênfase em diálogo / cenas de conversa)

Preparação do material :

@Imagem 1: Foto de meio corpo da protagonista feminina
@Imagem 2: Imagem de referência do cenário do dormitório
@Vídeo 1: Referência de movimento de câmera para diálogo interno (plano médio com zoom ou pan suave)
@Áudio 1: Som ambiente interno ou música suave

Prompt :

A garota em @Imagem 1 é a protagonista, @Imagem 2 é a referência de estilo do cenário do dormitório, consulte o movimento de câmera de @Vídeo 1.

Cena 1 : Ao entardecer, a garota @Imagem 1 caminha levemente até a porta do dormitório @Imagem 2 , a câmera a acompanha em plano médio estável. A luz amarela quente do entardecer entra no corredor pela janela. Ela faz uma pausa na porta, respira fundo, com uma expressão ligeiramente nervosa.

Cena 2 :a garota @Imagem 1 Ela abre a porta e entra no dormitório. A câmera corta para um plano médio interno. As colegas de quarto, enquanto arrumam os livros, olham para cima para vê-la. Uma delas pergunta sorrindo {Como foi a prova, passou?}, a câmera alterna lentamente entre close-ups de meio corpo das pessoas.

Cena 3 :a garota @Imagem 1 Ela primeiro abaixa a cabeça com uma expressão de decepção, a câmera dá um close-up nela. Em seguida, ela levanta a cabeça, mal conseguindo conter o sorriso, e ri alto dizendo {Enganei vocês!}. As colegas de quarto começam a brincar e correr atrás dela. A câmera se afasta lentamente, parando em um plano geral do dormitório cheio de risos e alegria.

Durante toda a cena, estilo documentário cinematográfico de alta definição, tons quentes, iluminação suave; rosto do personagem estável sem distorção, movimentos naturais e fluidos, sem travamentos ou cintilações; efeitos sonoros ambiente se fundem naturalmente com @Áudio 1.

Exemplo 2: Cena de confronto em penhasco de estilo antigo (com ênfase em ação / atmosfera)

Preparação do material :

@Imagem 1: Protagonista feminina de vermelho
@Imagem 2: Assassina de preto (oponente)
@Imagem 3: Imagem de cena de penhasco com bambuzal
@Vídeo 1: Referência de movimento de câmera para luta de artes marciais
@Áudio 1: Batidas de tambor intensas ou efeitos sonoros de luta

Prompt :

A mulher de vermelho em @Imagem 1 é a protagonista feminina, a mulher de preto em @Imagem 2 é a oponente. O cenário consulta o ambiente do penhasco com bambuzal em @Imagem 3. O movimento geral da câmera e o ritmo da ação consultam @Vídeo 1. O som de fundo está sincronizado com @Áudio 1.

Cena 1 : Ao entardecer, a câmera parte de a mulher de vermelho @Imagem 1Plano médio lateral em aproximação lenta. Ela está à beira do penhasco, erguendo a garrafa de vinho para beber. As mangas do vestido balançam suavemente ao vento da montanha. A câmera a circunda em meio círculo, indo da frente para as costas. Ao longe, é possível ver vagamente a silhueta de uma figura de preto entre os bambus.

Cena 2 : A câmera faz um zoom out gradual para um plano geral. Vista de drone sobrevoa todo o penhasco e o bosque de bambus. As duas pessoas estão em extremos opostos do penhasco. O vento da montanha levanta as barras das roupas e a poeira. O ritmo acelera ligeiramente com a batida do tambor.

Cena 3 : A câmera corta para um plano próximo ao chão. As duas sacam lentamente suas espadas, em confronto. Mulher de vermelho @imagem 1 Sua expressão passa de despreocupada para gélida. Mulher de preto @imagem 2 Olhar firme, a ponta da espada treme ligeiramente. A câmera acompanha suavemente as duas enquanto se movem em círculo, finalmente congelando em um close-up no instante antes do choque das espadas.

A imagem geral tem atmosfera cinematográfica de 'Chuva e Fumaça nos Rios e Lagos' (jianghu). Tom frio e baixa saturação. Textura de filme cinematográfico. Ricas camadas de luz e sombra. As proporções faciais e corporais são estáveis, sem distorção. Os movimentos são fluidos e naturais, sem rigidez, sem falhas de modelo ou travamentos.

Outras dicas

geração de texto

A série Seedance 2.0 suporta a geração de texto comum. O modelo podecombinar automaticamenteo estilo e a cor adequados com base no contexto, e também suportaespecificara cor, estilo, modo de aparecimento, momento de aparecimento e posição do texto no prompt. Ao escrever, priorize o uso decaracteres comuns, evitecaracteres rarosesímbolos especiais, para garantir a melhor apresentação. Atualmente, suporta cenários como slogans, legendas e balões. Para redação e exemplos específicos, consultegeração de texto.

Extensão de vídeo vs. Montagem por segmentos

Plano-sequência contínuo (extensão de vídeo): Adequado para "cenas dramáticas" em um único cenário, como diálogos longos, progressão emocional ou movimento em trajetória única, para obter um efeito imersivo e contínuo de plano-sequência.
Transição de cena/ação (montagem por segmentos): Adequado para reviravoltas na trama ou "cenas de ação" complexas e rápidas, como perseguições, lutas e montagem. Pode gerar segmentos independentes e depois editá-los e combiná-los para garantir ritmo e impacto visual.

Na produção real, os dois métodos são geralmente combinados. Por exemplo, primeiro use a extensão para gerar um diálogo contínuo e depois monte planos de corte ou segmentos de transição, equilibrando imersão e variação de ritmo.

Estratégia de configuração de materiais

Geralmente, os materiais são divididos em quatro "funções":

Ancoragem de personagem: fixa a aparência do personagem
Definição de cenário: fixa o ambiente e o estilo
Referência de movimento de câmera: fixa a linguagem da câmera e o ritmo da ação
Ritmo e atmosfera: usa áudio para controlar emoção e timbre

Configuração recomendada(total de 4 a 5 materiais): 1 a 2 imagens de personagem (close-up do rosto/corpo inteiro) + 1 imagem de cenário + 1 vídeo de movimento de câmera + 1 áudio.

Observação
Não é recomendado usar o limite máximo de materiais. Muitos materiais dificultam que o modelo julgue a prioridade das características, levando a conflitos de estilo, identificação confusa do sujeito e resultados fora do esperado.

Observações

Normas de idioma

O idioma das falas deve ser uniforme, evitando misturar chinês e inglês (exceto para nomes próprios).

Normas de caracteres especiais

O uso adequado de símbolos nos prompts ajuda o modelo a entender diferentes tipos de informação:

Tipo de informação

Símbolo

Exemplo

Música

()

(Ao fundo, toca rock acelerado)

Efeito sonoro

<>

<Latido de cachorro ao longe>

Fala

{}

{Olá, mundo}. Se a fala for em idioma minoritário (não chinês/inglês), deve-se indicar o idioma, ex: diga em japonês {こんにちは}.

Legendas

【】

【Capítulo 1: Partida】

Perguntas frequentes

Deriva de ID do personagem

Fenômeno típico

A imagem do personagem gerada não corresponde à imagem de referência, ou ocorre uma "troca de rosto" (deriva de ID) no meio do vídeo, fazendo com que o personagem se pareça com uma celebridade e seja bloqueado pela revisão.

Análise da causa raiz

Eficácia insuficiente da imagem de referência facial

Mistura de imagens de referência: Combinar a imagem de referência facial com imagens de pose de corpo inteiro/meio corpo, referência de roupa, detalhes, etc., em uma única imagem fornecida ao modelo.
Proporção facial muito pequena: Na imagem de referência mista, a área do rosto é muito pequena em relação à imagem inteira, e o modelo não dá peso suficiente à extração de características faciais, sendo facilmente interferido pelo fundo ou outros elementos.

Solução

Reforçar a independência e o peso da referência facial:

Preparar uma imagem de close-up facial: Além da foto de corpo inteiro original, prepare uma imagem de close-up facial quecontenha apenas a cabeça do personagem(close-up, apenas o rosto, de preferência sem expressão, minimizando ombros, pescoço, fundo e outros elementos de interferência).
Definição clara do sujeito no prompt: <sujeito1> características faciais referência imagem1 (close-up), maquiagem e figurino referência imagem2 (corpo inteiro).
Materiais importantes em primeiro lugar: Quanto maisreferência precisafor necessária, maisno iníciodo prompt o material deve ser colocado.
Aviso
Para referência de personagem, basta usar close-up facial + foto de corpo inteiro.Não é recomendado usar múltiplas vistas do personagem. Materiais com múltiplas vistas contêm diferentes ângulos do mesmo personagem, e o modelo pode identificá-los como vários sujeitos diferentes, agravando o problema de deriva de ID.

Antes da otimização

Após a otimização

O personagem no vídeo “troca de rosto” no meio, colidindo com celebridades.

O rosto permanece consistente com a imagem de referência durante todo o vídeo.

Vídeo contém legendas

Fenômeno típico

O prompt não solicitou a geração de legendas, mas o vídeo gerado as contém.

Solução

Observação
Atualmente, não é possível evitar 100% a geração de legendas. Apenas é possível reduzir a probabilidade e melhorar a taxa de sucesso com os métodos abaixo.
Adicione instruções claras de restrição ao prompt: "Manter sem legendas", "Evitar gerar qualquer texto ou legenda".
Se o texto nas imagens/vídeos de referência não for informação essencial, é recomendável removê-lo primeiro com ferramentas (por exemplo, usando a capacidade de edição de imagem/vídeo dos modelos Seedream/Seedance) e depois usar o material sem texto como entrada.
Se o negócio permitir, priorize a geração de vídeos no formato paisagem (a probabilidade de gerar legendas em paisagem é significativamente menor do que em retrato). Posteriormente, pode-se cortar para retrato com software de edição.

Vídeo contém logotipo/marca d'água

Fenômeno típico

O prompt não mencionou conteúdo de marca d'água, mas o vídeo gerado contém logotipo/marca d'água de outras plataformas de vídeo.

Solução

Adicione instruções claras de restrição ao prompt: "Não gerar marca d'água", "Não gerar logotipo".

Deriva de estilo

Fenômeno típico

Espera-se gerar um estilo de animação 2D ou 3D, mas o estilo da imagem de referência de entrada é mais realista e o prompt não enfatiza o estilo do vídeo. O vídeo gerado pode derivar para um estilo realista.

Solução

Adicione termos claros de restrição de estilo ao prompt, como "estilo anime 2D japonês", "mangá chinês 3D". Para controle de estilo mais preciso, é recomendável transformar a imagem de referência no estilo desejado antes de gerar o vídeo.

Antes da otimização

Após a otimização

O estilo xianxia derivou para estilo realista.

Manter o estilo 3D de animação chinesa CG de fantasia imortal (xianxia).

Salto na junção de vídeo estendido

Fenômeno típico

Ao usar a função de extensão de vídeo para gerar um novo vídeo e depois juntá-lo ao original, podem ocorrer saltos ou retrocessos na junção.

Solução

Atualmente, recomenda-se reparar por meio de edição posterior, alinhando os quadros-chave. Otimizações fundamentais serão feitas em iterações futuras do modelo.

Importe o vídeo a ser unido para o CapCut ou outro software profissional de edição de vídeo.
Na primeira junção, remova6 quadros do final do primeiro vídeo.
e, ao mesmo tempo, remova1 quadro do início do segundo vídeo.
Repita a operação acima para todos os pontos de junção.
Exporte e verifique a suavidade do vídeo após a junção.
Observação
Após o alinhamento dos quadros, ainda podem existir pequenos saltos. Recomenda-se terminar o vídeo de extensão em um momento de transição de corte e iniciar o próximo vídeo com a nova cena após o corte.

Antes da otimização

Após a otimização

Nas transições (5s, 20s) aparece Salto instantâneo na tela ou Retrocesso de conteúdo

As transições ficam mais suaves.

Problema de gêmeos

Fenômeno típico

Em cenários com muitos personagens na tela e ao usar imagens de três vistas como material de referência, é fácil que apareçam dois personagens idênticos na mesma tela do vídeo gerado.

Análise da causa raiz

A definição do sujeito do personagem no prompt não é clara, e o modelo não consegue distinguir com precisão diferentes personagens;
Ao usar imagens de três vistas/múltiplas vistas como material de referência, é fácil causar confusão na identificação do personagem pelo modelo, gerando assim personagens duplicados.

Solução

Observação
Atualmente, não é possível evitar 100% o problema de gêmeos. Apenas é possível reduzir a probabilidade e melhorar a taxa de sucesso com os métodos abaixo.
Definir claramente a associação do sujeito do personagem

Defina claramente cada personagem no prompt, especificando a correspondência entre o personagem e a imagem de referência. Recomenda-se anotar a imagem de referência correspondente após o nome do personagem e manter o formato uniforme.

Exemplo: Zhang San (correspondente à imagem 1) joga a caderneta de poupança verde em direção a Li Si (correspondente à imagem 2) que está de pé.

2. Adicionar instrução de restrição global

Adicione uma restrição fixa no final do prompt:É proibido durante todo o vídeo ter personagens com aparência, vestuário e acessórios completamente idênticos. É proibido gerar efeitos de clone ou gêmeos. Na mesma tela, mantenha apenas o personagem correspondente único, sem repetição de personagens..

3. Otimizar materiais de referência

Priorize o uso de fotos individuais independentes para referência de personagem. Não é recomendado usar materiais de três vistas ou múltiplas vistas.

4. Simplificar e otimizar o prompt

Não use o roteiro completo diretamente como prompt. Conteúdo excessivamente redundante pode causar confusão no modelo. É necessário simplificar declarações irrelevantes e garantir que as instruções sejam claras e focadas.

Antes da otimização

Após a otimização

No segundo 8 da tela, aparecem “gêmeos”.

Degradação da qualidade na extensão de vídeo

Fenômeno típico

Ao usar um vídeo gerado pelo modelo como material de entrada para extensão, ocorre degradação da qualidade. Múltiplas extensões acumulam o efeito de degradação, especialmente na área facial do personagem, onde podem aparecer manchas de cor.

Solução

Atualmente, é possível mitigar a degradação da qualidade com os métodos abaixo. Otimizações fundamentais serão feitas em iterações futuras do modelo:

Converta o vídeo original em um vídeo de modelo branco usando o Seedance 2.0 e depois use-o como material de entrada para extensão.
Prompt de referência: Converta o vídeo em um modelo 3D branco, personagens unificados como modelos 3D brancos puros, sem cor, textura ou sombra, fundo branco puro, estrutura estável e movimento suave.
Priorize o uso de imagens de alta definição como material de referência.
Controle razoavelmente o número de extensões de vídeo, evitando múltiplas extensões acumuladas.

Antes da otimização

Após a otimização

Continuar escrevendo diretamente sobre o produto do modelo.

Converter o produto do modelo em um vídeo de modelo branco antes de continuar escrevendo.

Efeitos especiais não correspondem ao esperado

Fenômeno típico

Ao descrever efeitos especiais específicos por meio de texto no prompt, pode ocorrer que o efeito gerado não corresponda ao esperado. Por exemplo: o prompt especifica "o número '2999' aparece com uma animação de contagem regressiva", mas o efeito de rolagem de números gerado apresenta saltos desordenados, não seguindo a lógica padrão de contagem regressiva.

Solução

Recomenda-se usarvídeo de referênciapara definir o efeito especial: insira o vídeo do efeito especial desejado como material de referência no modelo, permitindo que ele entenda precisamente a forma e a lógica de movimento do efeito, resultando em um efeito mais alinhado com o esperado. Por exemplo: a forma de aparecimento do número '2999' consulte o vídeo 1.

Antes da otimização

Após a otimização

O efeito de rolagem numérica tem uma sensação de salto desordenado óbvia.

Após adicionar o efeito de vídeo de rolagem numérica correta, o resultado do efeito atendeu às expectativas.

Animação de efeito especial

Excesso de personagens de referência

Fenômeno típico

Quando o número de personagens de referência excede 4, a estabilidade da saída do modelo diminui, e o vídeo gerado pode apresentar problemas como número incorreto de personagens (menos ou mais) ou repetição de personagens.

Solução

Atualmente, é possível mitigar com os métodos abaixo. Otimizações fundamentais serão feitas em iterações futuras do modelo:

Gerar imagens em etapas: Agrupe os personagens, garantindo que cada grupo gerado não tenha mais de 4 personagens. Por exemplo, 6 pessoas podem ser divididas em 2 grupos de 3, gerando imagens separadamente.
Gerar vídeo a partir de imagens: Use as múltiplas imagens de grupo geradas na primeira etapa como material de referência para gerar o vídeo final.

Antes da otimização

Após a otimização

Inseridos 8 personagens de referência, o vídeo de saída tem 9 pessoas.

Gere 2 imagens com os 8 personagens e depois use imagem para vídeo.

Ruído no final do vídeo

Fenômeno típico

Quando o vídeo contém narração, é fácil que o final do vídeo tenha um clique abrupto ou ruído de corte.

Solução

Regere o vídeo ou use ferramentas de edição como CapCut para aplicar umfade out de áudiona trilha sonora do final, usando uma curva de volume, para eliminar o ruído de corte.

Passos específicos (usando CapCut):

Importe o vídeo gerado para o CapCut.
Na linha do tempo, selecione a trilha de vídeo, clique emÁudio.
na barra de ferramentas, selecionefade out de áudioa função (em algumas versões, está no menu Básico/Ajuste) e escolha o ponto-chave. Uma linha representando o volume e pontos-chave aparecerão na trilha de áudio.
Perto do final do vídeo, arraste o ponto-chave de volume final para baixo até o volume 0, formando uma rampa descendente.
Exemplo de prompt do Seedance 2.0
Visualize para confirmar que o áudio final desaparece naturalmente, sem cortes abruptos ou ruídos.

Antes da otimização

Após a otimização

Ruído no final

Sem ruído no final

Pronúncia imprecisa em chinês

Fenômeno típico

O modelo tende a errar na pronúncia de caracteres polifônicos, raros ou visualmente semelhantes.

Solução

Substitua os caracteres propensos a erro por homófonos comuns de pronúncia consistente para evitar desvios de pronúncia e restaurar o efeito de áudio esperado. Observe que esta solução é apenas uma otimização e não pode evitar completamente todos os problemas de pronúncia.

Exemplo: Reescreva "螭龙山" no prompt como o homófono "吃龙山".

Antes da otimização

Após a otimização

A pronúncia de “螭” em “螭龙山” está errada.

Depois de mudar para “吃龙山”, a pronúncia ficou correta.

Referência de timbre imprecisa

Fenômeno típico

Ao usar um áudio de referência para especificar o timbre, o áudio do vídeo final gerado pode ter um desvio significativo em relação ao timbre de referência.

Solução

Manter o estilo das falas do vídeo próximo ao tom e estilo de expressão do áudio de referência ajuda a melhorar a fidelidade e estabilidade do timbre.

Antes da otimização

Após a otimização

O timbre não corresponde ao áudio de entrada.

Exemplo de prompt do Seedance 2.0

Áudio de entrada

Após adicionar a descrição do timbre no prompt, a correspondência do timbre melhorou significativamente.

“Use @áudio1, voz masculina de meia-idade, grave, quente, com textura granulada sutil, para dizer”

Apêndice: Exemplos de prompts

Mostra exemplos de prompts usando os modelos da série Seedance 2.0 em diferentes cenários, ajudando você a obter controle mais preciso de referências multimodais e geração de texto.

geração de texto

Slogan

Modelo de prompt de referência:

「Conteúdo do texto」+「Momento de aparecimento」+「Posição de aparecimento」+「Modo de aparecimento」, 「Características do texto (cor, estilo)」
Observação
O Seedance2.0 pode combinar estilos de texto adequados ao contexto. Se os requisitos para o efeito de exibição do texto forem rigorosos, consulte a seção Referência de múltiplas imagens > Referência de Logo .

Exemplo de referência:

[Efeito final]

[Prompt]

Estilo de desenho animado à mão. Três pessoas sentam juntas comendo Imagem1 o frango frito em. A atmosfera é amigável e alegre. A imagem gradualmente fica desfocada, e o texto “A alegria está no Seedance” aparece no centro da tela.

[Material de referência]

Exemplo de prompt do Seedance 2.0

▲ Imagem 1

Legendas

Modelo de prompt de referência:

Aparecem legendas na parte inferior da tela, com o conteúdo “...”. As legendas devem estar perfeitamente sincronizadas com o ritmo do áudio.

Exemplo de referência:

[Efeito final]

[Material de referência]

Exemplo de prompt do Seedance 2.0

[Prompt]

Gere um vídeo com narração em off. Uma voz masculina profunda e calma diz: “No vasto universo, nosso mundo é apenas um breve instante. No entanto, dentro dele, a vida floresce desenfreadamente.” A cena deve fazer a transição lenta da noite para o amanhecer, as estrelas desaparecendo gradualmente e o sol nascendo atrás da montanha. Legendas aparecem na parte inferior da tela de acordo com a fala.

[Efeito final]

[Material de referência]

Exemplo de prompt do Seedance 2.0

[Prompt]

As duas pessoas na imagem estão conversando no escritório. A mulher fala primeiro: “Você sempre chega na hora exata, gosta dessa sensação de timing perfeito?” O homem responde sorrindo: “Eu tenho meu próprio ritmo.” Quando os personagens falam, o diálogo é natural e casual. Legendas correspondentes aparecem na parte inferior da tela.

Balões de fala

Modelo de prompt de referência:

「Personagem」diz: “...”, um balão aparece ao redor do personagem enquanto ele fala, com a fala escrita dentro do balão.

Exemplo de referência:

[Efeito final]

[Material de referência]

Exemplo de prompt do Seedance 2.0

[Prompt]

Imagem1 As duas pessoas estão correndo na pista da escola vestindo roupas de esporte. A garota olha para o garoto e diz com um sorriso confiante: “We can definitely do it!” A câmera corta para um close-up do garoto, que responde hesitante: “Are you sure?” A câmera corta para um plano médio da garota, que diz em tom leve: “Yes!” A emoção é brilhante e firme. Balões de fala aparecem ao redor dos personagens que falam, com o respectivo texto dentro.

[Efeito final]

[Material de referência]

Exemplo de prompt do Seedance 2.0

[Prompt]

ReferencieImagem1 ,Imagem2 a imagem da garota em. A garota está em um campo de morangos, colhe um, dá uma mordida e diz sorrindo: “This is the real deal!” Um balão aparece ao redor da garota, com a fala escrita dentro.

Referência de imagem

A série de modelos Seedance 2.0 suporta referências de múltiplas perspectivas do sujeito, bem como referências de múltiplas imagens, como imagens de cena e storyboards.

Durante o uso, se houver requisitos de ordem das imagens, elas devem ser carregadas em ordem . No prompt, use Imagem1 ,Imagem2 ... ImagemN para referência precisa.

Referência de múltiplas perspectivas do sujeito

Basta indicar claramente o objeto de referência. O modelo pode responder a comandos, incluindo, mas não se limitando aos exemplos a seguir.

Produto:

Eletrônicos 3C


[Efeito final]

[Material de referência]

Exemplo de prompt do Seedance 2.0

[Prompt]

Extraia Imagem1 ,Imagem2 ,Imagem3 a câmera, mude o fundo para branco, a câmera está em uma mesa branca. A câmera foca na câmera em close-up e, em seguida, gira lentamente com a câmera como sujeito, mostrando claramente a frente, o lado e a parte de trás da câmera.

Itens domésticos


[Efeito final]

[Material de referência]

Exemplo de prompt do Seedance 2.0

[Prompt]

O fundo é um cenário doméstico em tons quentes. A garrafa térmica da imagem de referência é mostrada em plano médio. A câmera se aproxima suavemente para um close-up da garrafa térmica. Uma mão fora da tela entra naturalmente no quadro, segurando levemente o corpo da garrafa e levantando-a. A câmera acompanha o movimento de rotação suave da mão para exibir.


Personagem:

[Efeito final]

[Prompt]

ReferencieImagem1 ,Imagem2 ,Imagem3 a imagem da mulher em, gere uma cena dela comendo bolo em uma cafeteria.

[Material de referência]

Exemplo de prompt do Seedance 2.0

Referência de múltiplas imagens

Referência de Logo


[Efeito final]

[Material de referência]

Exemplo de prompt do Seedance 2.0

[Prompt]

O fundo é uma passagem aérea futurista de uma cidade com néons piscando, veículos voadores e hologramas publicitários se entrelaçam. Consulte Imagem2 a garota em, primeiro mostre em plano médio a garota soltando uma lanterna flutuante prateada com projeção holográfica, depois a câmera se afasta para mostrar inúmeras lanternas flutuantes no céu. A imagem gradualmente fica desfocada, e então aparece Imagem1 o Logo de. Estilo geral: animação 3D cyberpunk de ficção científica.

Referência de múltiplos sujeitos


[Efeito final]

[Material de referência]

Exemplo de prompt do Seedance 2.0

[Prompt]

Consulte o gato e o cachorro na imagem de referência. Em um apartamento aconchegante, o cachorro está deitado comendo ração. O gato se aproxima, estende a pata e toca o cachorro. O cachorro para de comer ao ver o gato, e o gato se aninha ao lado do cachorro. A cena usa tons quentes.

Referência de múltiplos elementos


[Efeito final]

[Material de referência]

Exemplo de prompt do Seedance 2.0

[Prompt]

A cena se passa em imagem4 o restaurante, com clientes indo e vindo. Imagem1 A garota está vestindo Imagem2 a roupa, organizando itens no balcão. Imagem3 O garoto é um cliente que se aproxima, querendo pedir o contato da garota. imagem5 O logotipo aparece sempre no canto inferior direito da tela.

Referência de storyboard multi-quadro


[Efeito final]

[Material de referência]

Exemplo de prompt do Seedance 2.0

[Prompt]

Consulte o storyboard na imagem de referência para gerar uma cena de luta intensa. Os vários quadros do storyboard na imagem devem aparecer em ordem, seguidos por uma luta feroz entre os dois.

Referência de storyboard


[Efeito final]

[Material de referência]

Exemplo de prompt do Seedance 2.0

[Prompt]

ReferencieImagem3 No storyboard, a menina está esperando o pai terminar de cozinhar. Ela diz: “아빠, 배고파요! 밥 다 됐어요?” A aparência da menina é baseada em Imagem1 . Em seguida, a câmera faz uma panorâmica horizontal para a direita, mudando para imagem4 a composição da cena e do quadro. A aparência do pai é baseada em Imagem2 . O pai responde: “거의 다 됐어, 조금만 기다려!” Em seguida, a câmera corta para um close-up do rosto ligeiramente decepcionado da filha, que diz: “아직 멀었어요? 맛있는 냄새 나는데...” Depois, corta para um close-up do rosto do pai, que diz: “이제 진짜 금방이야. '빨리빨리' 하지 말고 손부터 씻고 와!”

Referência de vídeo

A série de modelos Seedance 2.0 suporta referência de vídeo. Durante o uso, basta indicar claramente o conteúdo a ser gerado e o objeto de referência.

Durante o uso, se houver requisitos de ordem dos vídeos, eles devem ser carregadas em ordem . No prompt, use vídeo1,Vídeo2 ... VídeoN para referência precisa.

Referência de ação

Cinema e TV


[Efeito final]

[Material de referência]

▲ Vídeo 1

Exemplo de prompt do Seedance 2.0

[Prompt]

Referencievídeo1Com os movimentos dos personagens e a linguagem de câmera de, gere Imagem2 e Imagem1 uma cena de luta, sendo Imagem2 o personagem da esquerda e Imagem1 o da direita. Com música de fundo intensa.

Marketing


[Efeito final]

[Material de referência]

▲ Vídeo 1

[Prompt]

Referencievídeo1a forma de corrida do cavalo em, gere um cavalo dourado majestoso correndo na pradaria. Em seguida, congele sua postura de corrida elegante, transformando-o em um pingente de ouro em forma de cavalo.

Referência de movimento de câmera

[Efeito final]

[Prompt]

Referencievídeo1Com a movimentação de câmera de, faça um vídeo conceitual de um parque tecnológico, tendo Imagem1 o prédio alto como centro visual, também em primeira pessoa com mergulho, transmitindo Imagem1 a sensação de tecnologia do parque.

[Material de referência]

▲ Vídeo 1

Exemplo de prompt do Seedance 2.0

▲ Imagem 1

Referência de efeitos especiais

Cinema e TV


[Efeito final]

[Material de referência]

▲ Vídeo 1

Exemplo de prompt do Seedance 2.0

▲ Imagem 1

[Prompt]

Referencievídeo1o efeito de partículas douradas em, faça Imagem2 o personagem em tocar flauta enquanto partículas semelhantes giram ao seu redor.

Efeito especial de jogabilidade


[Efeito final]

[Material de referência]

▲ Vídeo 1

Exemplo de prompt do Seedance 2.0

▲ Imagem 1

[Prompt]

Referencievídeo1 O efeito faz com que Imagem1 a garota ganhe as mesmas asas, com trajetória de geração idêntica.

Edição de vídeo

A série de modelos Seedance 2.0 suporta edição de vídeo, incluindo adicionar, remover ou modificar elementos, estender o vídeo para frente ou para trás e preencher lacunas.

Durante o uso, se houver requisitos de ordem dos vídeos, eles devem ser carregadas em ordem . No prompt, use vídeo1,Vídeo2 ... VídeoN para referência precisa.

Adicionar, remover ou modificar elementos

Adicionar elemento


[Efeito final]

[Material de referência]

▲ Vídeo 1

[Prompt]

Adicione vídeo1petiscos como frango frito e pizza na superfície da mesa em.

Remover elemento


[Efeito final]

[Material de referência]

▲ Vídeo 1

[Prompt]

Limpar vídeo1as outras peças e ferramentas sobre a mesa, mantendo-a limpa e arrumada, com apenas as que estão nas mãos deles.

Modificar elemento


[Efeito final]

[Material de referência]

▲ Vídeo 1

Exemplo de prompt do Seedance 2.0

▲ Imagem 1

[Prompt]

Substitua o perfume em vídeo1pelo creme facial em Imagem1 , mantendo a ação e o movimento da câmera.

Estender vídeo

Aviso
O modelo cortará automaticamente a parte de transição para composição. Os segmentos originais do vídeo de entrada não serão gerados novamente.

Estender para trás


[Efeito final]

[Material de referência]

▲ Vídeo 1

[Prompt]

Gere vídeo1o conteúdo depois. Os dois homens atrasados correm em direção a eles. Os cinco finalmente se encontram e conversam amigavelmente.

Estender para frente


[Efeito final]

[Material de referência]

▲ Vídeo 1

[Prompt]

Estender para frente vídeo1, um plano sobre o ombro do homem de branco. O homem de branco diz: “It’s not that bad. You're just stressed. Everyone goes through this, you just need to keep going.”

Preencher lacunas

Observação
A série de modelos Seedance 2.0 suporta no máximo 3 segmentos de vídeo de entrada, com duração total não superior a 15 segundos.
Durante a geração, as partes de transição do primeiro e último vídeo serão cortadas automaticamente, mantendo apenas os segmentos necessários para a composição.

Exemplo de referência:

[Efeito final]

[Prompt]

vídeo1, no momento em que a folha cai no chão, provoca um efeito de partículas douradas. Uma brisa passa, conectando Vídeo2 .

[Material de referência]

▲ Vídeo 1

▲ Vídeo 2

Guia de Prompts do Seedance 2.0: Fórmulas, Exemplos e Perguntas Frequentes