Guida alla creazione con Seedance 2.0

Da un'ispirazione a un video controllabile

Padroneggia riferimenti multimodali, definizione del soggetto, sequenze di storyboard, movimenti di camera, editing video e tecniche di estensione. La pagina include esempi completi e domande frequenti: guarda, copia e usa subito per generare.

La serie Doubao Seedance 2.0 (di seguito Seedance 2.0) supporta nativamente la generazione congiunta di audio e video, con eccezionale comprensione semantica e capacità di interazione multimodale. Questo articolo illustra l'uso dei prompt per i modelli Seedance 2.0 e le relative tecniche, per aiutarvi a generare video di alta qualità in modo più efficiente.

Nota
Tutti i materiali visivi (immagini, video) e audio presentati in questa guida sono generati autonomamente dai modelli di generazione visiva Seedance/Seedream.

Formula di base

I modelli Seedance 2.0 supportano il riferimento simultaneo a materiali multimodali come video, immagini e audio, consentendo di individuare con precisione caratteristiche come aspetto dei soggetti, effetti di movimento, stile visivo e timbro vocale, riducendo notevolmente la complessità della scrittura dei prompt. Sfruttando questo vantaggio, possiamo guidare il modello con semplici formule di base per generare rapidamente video che soddisfino esigenze specifiche.

La generazione di video con riferimento si suddivide in tre tipi di attività: riferimento multimodale, modifica video e prolungamento video. Scegliete la formula di base del prompt in base al tipo di attività.

Riferimento multimodale

Estrae alcuni elementi dal materiale (es. soggetto, stile, scena, effetti sonori) per generare un video completamente nuovo.

Scenari d'uso: trasferimento di movimento, riutilizzo del soggetto, ispirazione atmosferica, ecc.
Formule consigliate:
Riferimento immagine: Riferimento a <ImmagineN> in <SoggettoN>, genera...
Riferimento video: Riferimento a <VideoN> in <Movimento/Inquadratura/Stile/Effetto sonoro>, genera...
Riferimento audio: Riferimento a <AudioN> con il timbro vocale, genera...

Modifica video

Apporta modifiche parziali o globali al video originale. Le parti non menzionate rimangono invariate per impostazione predefinita.

Scenari d'uso: sostituzione parziale, rimozione del soggetto, modifica degli attributi, ecc.
Formule consigliate:
Aggiunta di elementi: Descrivere chiaramente <Caratteristiche dell'elemento> + <Momento di comparsa> + <Posizione di comparsa>
Modifica di elementi: Modifica rigorosa <VideoN>, sostituendo <Caratteristica originale> con <Nuova caratteristica>
Rimozione di elementi: Specificare l'elemento da rimuovere; per gli elementi che rimangono invariati, enfatizzarli nel prompt per ottenere risultati migliori.

Prolungamento video

Estende il video originale nella dimensione temporale, richiedendo coerenza di stile audio-video, soggetto e narrazione.

Scenari d'uso: continuazione della trama, estensione del movimento, completamento di segmenti, ecc.
Formule consigliate:
Prolungamento video: Prolungamento in avanti/indietro<VideoN>, genera...
Completamento traccia: <Video1> + <Descrizione transizione> + seguito da <Video2> + <Descrizione transizione> + seguito da <Video3>
Nota
Per le attività di modifica/prolungamento video, utilizzare direttamente "<VideoN>" per riferirsi al video; non usare "riferimento <VideoN>" per evitare di essere interpretati erroneamente come attività di riferimento.

Attività combinate

Le tre tipologie di attività sopra menzionate possono essere combinate.

Scenari d'uso: Riferirsi a un materiale per modificarne un altro.
Formule consigliate:
Riferimento a <Immagine/VideoN> in [Dimensione di riferimento], modifica rigorosamente <VideoX>, [Contenuto specifico della modifica]

Formula avanzata

Seedance 2.0 è essenzialmente un regista AI multimodale: legge simultaneamente il prompt testuale, le immagini, i video e l'audio, e li scompone internamente in due dimensioni – "strato spaziale" (cosa c'è nell'inquadratura) e "strato temporale" (come le cose cambiano nel tempo) – per comprendere e generare le scene.

Pertanto, un buon prompt non è una semplice "descrizione testuale", ma un'"istruzione ingegneristica": chi, in quale scena, fa cosa, come si muove la telecamera, in quale sequenza temporale, da inviare rispettivamente allo strato spaziale e a quello temporale. La formula specifica è la seguente:

Formula avanzata del prompt: Soggetto preciso + Dettagli dell'azione + Ambiente della scena + Tonalità di luce e ombra + Movimento della telecamera + Stile visivo + Qualità dell'immagine + Vincoli

In parole semplici, prima si definisce "chi" fa "cosa", poi si specifica "dove" e "che atmosfera", quindi si dice al modello "come riprendere", e infine si restringe il risultato con stile, qualità e vincoli. Di seguito analizziamo ogni elemento in dettaglio.

1 Definire il soggetto

Nei materiali di riferimento reali, un'immagine spesso contiene più soggetti. Per fare riferimento preciso a un oggetto specifico, è necessaria una chiara definizione del soggetto. Il soggetto può essere una persona, un oggetto di scena, una scena, ecc.

Metodo di definizione di base
Formule consigliate: Definisci<Immagine/VideoN> in [Caratteristiche principali del soggetto]definito come<SoggettoN>
Requisiti delle caratteristiche principaliUsa 2-3 caratteristiche statiche chiare e stabili (come abbigliamento, acconciatura, aspetto, categoria) per la descrizione, garantendo l'unica identificabilità.
Esempi:
Sostituisci il profumo inImmagine1La donna con abito rosso e cappello di paglia in è definita comeSoggetto 1
Sostituisci il profumo inImmagine1La donna con abito rosso e cappello di paglia in è definita comeZhang Hong
Stesso soggetto in più materiali

Quando più materiali si riferiscono allo stesso soggetto, devono essere legati in modo uniforme:

Formule consigliate: DefinisciImmagine1 in [...], Immagine2 in [...]definito come **<SoggettoN>**
Scena multi-soggetto

Quando ci sono più soggetti nel video, è necessario definirli separatamente e usarli con etichette. Le etichette devono essere uniche e stabili, e devono essere utilizzate coerentemente nelle descrizioni successive per evitare confusione.

Formule consigliate: Definisci [caratteristiche principali del soggetto 1] in <Immagine/Video N> come <Soggetto 1>, definisci [caratteristiche principali del soggetto 2] in <Immagine/Video N> come <Soggetto 2>...
Esempi: DefinisciVideo1 come poliziotto, e l'altro uomo basso come ladro. Ambientazione: un mercato affollato di giorno, soleggiato, con molte bancarelle di frutta e folla densa, piena di vita di strada.ladroCorre in avanti nel caos tra la folla del mercato, poliziottolo segue da vicino a tutta velocità, i due sfrecciano rapidamente tra le bancarelle. La telecamera segue velocemente in avanti, con un leggero e realistico movimento tremolante, creando un'atmosfera di tensione da inseguimento.
Nota
Ogni volta che si menziona un soggetto, è necessario riferirsi esplicitamente, evitando omissioni. Sono supportati i seguenti due usi:
Per scene semplici senza soggetti predefiniti, ogni volta che si menziona un soggetto, utilizzare <SoggettoN>@<ImmagineN> per enfatizzare il legame tra soggetto e materiale. Ad esempio: Zhang San@Immagine1.
Per scene con soggetti predefiniti in anticipo, ogni volta che si menziona un soggetto, utilizzare la stessa etichetta. Ad esempio: definire l'uomo alto in Video1 come poliziotto, e l'altro uomo basso come ladro. Nelle descrizioni successive, per l'uomo alto continuare a usare "poliziotto", per l'uomo basso continuare a usare "ladro".
Quando si utilizza un Asset ID, è comunque necessario usare <Immagine/VideoN> per riferirsi al soggetto. Poiché il modello non può associare direttamente l'Asset ID al contenuto di riferimento, non sostituire <Immagine/VideoN>.
Mantenere le descrizioni concise, evitando ridondanze e conflitti semantici (es. caratteristiche contraddittorie per lo stesso soggetto).
Si consiglia di esprimere le relazioni spaziali preferibilmente tramite immagini di riferimento, riducendo le descrizioni testuali complesse.

2 Utilizzare la sequenza temporale delle inquadrature

La modellazione interna del modello disaccoppia spazio e tempo. Pertanto, la forma ideale per un prompt video complesso è una suddivisione in inquadrature su una linea temporale: scomporre il video in più inquadrature e descrivere dinamicamente ciascuna inquadratura in ordine di eventi: chi + dove + cosa fa + come si muove la telecamera.

Suggerimenti pratici

Utilizzare l'ordine delle inquadrature: per ogni segmento video, scrivere una semplice suddivisione in "Inquadratura 1 / Inquadratura 2 / Inquadratura 3", quindi unire il tutto in un prompt completo.

Esempio negativo: "Un uomo corre nervosamente per strada, la scena è molto cinematografica."
Esempio positivo:
Inquadratura 1: ripresa laterale in un vicolo, l'uomo inizia a correre lentamente, con un senso di respiro affannoso.
Inquadratura 2: l'uomo urta una bancarella di frutta, la telecamera oscilla rapidamente e si avvicina al volto spaventato dell'uomo in primo piano.
Inquadratura 3: l'uomo scavalca un muretto e scompare, la telecamera si allontana lentamente e si ferma sulla strada vuota.

Regole specifiche

Utilizzare identificatori come Inquadratura1, Inquadratura2, Inquadratura3 per organizzare il contenuto in ordine di eventi (prima il principale, poi il secondario). Non è obbligatorio limitare la durata di ogni segmento; si lascia che il modello generi il ritmo naturalmente in base alla trama.
Spiegazione
Il supporto del modello per tempi precisi (es. 0-3 secondi) è instabile; forzare limiti di durata può causare risultati anomali.
Si consiglia di organizzare ogni inquadratura secondo la seguente logica:
Movimento della telecamera o modalità di transizione: es. "panoramica che si avvicina lentamente", "posizione fissa", "la telecamera passa a...", ecc.
Azione ed espressione del soggetto: descrivere le azioni chiave e i cambiamenti espressivi del personaggio/oggetto principale.
Posizione o cambiamento spaziale: specificare la scena, la posizione o la relazione spaziale del soggetto.
Informazioni audio: descrivere effetti sonori, voci o musica di sottofondo per l'inquadratura corrispondente.

3 Requisiti per la descrizione delle azioni

Dettaglio degli arti + Quantificazione del grado
Le azioni devono essere specifiche per parti del corpo come mani, gambe, testa, spalle e schiena, con l'aggiunta di descrizioni di ampiezza, velocità, intensità;
Esempio: alzare lentamente la mano, girare rapidamente la testa, spingere con forza il piede, abbassare leggermente la testa.
Preferire movimenti piccoli, lenti e continui
Dare priorità a movimenti lenti, delicati e fluidi, evitando per quanto possibile azioni ad alta intensità e grande dinamismo come corse sfrenate, grandi salti o rotolamenti violenti.
Esempio: camminare lentamente, alzare leggermente la mano, abbassare un po' la testa, sedersi con naturalezza
Aggiungere transizioni di azione
Specificare la continuità e la connessione tra le azioni precedenti e successive per garantire movimenti fluidi e naturali.
Esempio: sfruttare lo slancio della rotazione per alzare la mano, passare naturalmente da una pausa ad alzare la mano.
Espressione esterna delle emozioni
Usare dettagli fisici specifici per esprimere le emozioni, sostituendo termini astratti come "molto triste" o "estremamente arrabbiato".
Vedere la tabella seguente per esempi specifici:

Emozione astratta

Esternalizzato in azioni e dettagli

Tristezza

Testa china, spalle che tremano leggermente, occhi arrossati, dita che stringono inconsciamente l'orlo dei vestiti, lacrime che girano negli occhi ma non cadono.

Gioia

Gli angoli della bocca si sollevano incontrollabilmente, sopracciglia e occhi si distendono, il passo diventa leggero, canticchia inconsciamente una canzoncina, non resiste a fare un giro su se stesso.

Tensione / Ansia

Guarda frequentemente l'orologio, tamburella con le dita sul tavolo, respiro affannoso, sguardo sfuggente, si morde le unghie inconsciamente.

Rabbia

Pugni serrati, mascella tesa, petto che si solleva violentemente, sguardo affilato come una lama, parole pronunciate a denti stretti.

Sollievo

Un lungo sospiro di sollievo, le spalle tese si rilassano completamente, un sorriso lieve e inaspettato appare sul volto, alza lo sguardo verso l'orizzonte.

4 Scrittura dei movimenti di telecamera

Il modello ha una forte comprensione dei termini di movimento della telecamera, è sufficiente utilizzare direttamente la terminologia standard, ad esempio "inquadratura media, primo piano, totale, carrellata lenta, panoramica orizzontale stabile, camera fissa".

Nota
Cercare di specificare un solo tipo di movimento per inquadratura; richiedere contemporaneamente zoom, panoramica e carrellata può aumentare l'instabilità dell'immagine.

5 Qualità, stile e vincoli

Qualità, stile e vincoli sono elementi chiave per controllare l'output di generazione video, definendo i confini creativi del modello, uniformando la qualità e la tonalità artistica, evitando difetti visivi e deviazioni casuali. Sono una configurazione necessaria per garantire risultati stabili e conformi.

1 Qualità

Definisce la nitidezza dell'immagine, i dettagli della texture e la qualità di luci e ombre, migliorando la qualità di base del video finale.

Esempi: alta definizione, ricco di dettagli, qualità cinematografica, colori naturali, luci e ombre morbide

2 Stile

Imposta lo stile artistico complessivo e la tonalità visiva, unificando l'atmosfera artistica dell'immagine.

Esempi: cyberpunk con tonalità fredde blu-viola, pellicola vintage, stile giapponese fresco

3 Vincoli

I vincoli sono molto importanti per evitare efficacemente difetti visivi, deformazioni e elementi irragionevoli, delimitando i confini di generazione e la stabilità.

Modelli di vincoli comuni:

Evitare la generazione di sottotitoli: "Mantenere senza sottotitoli", "Evitare di generare qualsiasi testo o sottotitolo"
Evitare la generazione di loghi: "Non generare loghi"
Evitare la generazione di filigrane: "Non generare filigrane"

6 Esempi pratici

Mostra come utilizzare la formula avanzata e i vari elementi sopra descritti per scrivere i prompt.

Esempio 1: Dramma emotivo in dormitorio (più dialoghi / recitazione)

Preparazione del materiale:

@Immagine 1: Foto a mezzo busto della protagonista
@Immagine 2: Immagine di riferimento della scena del dormitorio
@Video 1: Riferimento movimento camera per dialogo interno (zoom medio o leggero pan/tilt)
@Audio 1: Suono ambientale interno o musica leggera

Prompt:

La ragazza in @Immagine 1 come protagonista, @Immagine 2 come riferimento per lo stile della scena del dormitorio, riferimento al movimento della telecamera di @Video 1.

Inquadratura 1: Al tramonto, la ragazza @Immagine 1 cammina con passo leggero fino aall'ingresso del dormitorio @Immagine 2, la telecamera segue in piano medio, la luce gialla calda del tramonto entra nel corridoio dalla finestra, lei si ferma un attimo sulla porta, fa un respiro profondo, espressione leggermente tesa.

Inquadratura 2: la ragazza @Immagine 1 Apre la porta ed entra nel dormitorio, la telecamera passa a un'inquadratura media interna, i compagni di stanza alzano la testa verso di lei mentre sistemano i libri, uno di loro chiede sorridendo {Com'è andata? Passato?}, la telecamera passa lentamente tra di loro in primi piani a mezzo busto.

Inquadratura 3: la ragazza @Immagine 1 Prima abbassa la testa con un'espressione triste, la telecamera le fa un primo piano, poi alza la testa e non riesce a trattenere un sorriso, scoppia a ridere dicendo {Vi ho presi in giro}, i compagni iniziano a rincorrerla scherzando, la telecamera si allontana lentamente, fermandosi su un'inquadratura totale del dormitorio piena di risate e gioia.

Tutta la scena in stile documentaristico cinematografico ad alta definizione, tonalità calde, luce e ombra morbide; il volto del personaggio è stabile e non deformato, i movimenti sono naturali e fluidi, senza scatti o sfarfallii; gli effetti sonori ambientali si fondono naturalmente con @Audio 1.

Esempio 2: Scena di duello in stile antico su un dirupo (più azione / atmosfera)

Preparazione del materiale:

@Immagine 1: Protagonista in rosso
@Immagine 2: Assassino in nero (avversario)
@Immagine 3: Scena di scogliera e bosco di bambù
@Video 1: Riferimento movimento camera per combattimento
@Audio 1: Ritmo incalzante di tamburi o effetti sonori di combattimento

Prompt:

La donna in rosso di @Immagine 1 come protagonista, la donna in nero di @Immagine 2 come avversaria, ambiente di riferimento per la scena della scogliera e bosco di bambù di @Immagine 3, movimento generale e ritmo d'azione di riferimento da @Video 1, effetti sonori di sottofondo sincronizzati con @Audio 1.

Inquadratura 1: Al tramonto, la telecamera parte dala donna in rosso @Immagine 1Inquadratura laterale a mezza figura con lenta carrellata in avanti. Lei è in piedi sul bordo del dirupo, solleva la borraccia per bere. Le vesti ondeggiano dolcemente al vento di montagna. La cinepresa le ruota attorno per mezzo giro, passando dal primo frontale alla schiena. In lontananza, tra il bosco di bambù, si intravede una figura in nero.

Inquadratura 2Dissolvenza con zoom verso un campo lungo. Vista dall'alto con drone sull'intero dirupo e la foresta di bambù. I due si trovano ai lati opposti del dirupo. Il vento solleva lembi di vesti e polvere. Il ritmo accelera leggermente seguendo i colpi di tamburo.

Inquadratura 3Stacco su un primo piano a terra. I due estraggono lentamente le spade e si fronteggiano.Donna in rosso @immagine 1L'espressione passa da distaccata a glaciale.Donna in nero @immagine 2Sguardo fermo, la punta della spada vibra leggermente. La cinepresa segue con movimento fluido i due che ruotano, per poi fermarsi su un primissimo piano un istante prima che le lame si incrocino.

Atmosfera generale da film wuxia in stile 'pioggia e nebbia', tonalità fredda e bassa saturazione, grana cinematografica, ricchi strati di luce e ombra. I volti e le proporzioni dei corpi restano stabili e senza distorsioni. I movimenti sono fluidi e naturali, senza rigidità, senza artefatti o scatti.

Altri suggerimenti

Generazione di testo

I modelli Seedance 2.0 supportano la generazione di testo comune. Il modello può abbinare automaticamente lo stile e il colore appropriati in base al contesto, e supporta anche la specifica di colore, stile, modalità di comparsa, momento e posizione del testo nel prompt. Durante la scrittura, dare priorità all'uso di caratteri comuni, evitando Caratteri rariesimboli speciali, per garantire la migliore resa visiva. Attualmente supporta scenari come slogan, sottotitoli, fumetti, ecc. Per scrittura ed esempi specifici, consultaGenerazione di testo.

Estensione video vs Montaggio segmentato

Piano sequenza continuo (Estensione video): Adatto per 'scene dialogiche' in un unico ambiente, come lunghi dialoghi, progressione emotiva, movimenti su un percorso lineare, per ottenere un effetto immersivo e continuo.
Svolta di scena/azione (Montaggio segmentato): Adatto per colpi di scena o 'scene d'azione' complesse e veloci, come inseguimenti, combattimenti, montaggio, ecc. Si possono generare segmenti indipendenti e poi montarli per garantire ritmo e impatto visivo.

Nella produzione reale si combinano solitamente entrambi i metodi, ad esempio generando prima un dialogo continuo con l'estensione, poi montando inserti o transizioni, bilanciando immersione e variazione ritmica.

Strategia di configurazione dei materiali

Di solito i materiali si dividono in quattro 'ruoli funzionali':

Ancoraggio personaggio: Blocca l'aspetto del personaggio
Impostazione scena: Blocca ambiente e stile
Riferimento movimento macchina: Blocca linguaggio visivo e ritmo d'azione
Atmosfera ritmica: Controlla emozioni e timbro con l'audio

Configurazione consigliata(Totale 4-5 materiali): 1-2 immagini del personaggio (primo piano/figura intera) + 1 immagine di scena + 1 video di movimento macchina + 1 traccia audio.

Spiegazione
Non è consigliato utilizzare il limite massimo di materiali; troppi materiali rendono difficile per il modello determinare le priorità delle caratteristiche, causando conflitti di stile, riconoscimento confuso del soggetto e risultati fuori dalle aspettative.

Note importanti

Norme linguistiche

La lingua dei dialoghi deve essere uniforme, evitando mescolanze cinese-inglese (tranne per nomi propri).

Norme per caratteri speciali

L'uso appropriato di simboli nei prompt aiuta il modello a comprendere accuratamente diversi tipi di informazione:

Tipo di informazione

Simbolo

Esempi

Musica

()

(In sottofondo suona rock veloce)

Effetto sonoro

<>

<In lontananza si sente un cane abbaiare>

Battuta

{}

{Ciao, mondo}. Se la battuta è in una lingua minoritaria (non cinese o inglese), indicare la lingua, ad esempio: dire in giapponese {こんにちは}.

Sottotitoli

【】

【Capitolo 1: Partenza】

Problemi comuni

Deriva dell'identità del personaggio

Fenomeno tipico

L'aspetto del personaggio generato non corrisponde all'immagine di riferimento, o si verifica un 'cambio volto' (deriva ID) a metà video, causando il blocco della revisione per somiglianza con celebrità.

Analisi delle cause

Efficacia insufficiente dell'immagine di riferimento del volto

Mescolanza di immagini di riferimentoCombinare l'immagine di riferimento del volto con immagini di posa intera/mezza figura, riferimenti di abbigliamento, dettagli, ecc., in un'unica immagine fornita al modello.
Proporzione del volto troppo piccolaNelle immagini di riferimento miste, l'area del volto è troppo piccola rispetto all'intera immagine, quindi il modello non assegna peso sufficiente all'estrazione delle caratteristiche facciali, venendo facilmente disturbato dallo sfondo o da altri elementi.

Soluzioni

Rafforzare l'indipendenza e il peso del riferimento facciale:

Preparare un primo piano del voltoOltre alla foto a figura intera, preparare un'immagine aggiuntivacon solo la testa del personaggio in primo piano (ritratto ravvicinato, solo il viso, preferibilmente senza espressione, riducendo al minimo spalle, collo, sfondo e altri elementi di disturbo). (Primo piano, solo il viso, meglio senza espressione, ridurre al minimo spalle, collo e sfondo).
Definizione chiara del soggetto nel promptLe caratteristiche facciali di <Soggetto1> fanno riferimento all'immagine 1 (primo piano), il trucco e l'abbigliamento fanno riferimento all'immagine 2 (figura intera).
Materiali importanti in primo pianoPiù un materiale necessita diriferimento preciso, più va posizionatoall'iniziodel prompt.
Nota
Per il riferimento del personaggio è sufficiente usare primo piano + figura intera,non è consigliato usare viste multiple del personaggio. I materiali con viste multiple includono diverse angolazioni dello stesso personaggio, e il modello potrebbe identificarli come soggetti diversi, aggravando il problema della deriva ID.

Prima dell'ottimizzazione

Dopo l'ottimizzazione

Nel video il volto del personaggio cambia a metà, somigliando a una celebrità.

Il volto rimane coerente con l'immagine di riferimento per tutta la durata.

Video contenente sottotitoli

Fenomeno tipico

Il prompt non richiede la generazione di sottotitoli, ma il video generato ne contiene.

Soluzioni

Spiegazione
Attualmente non è possibile evitare al 100% la generazione di sottotitoli; si può solo ridurre la probabilità e migliorare il tasso di successo con i seguenti metodi.
Aggiungere istruzioni chiare nel prompt: 'Mantieni senza sottotitoli', 'Evita di generare testo o sottotitoli'.
Se il testo nelle immagini/video di riferimento non è informazione necessaria, si consiglia di rimuoverlo prima con strumenti (es. capacità di modifica immagine/video di Seedream/Seedance), quindi utilizzare materiali senza testo come input.
Se il business lo consente, scegliere preferibilmente la proporzione orizzontale per generare video (la probabilità di generare sottotitoli in orizzontale è significativamente inferiore rispetto al verticale); successivamente si può ritagliare in verticale con software di editing.

Video con Logo / Watermark

Fenomeno tipico

Il prompt non menziona watermark, ma il video generato contiene Logo/Watermark di altre piattaforme video.

Soluzioni

Aggiungere istruzioni chiare nel prompt: 'Non generare watermark', 'Non generare Logo'.

Deriva di stile

Fenomeno tipico

Si desidera generare uno stile anime 2D o 3D, ma lo stile dell'immagine di riferimento è realistico e il prompt non enfatizza lo stile del video; il video generato potrebbe derivare verso uno stile realistico.

Soluzioni

Aggiungere termini chiari di vincolo di stile nel prompt, ad esempio 'Stile anime 2D giapponese', 'Fumetto cinese 3D'. Per un controllo più preciso, si consiglia di trasformare prima l'immagine di riferimento nello stile desiderato e poi generare il video.

Prima dell'ottimizzazione

Dopo l'ottimizzazione

Lo stile wuxia si è spostato verso uno stile realistico.

Mantieni lo stile 3D cinese anime CG wuxia.

Salto nella giunzione del video esteso

Fenomeno tipico

Dopo aver generato un nuovo video con la funzione di estensione, unendolo al video originale, potrebbero verificarsi salti o regressioni dell'immagine nella giunzione.

Soluzioni

Attualmente si consiglia di riparare tramite montaggio in post-produzione, allineando i fotogrammi chiave; in futuro si farà affidamento sugli aggiornamenti del modello per un'ottimizzazione radicale.

Importare i video da unire in CapCut o altro software di editing video professionale.
Nella prima giunzione, eliminare6 fotogrammi dalla fine del primo video.
e contemporaneamente eliminare1 fotogramma dall'inizio del secondo video.
Ripetere l'operazione per tutti i punti di giunzione.
Esportare e controllare la fluidità del video unito.
Spiegazione
Dopo l'allineamento dei fotogrammi, potrebbero ancora esserci lievi salti; si consiglia di terminare la generazione del video esteso in corrispondenza di un taglio di transizione, e iniziare il video successivo con la nuova scena dopo il taglio.

Prima dell'ottimizzazione

Dopo l'ottimizzazione

Alle transizioni (5s, 20s) appareSalto improvviso dell'inquadraturaoRitorno di contenuto

Le transizioni sono più fluide.

Problema dei gemelli

Fenomeno tipico

In scene con molti personaggi e utilizzando viste multiple come materiale di riferimento, è facile che nella stessa scena appaiano due personaggi identici.

Analisi delle cause

La definizione del soggetto nel prompt non è chiara, il modello non riesce a distinguere accuratamente i diversi personaggi;
Usare viste multiple/triple come materiale di riferimento può facilmente confondere il modello nel riconoscimento dei personaggi, generando così personaggi duplicati identici.

Soluzioni

Spiegazione
Attualmente non è possibile evitare al 100% il problema dei gemelli; si può solo ridurre la probabilità e migliorare il tasso di successo con i seguenti metodi.
Definire chiaramente l'associazione del soggetto

Nel prompt, definire chiaramente ogni personaggio e la corrispondenza con l'immagine di riferimento. Si consiglia di annotare l'immagine di riferimento dopo il nome del personaggio, mantenendo un formato uniforme.

Esempio: Zhang San (corrisponde all'immagine 1) lancia il libretto di risparmio verde verso Li Si in piedi (corrisponde all'immagine 2).

2. Aggiungere istruzioni di vincolo globale

Alla fine del prompt, aggiungere un vincolo fisso:È vietato che appaiano personaggi con aspetto, abbigliamento e accessori completamente identici durante tutto il video; è vietato generare cloni o effetti gemelli; nella stessa scena deve apparire solo il singolo personaggio corrispondente, senza repliche..

3. Ottimizzare i materiali di riferimento

Per i riferimenti del personaggio, utilizzare preferibilmente foto singole e indipendenti; non è consigliato usare viste multiple o triple.

4. Semplificare e ottimizzare il prompt

Non utilizzare direttamente l'intera sceneggiatura come prompt; un contenuto eccessivamente ridondante può confondere il modello. È necessario eliminare le descrizioni irrilevanti e garantire che le istruzioni siano chiare e mirate.

Prima dell'ottimizzazione

Dopo l'ottimizzazione

Al secondo 8 dell'inquadratura appare 'gemelli'.

Degrado della qualità nell'estensione video

Fenomeno tipico

Quando si utilizza un video generato dal modello come materiale di input per l'estensione, si verifica un degrado della qualità. Estensioni multiple accumulano il degrado, specialmente nell'area del volto del personaggio, dove possono apparire macchie di colore.

Soluzioni

Attualmente è possibile mitigare il degrado della qualità con i seguenti metodi; in futuro si farà affidamento sugli aggiornamenti del modello per un'ottimizzazione radicale:

Convertire il video originale in un video a modello bianco tramite Seedance 2.0, quindi utilizzarlo come materiale di input per l'estensione.
Prompt di riferimento: Converti il video in un modello 3D bianco, i personaggi sono modelli 3D bianco puro, senza colore, texture, ombre, sfondo bianco puro, struttura stabile, movimento fluido.
Utilizzare preferibilmente immagini ad alta definizione come materiali di riferimento.
Controllare ragionevolmente il numero di estensioni video, evitando estensioni multiple accumulate.

Prima dell'ottimizzazione

Dopo l'ottimizzazione

Continua direttamente la scrittura del prodotto del modello.

Converti il prodotto del modello in un video a modello bianco prima di continuare la scrittura.

Effetti speciali non conformi alle aspettative

Fenomeno tipico

Quando si descrivono effetti speciali specifici tramite testo nel prompt, potrebbe verificarsi che l'effetto non corrisponda alle aspettative. Ad esempio: il prompt specifica 'Il numero "2999" appare con un'animazione di conto alla rovescia', ma l'effetto di scorrimento numerico generato presenta salti disordinati, non conformi alla logica standard del conto alla rovescia.

Soluzioni

Si consiglia di utilizzare unvideo di riferimentoper definire l'effetto speciale: inserire il video dell'effetto desiderato come materiale di riferimento nel modello, permettendogli di comprendere con precisione la forma e la logica di movimento dell'effetto, ottenendo risultati più vicini alle aspettative. Ad esempio: il modo di apparizione del numero "2999" fa riferimento al video 1.

Prima dell'ottimizzazione

Dopo l'ottimizzazione

L'effetto di scorrimento numerico ha un evidente salto disordinato.

Aggiungendo il corretto effetto video di scorrimento numerico, il risultato è conforme alle aspettative.

Animazione di effetti speciali

Numero eccessivo di personaggi di riferimento

Fenomeno tipico

Quando il numero di personaggi di riferimento supera 4, la stabilità dell'output del modello diminuisce; il video generato potrebbe presentare un numero errato di personaggi (es. meno o più del previsto) o personaggi duplicati.

Soluzioni

Attualmente è possibile mitigare con i seguenti metodi; in futuro si farà affidamento sugli aggiornamenti del modello per un'ottimizzazione radicale:

Generare immagini in fasiRaggruppare i personaggi, assicurandosi che ogni gruppo generato non superi 4 persone. Ad esempio, 6 persone possono essere divise in 2 gruppi da 3, generando immagini separatamente.
Generare video dalle immaginiUtilizzare le immagini di gruppo generate nel primo passo come materiali di riferimento, quindi generare il video finale.

Prima dell'ottimizzazione

Dopo l'ottimizzazione

Inseriti 8 personaggi di riferimento, nel video ne compaiono 9.

Genera 2 immagini con gli 8 personaggi, poi usa 'immagine a video'.

Rumore alla fine del video

Fenomeno tipico

Quando il video include una voce fuori campo, è facile che alla fine si sentano scatti improvvisi o rumori di interruzione.

Soluzioni

Rigenerare il video, o utilizzare strumenti di editing come CapCut per applicare unfade out audiosulla traccia audio finale tramite l'inviluppo del volume, eliminando il rumore di interruzione.

Procedura dettagliata (usando CapCut):

Importare il video generato in CapCut.
Sulla timeline, selezionare la traccia video, cliccare suAudio.
nella barra degli strumenti, selezionarefade out audiola funzione (in alcune versioni si trova nel menu Base/Regolazione), e scegliere un punto chiave. Sulla traccia audio apparirà una linea che rappresenta il volume e i punti chiave.
Verso la fine del video, abbassa il punto di volume finale a 0, creando una rampa discendente.
Esempio di prompt Seedance 2.0
Anteprima per confermare che l'audio in coda svanisca naturalmente, senza tagli improvvisi o rumori.

Prima dell'ottimizzazione

Dopo l'ottimizzazione

Rumore alla fine.

Nessun rumore alla fine.

Pronuncia cinese imprecisa

Fenomeno tipico

Il modello tende a sbagliare la pronuncia di caratteri polifonici, rari o simili nella forma.

Soluzioni

Sostituisci i caratteri facilmente errati conomofoni comuni dalla stessa pronunciaper evitare deviazioni fonetiche e ripristinare l'effetto audio desiderato. Nota: questa soluzione è solo un ottimizzazione, non può eliminare completamente tutti i problemi di pronuncia.

Esempio: riscrivi 'Montagna Chīlóng' nel prompt come 'Montagna Chīlóng' con omofoni.

Prima dell'ottimizzazione

Dopo l'ottimizzazione

La pronuncia di '螭' in '螭龙山' è sbagliata.

Correggendo in '吃龙山' la pronuncia è corretta.

Riferimento timbrico impreciso

Fenomeno tipico

Quando si usa un audio di riferimento per specificare il timbro, l'audio finale del video generato presenta una deviazione evidente dal timbro di riferimento.

Soluzioni

Mantenere lo stile delle battute del video simile al tono e all'espressione dell'audio di riferimento aiuta a migliorare la fedeltà e la stabilità del timbro.

Prima dell'ottimizzazione

Dopo l'ottimizzazione

Il timbro non corrisponde all'audio di input.

Esempio di prompt Seedance 2.0

Audio di input

Aggiungendo la descrizione del timbro vocale nel prompt, la corrispondenza timbrica migliora notevolmente.

'Usa @audio1 voce maschile di mezza età, grave, calda, con granulosità fine, per dire'

Appendice: Esempi di prompt

Mostra esempi di prompt per l'uso dei modelli della serie Seedance 2.0 in diversi scenari, aiutandoti a ottenere un controllo più preciso del riferimento multimodale e delle funzionalità di generazione del testo.

Generazione di testo

Slogan pubblicitario

Modello di prompt di riferimento:

«Contenuto del testo» + «Momento di apparizione» + «Posizione di apparizione» + «Modalità di apparizione», «Caratteristiche del testo (colore, stile)»
Spiegazione
Seedance2.0 può abbinare stili di testo appropriati in base al contesto. Se hai requisiti rigorosi per l'effetto del testo, consulta la sezioneRiferimento multi-immagine > Riferimento logo.

Esempio di riferimento:

[Risultato finale]

[Prompt]

Stile fumetto disegnato a mano, tre persone sedute insieme mangianoImmagine1il pollo fritto in, atmosfera amichevole e piacevole, poi l'immagine diventa gradualmente sfocata, al centro appare il testo 'Felicità in Seedance'.

[Materiale di riferimento]

Esempio di prompt Seedance 2.0

▲ Immagine 1

Sottotitoli

Modello di prompt di riferimento:

Nella parte inferiore dello schermo compaiono i sottotitoli con il testo '...', perfettamente sincronizzati con il ritmo dell'audio.

Esempio di riferimento:

[Risultato finale]

[Materiale di riferimento]

Esempio di prompt Seedance 2.0

[Prompt]

Genera un video con voce fuori campo. Una voce maschile profonda e calma dice: 'Nel vasto universo, il nostro mondo è solo un istante fugace. Eppure, al suo interno, la vita fiorisce con ostinazione.' La scena passa lentamente dalla notte all'alba, le stelle svaniscono gradualmente e il sole sorge dietro la montagna. In basso compaiono i sottotitoli in sincrono con le battute.

[Risultato finale]

[Materiale di riferimento]

Esempio di prompt Seedance 2.0

[Prompt]

Le due persone nell'immagine chiacchierano in ufficio. La donna parla per prima: 'Arrivi sempre all'ultimo minuto, ti piace questa sensazione di essere giusto in tempo?' L'uomo risponde sorridendo: 'Ho il mio ritmo.' Il dialogo è spontaneo e naturale. In basso compaiono i sottotitoli corrispondenti.

Fumetti di dialogo

Modello di prompt di riferimento:

«Personaggio» dice: “...”, mentre parla, intorno al personaggio appare un fumetto con il dialogo scritto.

Esempio di riferimento:

[Risultato finale]

[Materiale di riferimento]

Esempio di prompt Seedance 2.0

[Prompt]

Immagine1I due in indossano tute sportive e corrono sulla pista della scuola. La ragazza guarda il ragazzo e dice con sicurezza sorridendo: 'We can definitely do it!' Stacco sul primo piano del ragazzo, che risponde esitante: 'Are you sure?' Stacco sul mezzo primo della ragazza, che dice con tono leggero: 'Yes!' L'emozione è luminosa e decisa. Intorno ai personaggi che parlano compaiono fumetti con il testo corrispondente.

[Risultato finale]

[Materiale di riferimento]

Esempio di prompt Seedance 2.0

[Prompt]

Riferimento a Immagine1, Immagine2l'immagine della ragazza in, la ragazza in un campo di fragole, ne coglie una, la assaggia e dice sorridendo: “This is the real deal! ” Intorno alla ragazza appare un fumetto con il dialogo scritto.

Riferimento immagine

I modelli Seedance 2.0 supportano sia riferimenti multi-prospettiva del soggetto, sia riferimenti multi-immagine come scene e storyboard.

Durante l'uso, se l'ordine delle immagini è importante, caricalein ordine. Nel prompt, puoi usareImmagine1, Immagine2...ImmagineNper riferimenti precisi.

Riferimento multi-prospettiva del soggetto

Basta indicare chiaramente l'oggetto di riferimento; il modello può rispondere a comandi inclusi, ma non limitati, agli esempi seguenti.

Prodotto:

Elettronica 3C


[Risultato finale]

[Materiale di riferimento]

Esempio di prompt Seedance 2.0

[Prompt]

Estrai la fotocamera daImmagine1, Immagine2, Immagine3, cambia lo sfondo in bianco, la fotocamera è su un tavolo bianco, la telecamera si concentra sulla fotocamera in primo piano, poi ruota lentamente con la fotocamera come soggetto, mostrando chiaramente il fronte, il lato e il retro.

Oggetti per la casa


[Risultato finale]

[Materiale di riferimento]

Esempio di prompt Seedance 2.0

[Prompt]

Sfondo domestico dai toni caldi, inquadratura media del thermos nell'immagine di riferimento, la telecamera si avvicina lentamente al thermos in primo piano, una mano fuori campo entra naturalmente nell'inquadratura, afferra delicatamente il thermos e lo solleva, la telecamera segue il leggero movimento rotatorio della mano per mostrarlo.


Personaggio:

[Risultato finale]

[Prompt]

Riferimento a Immagine1, Immagine2, Immagine3l'immagine della donna in, genera una scena in cui mangia una torta in un bar.

[Materiale di riferimento]

Esempio di prompt Seedance 2.0

Riferimento multi-immagine

Riferimento logo


[Risultato finale]

[Materiale di riferimento]

Esempio di prompt Seedance 2.0

[Prompt]

Sfondo di un corridoio aereo futuristico con luci al neon, veicoli volanti e ologrammi pubblicitari intrecciati, riferimento aImmagine2la ragazza in, prima inquadratura media della ragazza che rilascia una lanterna sospesa argentata con ologramma, poi la telecamera si allontana per mostrare le lanterne sospese che riempiono il cielo, l'immagine diventa gradualmente sfocata, poi appareImmagine1il logo di, stile generale 3D cyberpunk sci-fi animation.

Riferimento multi-soggetto


[Risultato finale]

[Materiale di riferimento]

Esempio di prompt Seedance 2.0

[Prompt]

Riferimento all'immagine del gatto e del cane, in un appartamento accogliente, il cane mangia crocchette chinato, il gatto si avvicina, allunga una zampa e tocca il cane, il cane smette di mangiare quando vede il gatto, il gatto si accoccola accanto al cane. Tonalità calde.

Riferimento multi-elemento


[Risultato finale]

[Materiale di riferimento]

Esempio di prompt Seedance 2.0

[Prompt]

La scena è ambientata inimmagine4Il ristorante in è affollato.Immagine1La ragazza di indossaImmagine2I vestiti di mentre sistema gli oggetti sul bancone.Immagine3Il ragazzo di è un cliente che si avvicina per chiederle il contatto.immagine5Il logo in rimane sempre visibile nell'angolo in basso a destra dell'inquadratura.

Riferimento storyboard multi-vignetta


[Risultato finale]

[Materiale di riferimento]

Esempio di prompt Seedance 2.0

[Prompt]

Riferimento allo storyboard nell'immagine, genera una scena di combattimento intenso. Le varie vignette dello storyboard devono apparire in ordine, poi i due combattono ferocemente.

Riferimento per lo storyboard


[Risultato finale]

[Materiale di riferimento]

Esempio di prompt Seedance 2.0

[Prompt]

Riferimento a Immagine3La composizione dello storyboard mostra una bambina che aspetta che il papà finisca di cucinare. Lei dice: '아빠, 배고파요! 밥 다 됐어요?' Il look della bambina è ispirato aImmagine1Poi la cinepresa esegue una panoramica orizzontale verso destra, passando aimmagine4La composizione dell'inquadratura e il look del papà sono ispirati aImmagine2Il papà risponde: '거의 다 됐어, 조금만 기다려!' Poi stacco sul primo piano del volto della bambina, con espressione leggermente delusa, e lei dice: '아직 멀었어요? 맛있는 냄새 나는데...' Poi stacco sul primo piano del papà, che dice: '이제 진짜 금방이야. '빨리빨리' 하지 말고 손부터 씻고 와!'

Riferimento video

I modelli Seedance 2.0 supportano il riferimento video. Durante l'uso, basta indicare chiaramente il contenuto da generare e l'oggetto di riferimento.

Durante l'uso, se l'ordine dei video è importante, caricaliin ordine. Nel prompt, puoi usareVideo1, Video2...VideoNper riferimenti precisi.

Riferimento movimento

Cinema e TV


[Risultato finale]

[Materiale di riferimento]

▲ Video 1

Esempio di prompt Seedance 2.0

[Prompt]

Riferimento a Video1Con i movimenti e il linguaggio visivo di, generaImmagine2eImmagine1La scena di combattimento tra, doveImmagine2è il personaggio a sinistra eImmagine1quello a destra. Con musica di sottofondo intensa.

Marketing


[Risultato finale]

[Materiale di riferimento]

▲ Video 1

[Prompt]

Riferimento a Video1la forma di corsa del cavallo in, genera un cavallo dorato che corre nella prateria, poi congela la sua posa elegante, trasformandolo in un ciondolo d'oro a forma di cavallo.

Riferimento movimento camera

[Risultato finale]

[Prompt]

Riferimento a Video1Con l'inquadratura di, realizza un concept video per un parco tecnologico, conImmagine1Il grattacielo di come centro visivo, in prima persona con picchiata, per evidenziareImmagine1La sensazione tecnologica del parco in.

[Materiale di riferimento]

▲ Video 1

Esempio di prompt Seedance 2.0

▲ Immagine 1

Riferimento effetti speciali

Cinema e TV


[Risultato finale]

[Materiale di riferimento]

▲ Video 1

Esempio di prompt Seedance 2.0

▲ Immagine 1

[Prompt]

Riferimento a Video1l'effetto particellare dorato in, lascia cheImmagine2il personaggio in suoni il flauto mentre intorno a lui si diffonde lo stesso effetto particellare.

Effetto speciale di gameplay


[Risultato finale]

[Materiale di riferimento]

▲ Video 1

Esempio di prompt Seedance 2.0

▲ Immagine 1

[Prompt]

Riferimento a Video1L'effetto speciale fa sì cheImmagine1La ragazza in sviluppi le stesse ali, con traiettoria di generazione identica.

Montaggio video

I modelli Seedance 2.0 supportano il montaggio video, inclusa l'aggiunta, la rimozione o la modifica di elementi, l'estensione del video in avanti o indietro e il riempimento delle tracce.

Durante l'uso, se l'ordine dei video è importante, caricaliin ordine. Nel prompt, puoi usareVideo1, Video2...VideoNper riferimenti precisi.

Aggiunta/rimozione/modifica elementi

Aggiunta di elementi


[Risultato finale]

[Materiale di riferimento]

▲ Video 1

[Prompt]

Sul piano di lavoro diVideo1aggiungi snack come pollo fritto e pizza.

Rimozione di elementi


[Risultato finale]

[Materiale di riferimento]

▲ Video 1

[Prompt]

RimuoviVideo1Gli altri utensili e strumenti dal tavolo, mantieni la scrivania pulita e ordinata, con solo quelli che hanno in mano.

Modifica di elementi


[Risultato finale]

[Materiale di riferimento]

▲ Video 1

Esempio di prompt Seedance 2.0

▲ Immagine 1

[Prompt]

Sostituisci il profumo inVideo1con la crema inImmagine1, mantenendo azione e movimento della telecamera invariati.

Estensione video

Nota
Il modello taglierà automaticamente la parte di transizione per la composizione; i segmenti originali del video di input non verranno rigenerati.

Estensione all'indietro


[Risultato finale]

[Materiale di riferimento]

▲ Video 1

[Prompt]

GeneraVideo1il contenuto successivo, i due uomini in ritardo corrono verso di loro, i cinque finalmente si incontrano e chiacchierano amichevolmente.

Estensione in avanti


[Risultato finale]

[Materiale di riferimento]

▲ Video 1

[Prompt]

Estensione in avantiVideo1, inquadratura oltre la spalla dell'uomo in bianco, l'uomo in bianco dice: “It’s not that bad. You're just stressed. Everyone goes through this, you just need to keep going.”

Riempimento tracce

Spiegazione
I modelli Seedance 2.0 supportano fino a 3 segmenti video in input, con una durata totale non superiore a 15 secondi.
Durante la generazione, verranno automaticamente tagliate le parti di transizione tra il primo e l'ultimo video, mantenendo solo i segmenti necessari per la composizione.

Esempio di riferimento:

[Risultato finale]

[Prompt]

Video1, nel momento in cui la foglia cade a terra, si innescano effetti speciali di particelle dorate, una folata di vento passa, poiVideo2.

[Materiale di riferimento]

▲ Video 1

▲ Video 2

Guida ai prompt di Seedance 2.0: formule, esempi e domande frequenti