Seedance 2.0 Руководство по созданию

От одной идеи до управляемого видео

Освойте мультимодальные референсы, определение субъекта, временную раскадровку, движения камеры, редактирование видео и техники продления. На странице собраны полные примеры и частые вопросы — копируйте и сразу используйте для генерации.

Модели серии Doubao Seedance 2.0 (далее — Seedance 2.0) изначально поддерживают совместную генерацию аудио и видео, обладая выдающимся пониманием семантики и способностями к мультимодальному взаимодействию. В этой статье описываются методы и советы по использованию промптов для моделей Seedance 2.0, которые помогут вам эффективно создавать качественные видеоролики, соответствующие вашим потребностям.

Примечание
Все визуальные (изображения, видео) и аудиоматериалы, представленные в этом руководстве, созданы самостоятельно моделями визуальной генерации серии Seedance/Seedream.

Базовая формула

Модели серии Seedance 2.0 поддерживают одновременную ссылку на мультимодальные материалы, такие как видео, изображения и аудио, что позволяет точно фиксировать такие характеристики, как внешность персонажа, спецэффекты, визуальный стиль и тембр голоса, значительно снижая порог написания промптов. Основываясь на этом преимуществе, мы можем использовать простую базовую формулу для направления модели, используя особенности мультимодальных материалов, чтобы быстро создавать видео, отвечающие конкретным требованиям.

Создание видео по референсам можно разделить на три типа задач: мультимодальные референсы, редактирование видео и продление видео. Вы можете выбрать базовую формулу промпта в зависимости от типа задачи.

Мультимодальные референсы

Извлечение некоторых элементов из материала (например, субъекта, стиля, сцены, звуковых эффектов) для создания совершенно нового видео.

Сценарии применения: перенос движений, повторное использование субъекта, заимствование атмосферы и т.д.
Рекомендуемые конструкции:
Ссылка на изображение: ссылаясь на<ИзображениеN>из<СубъектN>, сгенерировать...
Ссылка на видео: ссылаясь на<ВидеоN>из<Движение/Оператор/Стиль/Звук>, сгенерировать...
Ссылка на аудио: ссылаясь на<АудиоN>тембр из, сгенерировать...

Редактирование видео

Внесение частичных или глобальных изменений в исходное видео. Неупомянутые части по умолчанию остаются без изменений.

Сценарии применения: локальная замена, удаление субъекта, изменение атрибутов и т.д.
Рекомендуемые конструкции:
Добавление элемента: четко опишите<Характеристики элемента> + <Время появления> + <Место появления>
Изменение элемента: строго отредактируйте<ВидеоN>, заменив в нем<Исходная характеристика> на <Новая характеристика>
Удаление элемента: укажите элемент, который нужно удалить. Для элементов, которые остаются без изменений, лучше подчеркнуть их в промпте для лучшего результата.

Продление видео

Продолжение исходного видео во временном измерении с сохранением стиля аудио и видео, субъекта и повествования.

Сценарии применения: продолжение сюжета, продление действия, дополнение фрагментов и т.д.
Рекомендуемые конструкции:
Продление видео: продление вперед/назад<ВидеоN>, сгенерировать...
Заполнение трека:<Видео1> + <Описание переходной сцены> + затем <Видео2> + <Описание переходной сцены> + затем <Видео3>
Примечание
Для задач редактирования/продления видео используйте напрямую «<ВидеоN>» для обозначения видео, не используйте «ссылаться на<ВидеоN>», чтобы избежать ошибочной интерпретации как задачи с референсом.

Комбинированные задачи

Вышеуказанные 3 типа задач также поддерживают комбинированное использование.

Сценарии применения: ссылаться на один материал, редактировать другой материал.
Рекомендуемые конструкции:
Ссылаясь на<Изображение/ВидеоN>из[Измерение референса], строго отредактируйте<ВидеоX>,[Конкретное содержание редактирования]

Продвинутая формула

По своей сути Seedance 2.0 — это мультимодальный AI-режиссер: он одновременно считывает ваши текстовые промпты, изображения, видео и аудио, а затем внутренне разбивает их на два измерения — «пространственный слой» (что находится в кадре) и «временной слой» (как события меняются со временем) — для понимания и генерации изображения.

Поэтому хороший промпт — это не просто «текстовое описание», а «инженерная инструкция»: кто, в какой сцене, какое действие выполняет, как движется камера, в какой временной последовательности это происходит — все это направляется соответственно в пространственный и временной слои. Конкретная формула выглядит следующим образом:

Продвинутая формула подсказки: точный объект + детали действия + окружение сцены + свет и цвет + движение камеры + визуальный стиль + качество + ограничения

Проще говоря, сначала определите «кто» и «что делает», затем укажите «где» и «какая атмосфера», после чего сообщите модели «как снимать» и, наконец, используйте стиль, качество и ограничения для уточнения результата. Ниже подробно разбираются каждый элемент.

1 Определение субъекта

В реальных референсных материалах, особенно на одном изображении, часто присутствует несколько субъектов. Для точного обращения к конкретному объекту в материале необходимо четкое определение субъекта. Субъектом может быть персонаж, реквизит, сцена и т.д.

Базовый способ определения
Рекомендуемые конструкции: Определите <Изображение/ВидеоN>изСоздать сцену боя междуи<СубъектN>
где— персонаж слева, а
Примеры:
Замените духи из изображение1 — персонаж справа. С энергичной фоновой музыкой. Двое из
Замените духи из изображение1 — персонаж справа. С энергичной фоновой музыкой. В спортивных костюмах бегут по школьному стадиону. Девушка смотрит на парня и уверенно улыбается: «We can definitely do it!» Камера переключается на крупный план парня, он отвечает с колебанием: «Are you sure?» Камера возвращается к среднему плану девушки, она говорит бодрым тоном: «Yes!» Настроение светлое и решительное. У говорящих персонажей появляются облачка с соответствующими репликами.
Один объект из нескольких материалов

Когда объекты из разных материалов относятся к одному и тому же субъекту, их следует объединить:

Рекомендуемые конструкции: Определите изображение1 из[...] ,изображение2 из[...] определить как ** <СубъектN>**
Сцена с несколькими объектами

Если в видео несколько объектов, их нужно определить отдельно и различать с помощью тегов. Теги должны быть уникальными и стабильными, в последующих описаниях используйте соответствующие теги, чтобы избежать путаницы.

Рекомендуемые конструкции: Определите [основные характеристики объекта1] из <изображение/видеоN> как <объект1>, [основные характеристики объекта2] из <изображение/видеоN> как <объект2>...
Примеры: Определите видео1 какполицейский, а другого низкого мужчину каквор. Сцена: оживленный дневной рынок, яркое солнце, множество фруктовых лотков и плотная толпа, атмосфера уличной жизни. ворв панике бежит вперед сквозь толпу на рынке, полицейскийпреследует ее вплотную на полной скорости, они быстро лавируют между лотками. Ручная камера быстро движется вперед, с легкой естественной тряской, создавая напряженную атмосферу погони.
Примечание
При каждом упоминании субъекта необходимо четко указывать на него, избегая пропусков. Поддерживаются следующие два способа использования:
Для простых сцен без предварительно определенных субъектов при каждом упоминании субъекта используйте<СубъектN>@<ИзображениеN>, подчеркивая привязку субъекта к материалу. Например: Чжан Сань@изображение1.
Для сцен с предварительно определенными субъектами при каждом упоминании субъекта следует использовать один и тот же тег. Например: определите высокого мужчину извидео1 какполицейский, а другого низкого мужчину каквор. В последующих описаниях, касающихся высокого мужчины, последовательно используйте «полицейский», а касающихся низкого мужчины — «вор».
При использовании библиотеки материалов (Asset ID) все равно необходимо использовать<Изображение/ВидеоN>для обозначения субъекта. Поскольку модель не может напрямую связать Asset ID с референсным содержимым, нельзя напрямую заменять<Изображение/ВидеоN>.
Старайтесь делать описание кратким, избегайте избыточности и семантических конфликтов (например, противоречивых характеристик одного и того же субъекта).
Пространственные отношения рекомендуется в первую очередь выражать через референсные изображения, уменьшая количество сложных текстовых описаний.

2 Использование временной последовательности кадров

Внутреннее моделирование модели разделяет пространство и время. Поэтому идеальная форма промпта для сложного видео — это раскадровка по временной шкале: разбейте видео на несколько кадров и динамически описывайте каждый кадр в порядке возникновения событий: кто + где + что делает + как движется камера.

Практические рекомендации

Используйте порядок кадров: для каждого сегмента видео напишите простую раскадровку «Кадр 1 / Кадр 2 / Кадр 3», а затем объедините их в полный промпт.

Негативный пример«Мужчина напряженно бежит по улице, кадр очень кинематографичный.»
Позитивный пример:
Кадр 1: Боковой план переулка, мужчина медленно начинает бег, с ощущением учащенного дыхания.
Кадр 2: Мужчина опрокидывает фруктовый лоток, камера быстро панорамирует и дает крупный план испуганного мужчины.
Кадр 3: Мужчина перелезает через низкую стену и исчезает, камера медленно отъезжает, останавливаясь на пустой улице.

Конкретные правила

Используйте идентификаторы, такие какКадр1,Кадр2,Кадр3и т.д., для организации содержимого в порядке возникновения событий (сначала главное, затем второстепенное). Необязательно строго ограничивать продолжительность каждого сегмента, позвольте модели естественным образом генерировать ритм в соответствии с сюжетом.
Пояснение
Поддержка моделью точного времени (например, 0–3 секунды) нестабильна, принудительное ограничение длительности может привести к аномальным результатам генерации.
Для каждого кадра рекомендуется следующая логическая структура:
Способ движения камеры или смены кадра: например, «общий план, медленный наезд», «фиксированная камера», «переход кадра на...» и т.д.
Действия и выражения субъекта: опишите ключевые действия и изменения мимики основного персонажа/объекта.
Изменение местоположения или пространства: укажите сцену, местоположение или пространственные отношения субъекта.
Аудиоинформация: опишите звуковые эффекты, голос или фоновую музыку, соответствующие кадру.

3 Требования к описанию действий

Детализация конечностей + Квантификация степени
Действия должны быть конкретизированы до таких частей тела, как руки, ноги, голова, плечи и спина, а также дополнены описаниемамплитуды, скорости, силы;
Пример: медленно поднять руку, быстро повернуть голову, сильно оттолкнуться ногой, слегка наклонить голову.
Предпочтение медленным, плавным, непрерывным мелким движениям
Отдавайте предпочтение медленным, мягким, плавным мелким движениям, по возможности избегая высокоинтенсивных, динамичных действий, таких как бег, прыжки, энергичные кувырки.
Пример: медленно идти, легко поднять руку, слегка наклонить голову, плавно сесть
Дополнение переходами между действиями
Опишите инерцию и связь между предыдущим и последующим действиями, чтобы обеспечить плавность и естественность движений в кадре.
Пример: используя инерцию поворота, плавно поднять руку; естественно перейти от состояния покоя к поднятию руки.
Конкретное внешнее выражение эмоций
Используйте конкретные детали тела для выражения эмоций, заменяя абстрактные слова, такие как «очень грустно», «очень злой».
Конкретные примеры см. в таблице ниже:

«Используй @audio1 низкий, тёплый, с лёгкой зернистостью голос мужчины средних лет, чтобы сказать»

После добавления описания тембра в промпт соответствие тембра заметно улучшилось.

()

Музыка

Тип информации

【Глава первая: Отправление】

Сгенерировать 8 персонажей в 2 изображения, затем использовать изображение для создания видео.

Введено 8 референсных персонажей, в выходном видео — 9 человек.

или

Резкий скачок кадра

【】

Напряжение / Тревога

4 Написание операторских приемов

Модель отлично понимает термины операторской работы, достаточно использовать стандартные термины, такие как «средний план, крупный план, общий план, медленный наезд, плавное перемещение, фиксированный кадр».

Примечание
Старайтесь указывать только 1 тип операторского приема в одном кадре, не требуйте одновременно наезда, отъезда и панорамирования, так как это может увеличить нестабильность изображения.

5 Качество, стиль и слова-ограничители

Качество, стиль и слова-ограничители являются ключом к контролю эффекта генерации видео. Они позволяют установить для модели творческие границы, унифицировать качество и художественный тон, а также избежать дефектов изображения и случайных отклонений. Это необходимая конфигурация для обеспечения стабильного и соответствующего требованиям результата.

1 Качество

Определяет четкость изображения, детализацию текстур и качество света и тени, повышая базовое качество готового видео.

Примеры: высокое разрешение, богатая детализация, кинематографическое качество, естественные цвета, мягкое освещение

2 Стиль

Задает общий художественный стиль и визуальный тон, унифицируя художественную атмосферу изображения.

Примеры: холодные сине-фиолетовые тона киберпанка, ретро-пленка, японская чистота

3 Слова-ограничители

Слова-ограничители очень важны, они позволяют эффективно избежать дефектов изображения, искажений, разрушений и нелогичных элементов, ограничивая границы генерации и обеспечивая стабильность.

Шаблоны часто используемых слов-ограничителей:

Избегать генерации субтитров: «Оставить без субтитров», «Избегать генерации любых текстов или субтитров»
Избегать генерации логотипов: «Не генерировать логотип»
Избегать генерации водяных знаков: «Не генерировать водяные знаки»

6 Практический пример

Демонстрация того, как использовать описанную выше продвинутую формулу и различные элементы для написания промпта.

Продолжить запись непосредственно на основе вывода модели.

Подготовка материалов :

@Изображение 1: Портрет девушки по пояс
@Изображение 2: Референс сцены общежития
@Видео 1: Референс движения камеры для диалога в помещении (средний план, наезд/отъезд или легкое панорамирование)
@Аудио 1: Фоновый шум помещения или легкая музыка

Подсказка :

Девушка из @Изображение 1 как главная героиня, @Изображение 2 как стиль сцены общежития, движение камеры по образцу @Видео 1.

Кадр 1 : Вечер, девушка @Изображение 1 легкой походкой подходит к входу в общежитие @Изображение 2 , камера средним планом плавно следует за ней, теплый желтый солнечный свет льется из окна в коридор, она останавливается у двери, глубоко вздыхает, выражение лица слегка напряженное.

Кадр 2 :девушка @Изображение 1 Открывает дверь и заходит в общежитие, камера переключается на средний план внутри, соседи по комнате поднимают головы, глядя на нее, один из них с улыбкой спрашивает {Как сдала, прошла?}, камера медленно переключается между ними, давая полукрупные планы.

Кадр 3 :девушка @Изображение 1 Сначала опускает голову с грустным выражением, камера дает крупный план, затем она поднимает голову, не сдерживая улыбку, громко смеется и говорит {Обманула вас}, соседи начинают шутливо гоняться за ней, камера медленно отъезжает, останавливаясь на общем плане комнаты, полной смеха.

Весь фильм в стиле высококачественной документальной съемки, теплые тона, мягкий свет; лица персонажей стабильны, без искажений, движения естественные и плавные, без задержек и мерцаний; фоновые звуки естественно сочетаются с @Аудио 1.

Сначала преобразовать вывод модели в бесцветное видео, затем продолжить запись.

Подготовка материалов :

@Изображение 1: Девушка в красном (главная героиня)
@Изображение 2: Убийца в черном (противник)
@Изображение 3: Сцена — бамбуковый лес на утесе
@Видео 1: Референс движения камеры для боевой сцены
@Аудио 1: Напряженные барабаны или звуки боя

Подсказка :

Девушка в красном из @Изображение 1 как главная героиня, девушка в черном из @Изображение 2 как противник, сцена по образцу @Изображение 3 — бамбуковый лес на утесе, общее движение камеры и ритм действий по образцу @Видео 1, фоновые звуки синхронизированы с @Аудио 1.

Кадр 1 : Вечер, камера снимает девушку в красном @Изображение 1Средний план сбоку, медленное наступление. Она стоит на краю обрыва, поднимает флягу и пьёт, одежда колышется на горном ветру. Камера обходит её полукругом, от фронтального плана переходит к спине. Вдали смутно видны фигуры в чёрном среди бамбуковой рощи.

Кадр 2 Камера с изменением фокуса постепенно переходит в общий план. Вид с дрона на весь обрыв и бамбуковую рощу. Двое стоят на противоположных концах скалы. Ветер поднимает полы одежды и пыль. Ритм слегка ускоряется под барабаны.

Кадр 3 Камера переключается на наземный крупный план. Двое медленно обнажают мечи, стоя друг напротив друга. Девушка в красном @изображение 1Выражение лица меняется с беззаботного на холодное. Девушка в чёрном @изображение 2Взгляд решительный, кончик меча слегка дрожит. Камера плавно следует за ними, двигаясь по кругу, и останавливается на крупном плане за мгновение до скрещения мечей.

Общая картина в стиле «дождливого мира боевых искусств»: холодные тона, низкая насыщенность, плёночная текстура, богатая светотень. Лица и пропорции тела стабильны, без искажений. Движения плавные и естественные, без скованности, без сбоев и задержек.

Другие советы

Генерация текста

Модели серии Seedance 2.0 поддерживают генерацию часто используемых текстов. Модель можетавтоматически подбиратьподходящий стиль и цвет в зависимости от контекста, а также поддерживаетуказаниецвета, стиля, способа появления, времени появления и места появления текста в промпте. При написании отдавайте предпочтениечасто используемым символам, избегайтеРедкие иероглифыиспециальные символы, чтобы обеспечить наилучшее отображение. В настоящее время поддерживаются сценарии: рекламные слоганы, субтитры, облачка и т.д. Подробные формулировки и примеры см. в разделеГенерация текста.

Продление видео vs Сегментированная склейка

Непрерывный длинный кадр (продление видео): подходит для «диалоговых сцен» в рамках одной локации, таких как длинные диалоги, эмоциональное развитие, движение по одному маршруту, для достижения эффекта погружения и непрерывности «одним кадром».
Смена сцены / действия (сегментированная склейка): подходит для сюжетных поворотов или сложных, быстрых «боевых сцен», таких как погони, драки, монтаж и т.д. Можно генерировать отдельные фрагменты, а затем монтировать их, чтобы обеспечить ритм и визуальное воздействие.

В реальном производстве обычно комбинируют оба метода, например, сначала продлевают для создания连贯ного диалога, затем склеивают пустые кадры или переходы, сочетая погружение и смену ритма.

Стратегия настройки материалов

Обычно материалы делятся на четыре «функциональные роли»:

Фиксация персонажа: закрепление внешности персонажа
Определение сцены: фиксация окружения и стиля
Ориентир по камере: фиксация языка камеры и ритма движений
Ритм и атмосфера: управление эмоциями и тембром с помощью аудио

Рекомендуемая конфигурация(всего 4-5 материалов): 1-2 изображения персонажа (крупный план / в полный рост) + 1 изображение сцены + 1 видео с движением камеры + 1 аудио.

Пояснение
Не рекомендуется использовать максимальное количество материалов. Избыток материалов затрудняет для модели определение приоритетов признаков, что может привести к конфликту стилей, размытию идентификации объекта и отклонению от ожидаемого результата.

Важные замечания

Языковые нормы

Язык диалогов должен быть единообразным, избегайте смешивания китайского и английского (за исключением имен собственных).

Нормы специальных символов

Разумное использование символов в промптах помогает модели точно понимать различные типы информации:

В видео персонаж «меняет лицо» по ходу, напоминая знаменитостей.

Лицо полностью соответствует референсу на протяжении всего видео.

Примеры

Определить как

Требования к основным чертам

Использовать 2–3 чётких, стабильных статических признака (например, одежда, причёска, внешность, категория) для описания, обеспечивая уникальную идентифицируемость.

{}

{Привет, мир}. Если речь на редком языке (не китайском и не английском), необходимо указать язык, например: на японском сказать {こんにちは}.

Часто смотрит на часы, барабанит пальцами по столу, дыхание учащённое, взгляд уклончивый, бессознательно грызёт ногти.

На 8-й секунде видео появляются «близнецы».

Внешнее проявление через действия и детали.

Абстрактная эмоция

Субтитры

Сохранять стиль 3D-анимации в жанре сянься (CG).

Стиль сянься сместился в сторону реализма.

Часто задаваемые вопросы

Дрейф ID персонажа

Типичное проявление

Сгенерированный образ персонажа не соответствует референсному изображению или происходит «смена лица» (дрейф ID) в середине видео, что приводит к блокировке из-за сходства персонажа со знаменитостью.

Анализ коренных причин

Недостаточная эффективность референсного изображения лица

Смешивание референсных изображений: объединение референсного изображения лица с изображениями позы в полный/по пояс, одежды, деталей и т.д. в одном файле, предоставленном модели.
Слишком малая доля лица: в смешанном референсном изображении область лица занимает слишком малую часть от всего изображения, и модель не получает достаточного веса при извлечении черт лица, что легко приводит к помехам от фона или других элементов.

Решения

Усиление независимости и веса референса лица:

Подготовка крупного плана лица: в дополнение к исходному изображению в полный рост подготовьте отдельноеизображение крупного плана лица персонажа(портрет, только лицо, лучше без эмоций, минимизируйте помехи от плеч, шеи, фона).
Четкое определение объекта в промпте: <Объект1> черты лица по изображению1 (крупный план), макияж и одежда по изображению2 (в полный рост).
Размещение важных материалов в начале: чем болееточный референстребуется, темближе к началупромпта его следует размещать.
Примечание
Для референса персонажа достаточно использовать крупный план + изображение в полный рост,не рекомендуется использовать многовидовые изображения персонажа. Многовидовые материалы содержат разные ракурсы одного персонажа, и модель может принять их за несколько разных объектов, что усугубит проблему дрейфа ID.

Двое из

Беседуют в офисе. Женщина говорит первой: «Ты каждый раз приходишь впритык — тебе нравится это чувство «как раз вовремя»?» Мужчина отвечает с улыбкой: «У меня свой ритм». Диалог естественный и непринуждённый. Внизу кадра появляются субтитры с репликами.

Опущенная голова, плечи слегка дрожат, глаза покраснели, пальцы бессознательно сжимают край одежды, слёзы наворачиваются на глаза, но не падают.

Печаль

Видео содержит субтитры

Типичное проявление

В промпте не было требования генерировать субтитры, но сгенерированное видео их содержит.

Решения

Пояснение
В настоящее время невозможно на 100% избежать генерации субтитров, можно только снизить вероятность их появления и повысить успешность «вытягивания карт» следующими методами.
Добавьте в промпт четкие ограничивающие инструкции: «Оставить без субтитров», «Избегать генерации любых текстов или субтитров».
Если текст на референсных изображениях/видео не является необходимой информацией, рекомендуется сначала удалить его с помощью инструментов (например, используя возможности редактирования изображений/видео Seedream/Seedance), а затем использовать материалы без текста в качестве входных данных.
Если позволяют бизнес-требования, предпочтительно генерировать видео в альбомном формате (вероятность появления субтитров в альбомном формате значительно ниже, чем в портретном), а затем обрезать до портретного формата в программе монтажа.

Видео содержит логотип / водяной знак

Типичное проявление

В промпте не упоминалось о водяных знаках, но сгенерированное видео содержит логотип / водяной знак другой видеоплатформы.

Решения

Добавьте в промпт четкие ограничивающие инструкции: «Не генерировать водяные знаки», «Не генерировать логотипы».

Дрейф стиля

Типичное проявление

Ожидается генерация в стиле 2D или 3D аниме, но стиль входных референсных изображений реалистичен, и в промпте не указан стиль видео. В результате сгенерированное видео может с высокой вероятностью «дрейфовать» в сторону реалистичного стиля.

Решения

Добавьте в промпт четкие ограничивающие слова по стилю, например, «Стиль 2D японского аниме», «Стиль 3D китайской маньхуа». Для более точного контроля стиля рекомендуется сначала преобразовать референсные изображения в целевой стиль, а затем генерировать видео.

Двое из

Беседуют в офисе. Женщина говорит первой: «Ты каждый раз приходишь впритык — тебе нравится это чувство «как раз вовремя»?» Мужчина отвечает с улыбкой: «У меня свой ритм». Диалог естественный и непринуждённый. Внизу кадра появляются субтитры с репликами.

После оптимизации

До оптимизации

Скачок на стыке продленного видео

Типичное проявление

После создания нового видео с помощью функции продления и склейки его с исходным видео на стыке могут возникать скачки изображения или откат.

Решения

В настоящее время рекомендуется исправлять это с помощью пост-монтажа, выравнивая ключевые кадры. В будущем планируется фундаментальная оптимизация на основе итераций модели.

Импортируйте видео для склейки в CapCut или другое профессиональное программное обеспечение для видеомонтажа.
На первом стыке удалите6 кадров с конца предыдущего видео.
и одновременно удалите1 кадр с начала следующего видео.
Повторите вышеуказанные действия для всех точек склейки.
Экспортируйте и проверьте плавность склеенного видео.
Пояснение
Даже после выравнивания кадров могут оставаться незначительные скачки. Рекомендуется заканчивать генерацию продленного видео на моменте перехода или смены кадра, а следующий сегмент начинать с новой сцены после этого перехода.

Двое из

Беседуют в офисе. Женщина говорит первой: «Ты каждый раз приходишь впритык — тебе нравится это чувство «как раз вовремя»?» Мужчина отвечает с улыбкой: «У меня свой ритм». Диалог естественный и непринуждённый. Внизу кадра появляются субтитры с репликами.

Пример Звуковой эффект <> <Издалека доносится лай собаки>

Символ

Проблема «близнецов»

Типичное проявление

В сценах с большим количеством персонажей при использовании трехвидовых изображений в качестве референсных материалов в одном кадре сгенерированного видео легко могут появиться два совершенно одинаковых персонажа.

Анализ коренных причин

Определение объекта в промпте нечеткое, модель не может точно различить разных персонажей;
Использование трехвидовых / многовидовых изображений в качестве референсных материалов может привести к путанице в идентификации персонажей моделью, что приведет к генерации повторяющихся одинаковых персонажей.

Решения

Пояснение
В настоящее время невозможно на 100% избежать проблемы «близнецов», можно только снизить вероятность ее появления и повысить успешность «вытягивания карт» следующими методами.
Четкая привязка объектов

Четко определите каждого персонажа в промпте, укажите соответствие между персонажем и референсным изображением. Рекомендуется после имени персонажа указывать соответствующее референсное изображение и соблюдать единый формат.

Пример: Чжан Сань (соответствует изображению 1) бросает зеленую сберегательную книжку в стоящего Ли Си (соответствует изображению 2).

2. Добавление глобальной ограничивающей инструкции

Добавьте фиксированное ограничение в конец промпта:На протяжении всего видео запрещено появление персонажей с полностью идентичной внешностью, одеждой и аксессуарами. Запрещена генерация эффекта клонов или близнецов. В одном кадре должен присутствовать только один соответствующий персонаж, без повторного копирования персонажей..

3. Оптимизация референсных материалов

Для референсных изображений персонажей предпочтительно использовать отдельные фотографии одного человека. Не рекомендуется использовать трехвидовые или многовидовые материалы.

4. Упрощение и оптимизация промпта

Не используйте полный сценарий в качестве промпта. Чрезмерно избыточное текстовое содержание может привести к путанице в понимании модели. Необходимо сократить нерелевантные описания и обеспечить четкость и фокусировку инструкций.

Двое из

Беседуют в офисе. Женщина говорит первой: «Ты каждый раз приходишь впритык — тебе нравится это чувство «как раз вовремя»?» Мужчина отвечает с улыбкой: «У меня свой ритм». Диалог естественный и непринуждённый. Внизу кадра появляются субтитры с репликами.

(На фоне играет быстрый рок)

Ухудшение качества при продлении видео

Типичное проявление

При использовании сгенерированного моделью видео в качестве входного материала для продления происходит ухудшение качества. Многократное продление накапливает эффект ухудшения, особенно в области лица персонажа могут появляться пятнистые цветовые блоки.

Решения

В настоящее время можно смягчить ухудшение качества следующими способами. В будущем планируется фундаментальная оптимизация на основе итераций модели:

Преобразуйте исходное видео в беломодельное видео с помощью Seedance 2.0, а затем используйте его как входной материал для продления.
Пример промпта: Преобразовать видео в белую 3D-модель, персонажи унифицированы в чисто-белые 3D-модели, без цвета, текстуры, теней, чисто-белый фон, стабильная структура, плавное движение.
Предпочтительно использовать изображения высокого разрешения в качестве референсных материалов.
Разумно контролируйте количество продлений видео, избегайте многократного последовательного продления.

Двое из

Беседуют в офисе. Женщина говорит первой: «Ты каждый раз приходишь впритык — тебе нравится это чувство «как раз вовремя»?» Мужчина отвечает с улыбкой: «У меня свой ритм». Диалог естественный и непринуждённый. Внизу кадра появляются субтитры с репликами.

Уголки губ непроизвольно поднимаются, брови и глаза расслаблены, шаги становятся лёгкими, бессознательно напевает мелодию, не может удержаться и кружится на месте.

Радость

Эффект спецэффектов не соответствует ожиданиям

Типичное проявление

При описании конкретных спецэффектов текстом в промпте может возникнуть ситуация, когда эффект не соответствует ожиданиям. Например: в промпте указано «Цифра "2999" появляется в анимации обратного отсчета», но фактически сгенерированная анимация цифр демонстрирует хаотичные скачки, не соответствующие стандартной логике обратного отсчета.

Решения

Рекомендуется использоватьреференсное видеодля определения спецэффекта: подайте видео с целевым спецэффектом в качестве референсного материала модели, чтобы модель точно поняла форму и логику движения эффекта, и результат генерации будет ближе к ожидаемому. Например: способ появления цифры "2999" см. в видео1.

Двое из

Беседуют в офисе. Женщина говорит первой: «Ты каждый раз приходишь впритык — тебе нравится это чувство «как раз вовремя»?» Мужчина отвечает с улыбкой: «У меня свой ритм». Диалог естественный и непринуждённый. Внизу кадра появляются субтитры с репликами.

В конце нет шума.

Откат содержимого

В конце есть шум.

Слишком много референсных персонажей

Типичное проявление

Когда количество референсных персонажей превышает 4, стабильность вывода модели снижается. Сгенерированное видео может содержать несоответствующее количество персонажей (например, меньше или больше) или повторяющихся персонажей.

Решения

В настоящее время можно смягчить проблему следующими способами. В будущем планируется фундаментальная оптимизация на основе итераций модели:

Поэтапная генерация изображений: разделите персонажей на группы, убедитесь, что количество персонажей в каждой группе не превышает 4. Например, 6 человек можно разделить на 2 группы по 3 человека и сгенерировать изображения для каждой группы отдельно.
Генерация видео из изображений: используйте несколько сгенерированных на первом этапе групповых изображений в качестве референсных материалов, а затем сгенерируйте итоговое видео.

Двое из

Беседуют в офисе. Женщина говорит первой: «Ты каждый раз приходишь впритык — тебе нравится это чувство «как раз вовремя»?» Мужчина отвечает с улыбкой: «У меня свой ритм». Диалог естественный и непринуждённый. Внизу кадра появляются субтитры с репликами.

Тембр не соответствует входному аудио.

Входное аудио

Шум в конце видео

Типичное проявление

Когда видео содержит закадровый голос, в конце видео часто появляются резкие щелчки или обрывистые шумы.

Решения

Перегенерируйте видео или используйте инструменты монтажа, такие как CapCut, для обработки звуковой дорожки в конце с помощьюогибающей громкостидля создания плавного затухания аудио и устранения обрывистого шума.

Конкретные шаги (с использованием CapCut):

Импортируйте сгенерированное видео в CapCut.
На временной шкале выберите видеодорожку, нажмите на панели инструментовАудио.
выберитеогибающей громкостифункцию (в некоторых версиях находится в меню «Базовое» / «Регулировка») и выберите ключевую точку. На аудиодорожке появится линия, представляющая громкость, и ключевые точки.
В конце видео опустите ключевой кадр громкости до 0, создав нисходящий спад.
Пример промпта Seedance 2.0
Проверьте предпросмотр, чтобы убедиться, что аудио в конце затухает естественно, без резких обрывов и шумов.

Двое из

Беседуют в офисе. Женщина говорит первой: «Ты каждый раз приходишь впритык — тебе нравится это чувство «как раз вовремя»?» Мужчина отвечает с улыбкой: «У меня свой ритм». Диалог естественный и непринуждённый. Внизу кадра появляются субтитры с репликами.

Глубокий выдох, полностью расслабленные плечи, на лице давно не появлявшаяся лёгкая улыбка, взгляд устремлён вдаль.

Облегчение

Неточное произношение китайского языка

Типичное проявление

Модель часто ошибается в многосложных, редких и похожих по написанию иероглифах.

Решения

Можно заменить легко ошибочные символы на часто используемые омофоны с одинаковым произношением , чтобы избежать отклонений в произношении и восстановить ожидаемый аудиоэффект. Обратите внимание, что это лишь оптимизация и не может полностью устранить все проблемы с произношением.

Пример: можно переписать «螭龙山» в подсказке как омофон «吃龙山».

Двое из

Беседуют в офисе. Женщина говорит первой: «Ты каждый раз приходишь впритык — тебе нравится это чувство «как раз вовремя»?» Мужчина отвечает с улыбкой: «У меня свой ритм». Диалог естественный и непринуждённый. Внизу кадра появляются субтитры с репликами.

Места соединения стали более плавными.

На стыках (5-я и 20-я секунды) появляется

Неточная привязка тембра

Типичное проявление

При использовании эталонного аудио для указания тембра, итоговый тембр аудио в видео заметно отличается от эталонного.

Решения

Старайтесь, чтобы стиль реплик в видео был близок к тону и манере речи эталонного аудио — это повысит точность и стабильность воспроизведения тембра.

Двое из

Беседуют в офисе. Женщина говорит первой: «Ты каждый раз приходишь впритык — тебе нравится это чувство «как раз вовремя»?» Мужчина отвечает с улыбкой: «У меня свой ритм». Диалог естественный и непринуждённый. Внизу кадра появляются субтитры с репликами.

Субъект1

Пример промпта Seedance 2.0

Чжан Хун

Женщина в красном платье и соломенной шляпе из

Определить как

Приложение: Примеры подсказок

Показаны примеры промптов для использования моделей серии Seedance 2.0 в различных сценариях, чтобы помочь вам точнее реализовать функции управления референсами и генерации текста с помощью мультимодальных ссылок.

Генерация текста

Слоган

Шаблон подсказки:

«Текст» + «Время появления» + «Место появления» + «Способ появления», «Характеристики текста (цвет, стиль)»
Пояснение
Seedance2.0 может подбирать подходящий стиль текста в зависимости от контекста. Если требования к отображению текста строгие, обратитесь к разделу Множественные изображения > Ссылка на логотип .

Пример:

[Готовый результат]

[Подсказка]

Стиль рисованной анимации, три человека сидят вместе и едят изображение1 жареную курицу, атмосфера дружелюбная и радостная, затем изображение постепенно размывается, в центре появляется текст «Счастье в Seedance».

[Исходный материал]

Пример промпта Seedance 2.0

▲ Изображение 1

Субтитры

Шаблон подсказки:

изображение5

Пример:

[Готовый результат]

[Исходный материал]

Пример промпта Seedance 2.0

[Подсказка]

Значок из

[Готовый результат]

[Исходный материал]

Пример промпта Seedance 2.0

[Подсказка]

[Основные характерные черты субъекта]

Речевые пузыри

Шаблон подсказки:

«Персонаж» говорит: «…», вокруг персонажа появляется пузырь с репликой.

Пример:

[Готовый результат]

[Исходный материал]

Пример промпта Seedance 2.0

[Подсказка]

изображение1 Движения персонажей и язык камеры из

[Готовый результат]

[Исходный материал]

Пример промпта Seedance 2.0

[Подсказка]

Ссылаясь наизображение1 ,изображение2 образ девушки, девушка на клубничной ферме, срывает ягоду, откусывает, улыбается и говорит: «This is the real deal!» Вокруг девушки появляется пузырь с репликой.

Ссылка на изображение

Модели Seedance 2.0 поддерживают как многовидовые ссылки на объект, так и ссылки на несколько изображений, например, сцены или раскадровки.

Если важен порядок изображений, загружайте их по порядку , а в подсказке используйте изображение1 ,изображение2 изображениеN для точного указания.

Многовидовая ссылка на объект

Достаточно четко указать объект, модель может выполнять команды, включая, но не ограничиваясь следующими примерами.

Товар:

3C цифровая техника


[Готовый результат]

[Исходный материал]

Пример промпта Seedance 2.0

[Подсказка]

Извлеките изображение1 ,изображение2 ,изображение3 камеру, замените фон на белый, камера на белом столе, крупным планом сфокусируйтесь на камере, затем медленно вращайте камеру как объект, четко показывая переднюю, боковые и заднюю стороны.

Предметы интерьера


[Готовый результат]

[Исходный материал]

Пример промпта Seedance 2.0

[Подсказка]

Фон: теплый домашний интерьер, средний план термоса из референса, камера плавно приближается к крупному плану термоса, рука за кадром естественно входит в кадр, легко берет термос, камера следует за легким поворотом руки, демонстрируя его.


Персонаж:

[Готовый результат]

[Подсказка]

Ссылаясь наизображение1 ,изображение2 ,изображение3 образ девушки, сгенерируйте сцену, где она ест торт в кофейне.

[Исходный материал]

Пример промпта Seedance 2.0

Множественные изображения

Ссылка на логотип


[Готовый результат]

[Исходный материал]

Пример промпта Seedance 2.0

[Подсказка]

Фон: неоновый футуристический городской воздушный коридор, переплетение летательных аппаратов и голографической рекламы, ссылка на изображение2 девушку, сначала средним планом показать, как она запускает серебряный парящий фонарь с голограммой, затем камера отъезжает, показывая множество парящих фонарей, изображение постепенно размывается, появляется изображение1 логотип, общий стиль — 3D киберпанк анимация.

Множественные объекты


[Готовый результат]

[Исходный материал]

Пример промпта Seedance 2.0

[Подсказка]

Ссылаясь на кошку и собаку на изображении, в уютной квартире собака ест корм, кошка подходит, протягивает лапу и касается собаки, собака перестает есть, увидев кошку, кошка прижимается к собаке. Теплые тона.

Множественные элементы


[Готовый результат]

[Исходный материал]

Пример промпта Seedance 2.0

[Подсказка]

Сцена установлена визображение4Ресторан внутри, в зале много посетителей. изображение1 Девушка изизображение2 Одета в одежду изизображение3 Она раскладывает предметы на стойке. Парень изОн подходит и хочет попросить у неё контакты.

Многорамочная раскадровка


[Готовый результат]

[Исходный материал]

Пример промпта Seedance 2.0

[Подсказка]

Ссылаясь на раскадровку на изображении, сгенерируйте напряженную сцену боя. Кадры раскадровки должны появляться по порядку, затем два человека яростно сражаются.

Ссылка на раскадровку


[Готовый результат]

[Исходный материал]

Пример промпта Seedance 2.0

[Подсказка]

Ссылаясь наизображение3 Композиция из раскадровки: девочка ждёт, пока папа приготовит еду, и говорит: «아빠, 배고파요! 밥 다 됐어요?» Образ девочки по ссылкеизображение1 Затем камера панорамирует вправо, переходя кизображение4Кадр и композиция. Образ папы по ссылкеизображение2 Папа отвечает ей: «거의 다 됐어, 조금만 기다려!» Затем камера переключается на крупный план лица дочери с лёгким разочарованием, она говорит: «아직 멀었어요? 맛있는 냄새 나는데...» Затем крупный план лица папы, он говорит: «이제 진짜 금방이야. «빨리빨리» 하지 말고 손부터 씻고 와!»

Ссылка на видео

Модели Seedance 2.0 поддерживают ссылку на видео. При использовании достаточно четко указать, что генерировать и на какой объект ссылаться.

Если важен порядок видео, загружайте их по порядку , а в подсказке используйте видео1,видео2 видеоN для точного указания.

Ссылка на движение

Кино


[Готовый результат]

[Исходный материал]

▲ Видео 1

Пример промпта Seedance 2.0

[Подсказка]

Ссылаясь навидео1Операторская работа изизображение2 Сделать концептуальное видео технопарка, используяизображение1 Высотное здание изизображение2 Как визуальный центр, с тем же пикированием от первого лица, передающимизображение1 Технологичность парка из

Маркетинг


[Готовый результат]

[Исходный материал]

▲ Видео 1

[Подсказка]

Ссылаясь навидео1бег лошади, сгенерируйте золотого скакуна, бегущего по степи, затем зафиксируйте его грациозную позу, превратившуюся в золотую подвеску в форме лошади.

Ссылка на движение камеры

[Готовый результат]

[Подсказка]

Ссылаясь навидео1Постоянно отображается в правом нижнем углу кадра. изображение1 Внизу кадра появляются субтитры с текстом «...», синхронизированные с аудиоритмом. изображение1 Создать видео с закадровым голосом. Глубокий, спокойный мужской голос говорит: «В огромной вселенной наш мир — лишь краткое мгновение. Однако в нём жизнь, несмотря ни на что, процветает». Сцена должна медленно переходить от ночи к рассвету: звёзды постепенно исчезают, солнце встаёт из-за гор. Внизу кадра появляются субтитры в соответствии с репликами.

[Исходный материал]

▲ Видео 1

Пример промпта Seedance 2.0

▲ Изображение 1

Ссылка на эффекты

Кино


[Готовый результат]

[Исходный материал]

▲ Видео 1

Пример промпта Seedance 2.0

▲ Изображение 1

[Подсказка]

Ссылаясь навидео1золотой частичный эффект, пусть изображение2 персонаж играет на флейте, а вокруг него кружатся такие же частицы.

Эффект геймплея


[Готовый результат]

[Исходный материал]

▲ Видео 1

Пример промпта Seedance 2.0

▲ Изображение 1

[Подсказка]

Ссылаясь навидео1Эффект, при которомизображение1 У девушки вырастают такие же крылья, траектория появления крыльев совпадает.

Редактирование видео

Модели Seedance 2.0 поддерживают редактирование видео: добавление, удаление или изменение элементов, продление видео вперед или назад, а также заполнение треков.

Если важен порядок видео, загружайте их по порядку , а в подсказке используйте видео1,видео2 видеоN для точного указания.

Добавление/удаление/изменение элементов

Добавление элемента


[Готовый результат]

[Исходный материал]

▲ Видео 1

[Подсказка]

На видео1поверхность добавьте закуски: жареную курицу, пиццу и т.д.

Удаление элемента


[Готовый результат]

[Исходный материал]

▲ Видео 1

[Подсказка]

Произношение «Чилуншань» в «螭龙山» неверно. видео1После исправления на «Чилуншань» произношение стало правильным.

Изменение элемента


[Готовый результат]

[Исходный материал]

▲ Видео 1

Пример промпта Seedance 2.0

▲ Изображение 1

[Подсказка]

Замените духи из видео1на крем из изображение1 , сохранив движение и работу камеры.

Продление видео

Примечание
Модель автоматически обрежет соединяемые части для синтеза, не генерируя повторно исходные фрагменты входного видео.

Продление назад


[Готовый результат]

[Исходный материал]

▲ Видео 1

[Подсказка]

Сгенерируйте видео1последующее: двое опоздавших мужчин бегут к ним, пятеро наконец встречаются и дружелюбно болтают.

Продление вперед


[Готовый результат]

[Исходный материал]

▲ Видео 1

[Подсказка]

Продление вперед видео1, кадр через плечо мужчины в белом, мужчина в белом говорит: «It’s not that bad. You're just stressed. Everyone goes through this, you just need to keep going.»

Заполнение треков

Пояснение
Модели Seedance 2.0 поддерживают до 3 входных видео, общая длительность не более 15 секунд.
При генерации автоматически обрезаются соединительные части первого и последнего видео, сохраняя только необходимые фрагменты для синтеза.

Пример:

[Готовый результат]

[Подсказка]

видео1, в момент падения листьев на землю возникает золотой частичный эффект, порыв ветра, затем видео2 .

[Исходный материал]

▲ Видео 1

▲ Видео 2

Seedance 2.0 Руководство по промптам: формулы, примеры и часто задаваемые вопросы