سلسلة Doubao Seedance 2.0 (يُشار إليها اختصارًا بسلسلة Seedance 2.0) تدعم أصلاً التوليف المشترك للصوت والفيديو، وتتمتع بفهم دلالي ممتاز وقدرات تفاعل متعددة الوسائط. تشرح هذه المقالة طرق استخدام المطالبات (Prompt) والنصائح ذات الصلة لنماذج سلسلة Seedance 2.0، لمساعدتك على استخدام هذا النموذج بكفاءة أكبر لتوليد مقاطع فيديو عالية الجودة تلبي احتياجاتك.
الصيغة الأساسية
تدعم سلسلة نماذج Seedance 2.0 الرجوع في نفس الوقت إلى مواد متعددة الوسائط مثل الفيديو والصورة والصوت، مما يسمح بتحديد دقيق لملامح الشخصيات، وتأثيرات الحركة، والأسلوب البصري، ونبرة الصوت، مما يقلل بشكل كبير من صعوبة كتابة المطالبات. بناءً على هذه الميزة، يمكننا استخدام صيغ أساسية بسيطة لتوجيه النموذج، والاستفادة من خصائص المواد متعددة الوسائط لتوليد مقاطع فيديو تلبي احتياجات محددة بسرعة.
يمكن تقسيم مهام توليد الفيديو بالرجوع إلى ثلاثة أنواع: الرجوع متعدد الوسائط، وتحرير الفيديو، وتمديد الفيديو. يمكنك اختيار الصيغة الأساسية للمطالبة بناءً على نوع المهمة.
الرجوع متعدد الوسائط
استخراج بعض العناصر (مثل الكائن الرئيسي، الأسلوب، المشهد، المؤثرات الصوتية) من المادة لتوليد فيديو جديد كليًا.
<صورة N>في<الكائن الرئيسي N>، قم بتوليد...<فيديو N>في<الحركة/التصوير/الأسلوب/المؤثر الصوتي>، قم بتوليد...<صوت N>النبرة الصوتية في، قم بتوليد...تحرير الفيديو
إجراء تعديلات جزئية أو كلية على الفيديو الأصلي. الأجزاء غير المذكورة تبقى كما هي افتراضيًا.
<خصائص العنصر> + <توقيت الظهور> + <موقع الظهور><فيديو N>، قم بتغيير<الخاصية الأصلية>فيها إلى<الخاصية الجديدة>تمديد الفيديو
استمرار الفيديو الأصلي في البعد الزمني، مع الحفاظ على اتساق الأسلوب الصوتي والمرئي والكائن الرئيسي والسرد.
<فيديو N>، قم بتوليد...<فيديو 1> + <وصف المشهد الانتقالي> + متبوعًا بـ <فيديو 2> + <وصف المشهد الانتقالي> + متبوعًا بـ <فيديو 3><فيديو N>" للإشارة إلى الفيديو، ولا تستخدم "الرجوع<فيديو N>" لتجنب سوء التفسير كمهمة رجوع.المهام المركبة
المهام الثلاث المذكورة أعلاه تدعم أيضًا الاستخدام المركب.
<صورة/فيديو N>في[بعد الرجوع]، قم بتحرير دقيق لـ<فيديو X>،[محتوى التحرير المحدد]الصيغة المتقدمة
Seedance 2.0 هو في جوهره مخرج ذكاء اصطناعي متعدد الوسائط: يقرأ في نفس الوقت مطالباتك النصية والصور والفيديو والصوت، ويقسمها داخليًا إلى بُعد "المكان" (ما في المشهد) وبُعد "الزمان" (كيف تتغير الأمور مع الوقت) لفهم وتوليد الصورة.
لذلك، المطالبة الجيدة ليست مجرد "وصف نصي"، بل هي "تعليمات هندسية": من، وفي أي مشهد، وماذا يفعل، وكيف تتحرك الكاميرا، وبأي ترتيب زمني يحدث، يتم إرسالها إلى بُعد المكان وبُعد الزمان على التوالي. الصيغة المحددة هي كما يلي:
صيغة المطالبة المتقدمة: كائن دقيق + تفاصيل الحركة + بيئة المشهد + ألوان الإضاءة + حركة الكاميرا + الأسلوب البصري + جودة الصورة + شروط التقييد
ببساطة، حدد أولاً "من" يفعل "ماذا"، ثم اذكر "أين" و"ما الأجواء"، ثم أخبر النموذج "كيف يتم التصوير"، وأخيرًا استخدم الأسلوب وجودة الصورة والشروط المقيدة لضبط النتيجة. فيما يلي تفصيل لكل عنصر.
1 تعريف الكائن الرئيسي
في المواد المرجعية الفعلية، غالبًا ما توجد كائنات رئيسية متعددة في صورة واحدة. للرجوع بدقة إلى كائن معين في المادة، يجب تعريف الكائن الرئيسي بوضوح. يمكن أن يكون الكائن الرئيسي شخصًا أو أداة أو مشهدًا، إلخ.
<صورة/فيديو N>في[الخصائص الأساسية للكيان]تعريف<الكائن الرئيسي N>عندما تشير كائنات من مواد متعددة إلى نفس الكائن، يجب ربطها بشكل موحد:
[...]،الصورة2في[...]يُعرف بـ**<الكائن الرئيسي N>**عند وجود كائنات متعددة في الفيديو، يجب تعريف كل منها بشكل منفصل واستخدام العلامات للتمييز. يجب أن تكون العلامات فريدة ومستقرة، ويجب الاستمرار في استخدام العلامات المقابلة في الأوصاف اللاحقة لتجنب الارتباك في الإشارة.
<الكائن الرئيسي N>@<صورة N>في كل مرة يتم فيها ذكر الكائن الرئيسي، للتأكيد على علاقة الربط بين الكائن والمادة. مثال: Zhang San@صورة 1.<صورة/فيديو N>للإشارة إلى الكائن الرئيسي. نظرًا لأن النموذج لا يمكنه ربط Asset ID مباشرة بالمحتوى المرجعي، فلا يجوز استبدال<صورة/فيديو N>.
2 استخدام التسلسل الزمني للمشاهد
النمذجة الداخلية للنموذج تفصل بين المكان والزمان. لذلك، الشكل المثالي لمطالبة فيديو معقد هو تقسيم المشاهد على محور زمني: قسم الفيديو إلى عدة مشاهد، وصف كل مشهد ديناميكيًا حسب ترتيب الأحداث: من + أين + ماذا يفعل + كيف تتحرك الكاميرا.
نصيحة عملية
استخدم ترتيب المشاهد، واكتب لكل مقطع فيديو مشهدًا بسيطًا "مشهد 1 / مشهد 2 / مشهد 3"، ثم ادمجها في مطالبة كاملة.
قواعد محددة
مشهد 1،مشهد 2،مشهد 3، ونظم المحتوى حسب ترتيب الأحداث (الأساسي ثم الثانوي). لا تفرض مدة زمنية لكل مقطع، دع النموذج يولد الإيقاع بشكل طبيعي بناءً على القصة.3 متطلبات وصف الحركة
عاطفة مجردة | يتحول إلى أفعال وتفاصيل خارجية |
حزن | رأس منخفض، أكتاف ترتجف قليلاً، محجر العين يحمر، الأصابع تقبض على حافة الثوب دون وعي، دموع في محجر العين لكنها لم تسقط |
فرح | زوايا الفم ترتفع بشكل لا إرادي، الحاجبان والعينان منبسطان، الخطوات تصبح خفيفة، يهمس بأغنية دون وعي، لا يستطيع منع نفسه من الدوران في مكانه |
توتر / قلق | ينظر إلى الساعة بشكل متكرر، أصابعه تنقر على الطاولة باستمرار، تنفسه سريع، عيناه تتجنبان النظر، يعض أظافره دون وعي |
غضب | قبضات اليد مشدودة، خط الفك مشدود، الصدر يرتفع وينخفض بعنف، العيون حادة كالسكين، الكلمات تخرج من بين الأسنان |
ارتياح | زفير طويل، أكتاف مشدودة تسترخي تماماً، وجه يظهر ابتسامة خفيفة طال انتظارها، رفع النظر إلى البعيد |
4 كتابة حركة الكاميرا
قدرة النموذج على فهم مصطلحات التصوير قوية جدًا، يمكنك استخدام مصطلحات التصوير القياسية مباشرة، مثل "لقطة متوسطة، لقطة قريبة، لقطة بانورامية، دفع بطيء، تحريك أفقي ثابت، لقطة ثابتة".
5 جودة الصورة والأسلوب والشروط المقيدة
جودة الصورة والأسلوب والشروط المقيدة هي مفاتيح التحكم في تأثير توليد الفيديو، حيث تحدد حدود الإبداع للنموذج، وتوحد جودة الصورة والنغمة الفنية، وتتجنب عيوب الصورة والانحرافات العشوائية، وهي تكوينات ضرورية لضمان استقرار وامتثال النتيجة النهائية.
1 جودة الصورة
تحديد وضوح الصورة وتفاصيل الملمس وجودة الإضاءة والظل، لتحسين جودة الصورة الأساسية.
مثال: عالية الدقة، غنية بالتفاصيل، جودة سينمائية، ألوان طبيعية، إضاءة وظلال ناعمة.
2 الأسلوب
تحديد الأسلوب الفني العام والنغمة البصرية، لتوحيد الجو الفني للمشهد.
مثال: سايبربانك بألوان زرقاء بنفسجية باردة، فيلم قديم، نضارة يابانية.
3 الشروط المقيدة
الشروط المقيدة مهمة جدًا، حيث يمكنها تجنب عيوب الصورة والتشوهات والعناصر غير المنطقية بشكل فعال، وتحديد حدود التوليد والاستقرار.
قوالب الشروط المقيدة الشائعة:
6 أمثلة عملية
عرض كيفية استخدام الصيغة المتقدمة والعناصر المذكورة أعلاه لكتابة المطالبات.
تحضير المواد:
المطالبة:
الفتاة في @صورة 1 هي البطلة، @صورة 2 هي مرجع لأسلوب مشهد السكن، راجع طريقة حركة الكاميرا في @فيديو 1.
اللقطة 1: في وقت الغروب، الفتاة @صورة 1 تمشي بخفة إلىباب السكن @صورة 2، الكاميرا تتتبع بثبات بلقطة متوسطة، ضوء الشمس الأصفر الدافئ يتسلل من النافذة إلى الممر، تتوقف للحظة عند الباب، تأخذ نفسًا عميقًا، تعابير وجهها متوترة قليلاً.
اللقطة 2:الفتاة @صورة 1 تدفع الباب وتدخل إلى السكن، تنتقل الكاميرا إلى لقطة متوسطة داخل الغرفة، زملاء الغرفة يرفعون رؤوسهم نحوها أثناء ترتيب الكتب، أحدهم يسأل مبتسمًا {كيف كانت الامتحانات، هل نجحت؟}، تنتقل الكاميرا ببطء بينهم بلقطات نصفية قريبة.
اللقطة 3:الفتاة @صورة 1 تخفض رأسها أولاً بتعبير حزين، الكاميرا تعطي لقطة قريبة لها، ثم ترفع رأسها وتنفجر ضاحكة وتقول {خدعتكم}، يركض زملاء الغرفة وراءها ويمازحونها، الكاميرا تبتعد ببطء، وتتوقف على لقطة عامة للغرفة مليئة بالضحك.
طوال الفيديو، أسلوب وثائقي سينمائي عالي الدقة، ألوان دافئة، إضاءة ناعمة؛ وجه الشخصية ثابت دون تشويه، الحركات طبيعية وسلسة، بدون توقف أو وميض؛ المؤثرات الصوتية المحيطة تندمج بشكل طبيعي مع @صوت 1.
تحضير المواد:
المطالبة:
المرأة ذات الرداء الأحمر في @صورة 1 هي البطلة، المرأة ذات الرداء الأسود في @صورة 2 هي الخصم، المشهد يرجع إلى بيئة جرف وغابة الخيزران في @صورة 3، الإيقاع العام للحركة وحركة الكاميرا يرجع إلى @فيديو 1، المؤثرات الصوتية الخلفية متزامنة مع @صوت 1.
اللقطة 1: في المساء، الكاميرا منالمرأة ذات الرداء الأحمر @صورة 1لقطة متوسطة جانبية تتحرك ببطء إلى الأمام، وهي تقف على حافة الجرف وتشرب الخمر من القارورة، أكمام ثوبها تتمايل بلطف في نسيم الجبل، الكاميرا تدور حولها نصف دورة، من الأمام إلى الخلف، وفي البعيد يمكن رؤية ظل شخصية ترتدي الأسود وسط غابة الخيزران بشكل خافت.
اللقطة 2تتحول الكاميرا بالتكبير البطيء إلى لقطة بعيدة، من منظور طائرة بدون طيار تطل على الجرف بأكمله وغابة الخيزران، الشخصان يقفان على طرفي الجرف، رياح الجبل ترفع أطراف الثياب والغبار، الإيقاع يتسارع قليلاً مع إيقاع الطبول.
اللقطة 3تنتقل الكاميرا إلى لقطة قريبة على الأرض، الشخصان يسحبان سيفيهما ببطء في مواجهة بعضهما،المرأة ذات الرداء الأحمر @صورة 1يتحول تعبير وجهها من اللامبالاة إلى البرودة،المرأة ذات الرداء الأسود @صورة 2نظراتها ثابتة، طرف السيف يرتجف قليلاً، الكاميرا تتابع بثبات حركتهما الدائرية، وتتوقف أخيراً على لقطة قريبة قبل لحظة تقاطع السيفين.
المشهد العام يحسّس بأجواء أفلام الكونغ فو الماطرة، ألوان باردة وتشبع منخفض، جودة فيلم سينمائي، طبقات ضوئية غنية؛ نسب الوجوه والأجسام ثابتة دون تشويه، الحركات متسلسلة وطبيعية، غير جامدة، بدون تشوهات أو توقف.
نصائح أخرى
توليد النص
سلسلة نماذج Seedance 2.0 تدعم توليد النصوص الشائعة. يمكن للنموذجمطابقة تلقائيةللأسلوب واللون المناسبين حسب السياق، كما يدعمتحديدلون النص وأسلوبه وطريقة ظهوره وتوقيته وموقعه في المطالبة. عند الكتابة، أعط الأولوية لاستخدامالكلمات الشائعة، وتجنبأحرف نادرةورموز خاصة، لضمان أفضل عرض. يدعم حاليًا سيناريوهات مثل الإعلانات والترجمة والفقاعات. راجعتوليد النص.
تمديد الفيديو مقابل التقطيع المتسلسل
في الإنتاج الفعلي، غالبًا ما يتم الجمع بين الطريقتين، مثل استخدام التمديد لتوليد حوار مستمر، ثم دمج لقطات فارغة أو انتقالية، لتحقيق التوازن بين الانغماس وتغير الإيقاع.
استراتيجية تكوين المواد
عادةً ما تُقسم المواد إلى أربعة "أدوار وظيفية":
التكوين الموصى به(إجمالي 4-5 مواد): 1-2 صورة شخصية (لقطة قريبة للوجه/كامل الجسم) + صورة مشهد واحدة + مقطع فيديو لحركة الكاميرا + مقطع صوتي واحد.
ملاحظات مهمة
قواعد اللغة
يجب توحيد لغة الحوار، وتجنب الخلط بين الصينية والإنجليزية (باستثناء المصطلحات الخاصة).
قواعد الرموز الخاصة
يساعد الاستخدام المعقول للرموز في النص الإرشادي النموذج على فهم أنواع المعلومات المختلفة بدقة:
نوع المعلومات | رمز | مثال |
موسيقى | () | (في الخلفية تُعزف موسيقى روك سريعة الإيقاع) |
مؤثر صوتي | <> | <صوت نباح كلب من بعيد> |
نص الحوار | {} | {مرحباً، أيها العالم}. إذا كان النص بلغة نادرة (غير الصينية أو الإنجليزية)، يجب تحديد اللغة، مثل: قل باليابانية {こんにちは}. |
ترجمة | 【】 | 【الفصل الأول: الانطلاق】 |
أسئلة شائعة
انحراف هوية الشخصية
ظاهرة نموذجية
عدم تطابق مظهر الشخصية المُولَّدة مع الصورة المرجعية، أو حدوث "تبديل الوجه" (انحراف الهوية) أثناء الفيديو، مما يؤدي إلى حظر الفيديو بسبب تشابه الشخصية مع أحد المشاهير.
تحليل السبب الجذري
عدم كفاية فعالية الصورة المرجعية للوجه
الحلول
تعزيز استقلالية ووزن مرجع الوجه:
قبل التحسين | بعد التحسين |
الشخصيات في الفيديو "تغير وجوهها" في منتصف الطريق، تصطدم بوجوه المشاهير | الوجه يبقى متطابقاً مع الصورة المرجعية طوال الوقت |
الفيديو يحتوي على ترجمة
ظاهرة نموذجية
لم يُطلب توليد ترجمة في النص الإرشادي، لكن الفيديو المُولَّد يحتوي على ترجمة.
الحلول
الفيديو يحتوي على شعار / علامة مائية
ظاهرة نموذجية
لم يُذكر محتوى العلامة المائية في النص الإرشادي، لكن الفيديو المُولَّد يحتوي على شعار / علامة مائية لمنصة فيديو أخرى.
الحلول
أضف تعليمات تقييد واضحة في النص الإرشادي: "لا تولد علامة مائية"، "لا تولد شعارًا".
انحراف الأسلوب
ظاهرة نموذجية
الرغبة في توليد أسلوب أنمي ثنائي أو ثلاثي الأبعاد، لكن أسلوب الصورة المرجعية المدخلة واقعي، ولم يتم التأكيد على أسلوب الفيديو في النص الإرشادي، مما قد يؤدي إلى انحراف الفيديو إلى الأسلوب الواقعي.
الحلول
أضف كلمات تقييد أسلوب واضحة في النص الإرشادي، مثل "أسلوب أنمي ياباني ثنائي الأبعاد"، "مانغا صينية ثلاثية الأبعاد". إذا كنت بحاجة إلى تحكم أكثر دقة في الأسلوب، يُنصح بتحويل الصورة المرجعية إلى الأسلوب المستهدف أولاً ثم توليد الفيديو.
قبل التحسين | بعد التحسين |
النمط الفنتازي السحري ينحرف إلى نمط واقعي | الحفاظ على نمط CG صيني ثلاثي الأبعاد للفنتازيا السحرية |
قفزة في وصلة تمديد الفيديو
ظاهرة نموذجية
بعد استخدام وظيفة تمديد الفيديو لتوليد فيديو جديد، عند دمج الفيديو الجديد مع الفيديو الأصلي، قد تحدث قفزة أو تراجع في الصورة عند نقطة الوصل.
الحلول
حاليًا يُنصح بالإصلاح عبر المونتاج اللاحق، ومحاذاة الإطارات الرئيسية، وسيتم التحسين الجذري لاحقًا من خلال تحديث النموذج.
قبل التحسين | بعد التحسين |
في نقاط الانتقال (الثانية 5، الثانية 20) يظهرقفزة مفاجئة في المشهدأوتراجع في المحتوى | الانتقالات أكثر سلاسة |
مشكلة التوأم
ظاهرة نموذجية
في السيناريوهات التي تحتوي على العديد من الشخصيات في المشهد ويتم استخدام صور ثلاثية الزوايا كمواد مرجعية، قد يظهر شخصان متطابقان تمامًا في نفس المشهد من الفيديو المُولَّد.
تحليل السبب الجذري
الحلول
حدد بوضوح كل شخصية في النص الإرشادي، ووضح العلاقة بين الشخصية والصورة المرجعية. يُنصح بتدوين الصورة المرجعية المقابلة بعد اسم الشخصية، والحفاظ على تنسيق موحد.
مثال: تشانغ سان (المقابل للصورة 1) يرمي دفتر التوفير الأخضر نحو لي سي (المقابل للصورة 2) الواقف.
2. إضافة تعليمات تقييد شاملة
أضف تقييدًا ثابتًا في نهاية النص الإرشادي: يمنع منعًا باتًا ظهور شخصيات متطابقة تمامًا في المظهر والملابس والإكسسوارات طوال الفيديو، ويمنع توليد تأثيرات نسخ متماثلة أو توأم، ويتم الاحتفاظ بشخصية واحدة فقط في نفس المشهد، دون تكرار الشخصية.
3. تحسين المواد المرجعية
يُفضل استخدام صور فردية مستقلة كمرجع للشخصية، ولا يُنصح باستخدام صور ثلاثية الزوايا أو متعددة الزوايا.
4. تبسيط وتحسين النص الإرشادي
لا تستخدم النص الكامل للسيناريو كنص إرشادي مباشرة، فالمحتوى الزائد عن الحاجة يسبب ارتباكًا في فهم النموذج. يجب تبسيط العبارات غير ذات الصلة وضمان تركيز التعليمات.
قبل التحسين | بعد التحسين |
في الثانية 8 من المشهد يظهر "توأمان" |
تدهور جودة الفيديو الممدد
ظاهرة نموذجية
عند استخدام فيديو مُولَّد من النموذج كمادة مدخلة للتمديد والاستمرار، يحدث تدهور في الجودة. التمديد المتكرر يضاعف تأثير التدهور، خاصة في منطقة وجه الشخصية حيث تظهر بقع ملونة.
الحلول
حاليًا يمكن تخفيف تدهور الجودة من خلال الطرق التالية، وسيتم التحسين الجذري لاحقًا من خلال تحديث النموذج:
قبل التحسين | بعد التحسين |
الكتابة المباشرة على ناتج النموذج | تحويل ناتج النموذج إلى فيديو نموذج أبيض ثم الكتابة عليه |
تأثيرات خاصة لا تتوافق مع التوقعات
ظاهرة نموذجية
عند وصف تأثيرات خاصة محددة من خلال النص في النص الإرشادي، قد لا يتطابق التأثير مع التوقعات. مثال: النص الإرشادي يحدد "الرقم '2999' يظهر مع حركة عد تنازلي"، لكن التأثير الفعلي للرقم المتدحرج يظهر قفزات غير منتظمة، ولا يتوافق مع منطق العد التنازلي القياسي.
الحلول
يُنصح باستخدامفيديو مرجعيلتحديد التأثير الخاص: قم بإدخال فيديو التأثير الخاص المستهدف كمادة مرجعية للنموذج، مما يسمح للنموذج بفهم شكل التأثير ومنطق الحركة بدقة، مما ينتج تأثيرًا أكثر توافقًا مع التوقعات. مثال: طريقة ظهور الرقم "2999" راجع الفيديو 1.
قبل التحسين | بعد التحسين |
تأثير التمرير الرقمي له قفزات غير منتظمة واضحة | بعد إضافة فيديو تأثير التمرير الرقمي الصحيح، كانت نتائج التأثير كما هو متوقع رسوم متحركة تأثيرية |
عدد كبير جدًا من الشخصيات المرجعية
ظاهرة نموذجية
عندما يتجاوز عدد الشخصيات المرجعية 4، ينخفض استقرار مخرجات النموذج، وقد ينتج الفيديو المُولَّد عددًا غير متطابق من الشخصيات (مثل نقص أو زيادة) أو تكرار الشخصيات.
الحلول
حاليًا يمكن تخفيف ذلك من خلال الطرق التالية، وسيتم التحسين الجذري لاحقًا من خلال تحديث النموذج:
قبل التحسين | بعد التحسين |
إدخال 8 شخصيات مرجعية، الفيديو الناتج يظهر 9 أشخاص | توليد 8 شخصيات في صورتين، ثم استخدام الصور لإنشاء فيديو |
ضوضاء في نهاية الفيديو
ظاهرة نموذجية
عندما يحتوي الفيديو على تعليق صوتي، قد تظهر أصوات نقر مفاجئة أو ضوضاء مقطوعة في نهاية الفيديو.
الحلول
أعد توليد الفيديو، أو استخدم أدوات المونتاج مثل CapCut، وقم بتطبيقمنحنى مستوى الصوتعلى المسار الصوتي في نهاية الفيديو لعمل تلاشي صوتي، لإزالة ضوضاء القطع.
الخطوات المحددة (باستخدام CapCut):

قبل التحسين | بعد التحسين |
نهاية بها ضوضاء | نهاية بدون ضوضاء |
النطق الصيني غير دقيق
ظاهرة نموذجية
يميل النموذج إلى الخطأ في نطق الأحرف متعددة النطق، والأحرف النادرة، والأحرف المتشابهة شكليًا.
الحلول
يمكن استبدال الأحرف التي يسهل نطقها بشكل خاطئ بـأحرف شائعة متجانسة النطق، لتجنب انحرافات النطق واستعادة تأثير الصوت المطلوب. لاحظ أن هذا الحل هو مجرد وسيلة تحسين، ولا يمكنه تجنب جميع مشاكل النطق تمامًا.
مثال: يمكن إعادة كتابة "جبل تشيلونغ" في المطالبة إلى "جبل تشي لونغ" باستخدام أحرف متجانسة.
قبل التحسين | بعد التحسين |
نطق "螭" في "螭龙山" غير صحيح | بعد تغييره إلى "吃龙山" أصبح النطق صحيحاً |
مرجع الجرس الصوتي غير دقيق
ظاهرة نموذجية
عند استخدام صوت مرجعي لتحديد الجرس، يكون هناك انحراف واضح بين جرس الصوت في الفيديو النهائي والجرس المرجعي.
الحلول
قبل التحسين | بعد التحسين |
النبرة لا تتطابق مع الصوت المدخل الصوت المدخل | بعد إضافة وصف خصائص النبرة في النص التوجيهي، تحسنت مطابقة النبرة بشكل ملحوظ "استخدم صوت رجل في منتصف العمر عميق ودافئ مع حبيبات خشنة دقيقة من @صوت1 ليقول" |
الملحق: أمثلة على المطالبات
عرض أمثلة على المطالبات باستخدام نماذج سلسلة Seedance 2.0 في سيناريوهات مختلفة، لمساعدتك على تحقيق التحكم في الإشارة متعددة الوسائط وتوليد النصوص بدقة أكبر.
توليد النص
شعار إعلاني (Slogan)
قالب المطالبة المرجعي:
«محتوى النص» + «توقيت الظهور» + «موقع الظهور» + «طريقة الظهور»، «خصائص النص (اللون، الأسلوب)»
مرجع متعدد الصور > مرجع الشعار.
مثال مرجعي:
[النتيجة النهائية]
[المطالبة]
أسلوب رسم كاريكاتيري يدوي، ثلاثة أشخاص يجلسون معًا ويأكلونالصورة1الدجاج المقلي في، جو ودي ومبهج، ثم تتلاشى الصورة تدريجيًا، يظهر في منتصف الشاشة نص “السعادة في Seedance”.
[المواد المرجعية]

▲ صورة 1
ترجمة
قالب المطالبة المرجعي:
تظهر ترجمة في أسفل الشاشة، محتوى الترجمة هو "..."، يجب أن تكون الترجمة متزامنة تماماً مع إيقاع الصوت.
مثال مرجعي:
[النتيجة النهائية]
[المواد المرجعية]

[المطالبة]
إنشاء فيديو مع تعليق صوتي خارجي. صوت رجل عميق وهادئ يقول: "في الكون الشاسع، عالمنا ليس إلا لحظة عابرة. ومع ذلك، داخله، تزدهر الحياة بكل قوة." يجب أن ينتقل المشهد ببطء من الليل إلى الفجر، تختفي النجوم تدريجياً، وتشرق الشمس من خلف الجبل. تظهر ترجمة أسفل الشاشة وفقاً للنص.
[النتيجة النهائية]
[المواد المرجعية]

[المطالبة]
الشخصان في الصورة يتحدثان في المكتب، المرأة تتحدث أولاً، تقول: "أنت تصل في الوقت المحدد دائماً، هل تستمتع حقاً بهذا الشعور بالضبط؟" الرجل يرد مبتسماً: "لدي إيقاعي الخاص" عندما تتحدث الشخصيات، يكون الحوار طبيعياً وعفوياً، وتظهر ترجمة النص المقابل في أسفل الشاشة.
فقاعة حوار
قالب المطالبة المرجعي:
«الشخصية» تقول: “…”، تظهر فقاعة حول الشخصية أثناء الحديث، وتحتوي الفقاعة على الحوار.
مثال مرجعي:
[النتيجة النهائية]
[المواد المرجعية]

[المطالبة]
الصورة1الشخصان في يرتديان ملابس رياضية ويركضان في ملعب المدرسة، الفتاة تنظر إلى الفتى وتقول بثقة وابتسامة: "We can definitely do it!" تنتقل الكاميرا إلى لقطة قريبة للفتى، يجيب بتردد: "Are you sure?" تنتقل الكاميرا إلى لقطة متوسطة قريبة للفتاة، تقول بنبرة خفيفة: "Yes!" المشاعر مشرقة وحازمة. تظهر فقاعات حول الشخصيات المتحدثة، داخل الفقاعات النص المقابل.
[النتيجة النهائية]
[المواد المرجعية]

[المطالبة]
بالرجوع إلىالصورة1،الصورة2صورة الفتاة في، الفتاة في مزرعة فراولة، تقطف واحدة، تأكل قضمة، وتقول مبتسمة: “This is the real deal! ” تظهر فقاعة حول الفتاة، تحتوي الفقاعة على الحوار.
الرجوع إلى صورة
تدعم نماذج سلسلة Seedance 2.0 الإشارات متعددة الزوايا للكائن، بالإضافة إلى الصور المرجعية المتعددة مثل صور المشهد وصور القصة المصورة.
أثناء الاستخدام، إذا كان هناك ترتيب محدد للصور، يجبالرفع بالترتيب، ويمكن استخدامالصورة1،الصورة2…الصورةnللإشارة بدقة.
مرجع متعدد الزوايا للكائن
يكفي الإشارة بوضوح إلى الكائن المرجعي، ويمكن للنموذج الاستجابة للأوامر بما في ذلك الأمثلة التالية.
منتج:
إلكترونيات 3C
[النتيجة النهائية]
[المواد المرجعية]

[المطالبة]
استخرجالصورة1،الصورة2،الكاميرا من الصورة3، غير الخلفية إلى الأبيض، الكاميرا على طاولة بيضاء، الكاميرا تركز على الكاميرا بلقطة مقربة، ثم تدور ببطء حول الكاميرا ككائن رئيسي، لعرض الجانب الأمامي والجانبي والخلفي بوضوح.
أدوات منزلية
[النتيجة النهائية]
[المواد المرجعية]

[المطالبة]
الخلفية عبارة عن مشهد منزلي دافئ، لقطة متوسطة لكوب العزل في الصورة المرجعية، الكاميرا تقترب بثبات إلى لقطة قريبة لكوب العزل، يد من خارج الإطار تدخل بشكل طبيعي وتمسك بالكوب برفق لترفعه، الكاميرا تتبع حركة اليد الدوارة الطفيفة لعرضها.
شخصية:
[النتيجة النهائية]
[المطالبة]
بالرجوع إلىالصورة1،الصورة2،الكاميرا من الصورة3صورة المرأة في، قم بإنشاء مشهد لها وهي تأكل كعكة في مقهى.
[المواد المرجعية]

مرجع متعدد الصور
مرجع الشعار
[النتيجة النهائية]
[المواد المرجعية]

[المطالبة]
الخلفية عبارة عن ممر جوي في مدينة مستقبلية مع أضواء نيون، طائرات وإعلانات ثلاثية الأبعاد متداخلة، راجعالصورة2الفتاة في، اعرض أولاً الفتاة بلقطة متوسطة وهي تطلق مصباحًا فضيًا عائمًا بإسقاط ثلاثي الأبعاد، ثم ابتعد الكاميرا لإظهار المصابيح العائمة في السماء، تتلاشى الصورة تدريجيًا، ثم يظهرالصورة1شعار، الأسلوب العام هو أسلوب رسوم متحركة خيال علمي سايبربانك ثلاثي الأبعاد.
مرجع متعدد الكائنات
[النتيجة النهائية]
[المواد المرجعية]

[المطالبة]
ارجع إلى القطة والكلب في الصورة المرجعية، في شقة دافئة، الكلب يأكل طعام الكلاب، تأتي القطة وتلمس الكلب بمخلبها، يتوقف الكلب عن الأكل عند رؤية القطة، تحتضن القطة بجانب الكلب. استخدم ألوان دافئة.
مرجع متعدد العناصر
[النتيجة النهائية]
[المواد المرجعية]

[المطالبة]
المشهد يقع فيصورة4المطعم في، داخل المطعم زبائن يتنقلون.الصورة1الفتاة في ترتديالصورة2الملابس في، وهي ترتب الأشياء على المنضدة.الكاميرا من الصورة3الفتى في هو زبون، يتقدم نحوها، يريد طلب معلومات الاتصال.صورة5العلامة في تظهر دائماً في الزاوية اليمنى السفلية من الشاشة.
مرجع لوحة القصة متعددة الإطارات
[النتيجة النهائية]
[المواد المرجعية]

[المطالبة]
ارجع إلى لوحة القصة في الصورة المرجعية، قم بإنشاء مشهد قتال عنيف. يجب أن تظهر تركيبات الإطارات المختلفة في الصورة بالترتيب، ثم يتقاتل الاثنان بعنف.
مرجع تخطيط اللقطات
[النتيجة النهائية]
[المواد المرجعية]

[المطالبة]
بالرجوع إلىالكاميرا من الصورة3تخطيط اللقطة في، الفتاة تنتظر والدها لإنهاء الطهي، تقول: "아빠، 배고파요! 밥 다 됐어요؟"، مظهر الفتاة مرجع منالصورة1ثم تتحرك الكاميرا أفقياً إلى اليمين، وتنتقل إلىصورة4مشهد وتخطيط، مظهر الأب مرجع منالصورة2يجيبها الأب: "거의 다 됐어، 조금만 기다려!"، ثم تنتقل الكاميرا إلى لقطة قريبة لوجه الفتاة بتعبير خيبة أمل طفيف، تقول: "아직 멀었어요? 맛있는 냄새 나는데..."، ثم تنتقل إلى لقطة قريبة لوجه الأب، يقول: "이제 진짜 금방이야. '빨리빨리' 하지 말고 손부터 씻고 와!".
الرجوع إلى فيديو
تدعم نماذج سلسلة Seedance 2.0 مرجع الفيديو، عند الاستخدام يكفي الإشارة بوضوح إلى المحتوى المراد إنشاؤه والكائن المرجعي.
أثناء الاستخدام، إذا كان هناك ترتيب محدد للفيديوهات، يجبالرفع بالترتيب، ويمكن استخدامفيديو 1،الفيديو2…الفيديوnللإشارة بدقة.
مرجع الحركة
سينمائي
[النتيجة النهائية]
[المواد المرجعية]
▲ فيديو 1

[المطالبة]
بالرجوع إلىفيديو 1حركات الشخصيات ولغة الكاميرا في، إنشاءالصورة2والصورة1مشهد قتال بين،الصورة2هو الشخصية على اليسار،الصورة1هو الشخصية على اليمين. مع موسيقى خلفية حماسية.
تسويق
[النتيجة النهائية]
[المواد المرجعية]
▲ فيديو 1
[المطالبة]
بالرجوع إلىفيديو 1شكل جري الحصان في، قم بإنشاء حصان ذهبي يركض في المرج، ثم يتجمد في وضعية ركضه الأنيقة، ليصبح قلادة ذهبية على شكل حصان.
مرجع حركة الكاميرا
[النتيجة النهائية]
[المطالبة]
بالرجوع إلىفيديو 1حركة الكاميرا في، عمل فيديو مفهوم لمنطقة تكنولوجية، معالصورة1المبنى العالي في كمركز بصري، بنفس زاوية الانقضاض من منظور الشخص الأول، لإظهارالصورة1الإحساس التكنولوجي للمنطقة في.
[المواد المرجعية]
▲ فيديو 1

▲ صورة 1
مرجع المؤثرات الخاصة
سينمائي
[النتيجة النهائية]
[المواد المرجعية]
▲ فيديو 1

▲ صورة 1
[المطالبة]
بالرجوع إلىفيديو 1تأثير الجزيئات الذهبية في، دعالصورة2الشخصية في تعزف على الناي بينما تحيط بها نفس تأثيرات الجزيئات.
تأثيرات اللعبة
[النتيجة النهائية]
[المواد المرجعية]
▲ فيديو 1

▲ صورة 1
[المطالبة]
بالرجوع إلىفيديو 1تأثيرات، تجعلالصورة1الفتاة في تنمو لها أجنحة مماثلة، مسار نمو الأجنحة متطابق.
تحرير الفيديو
تدعم نماذج سلسلة Seedance 2.0 تحرير الفيديو، بما في ذلك إضافة أو حذف أو تعديل العناصر، وتمديد الفيديو للأمام أو للخلف، وملء المسار.
أثناء الاستخدام، إذا كان هناك ترتيب محدد للفيديوهات، يجبالرفع بالترتيب، ويمكن استخدامفيديو 1،الفيديو2…الفيديوnللإشارة بدقة.
إضافة/حذف/تعديل العناصر
إضافة عناصر
[النتيجة النهائية]
[المواد المرجعية]
▲ فيديو 1
[المطالبة]
علىفيديو 1سطح الطاولة في، أضف وجبات خفيفة مثل الدجاج المقلي والبيتزا.
حذف العناصر
[النتيجة النهائية]
[المواد المرجعية]
▲ فيديو 1
[المطالبة]
مسحفيديو 1الأجزاء والأدوات الأخرى على الطاولة، الحفاظ على نظافة الطاولة وترتيبها، فقط ما في أيديهما.
تعديل العناصر
[النتيجة النهائية]
[المواد المرجعية]
▲ فيديو 1

▲ صورة 1
[المطالبة]
استبدل العطر فيفيديو 1بكريم الوجه فيالصورة1، مع الحفاظ على الحركة وحركة الكاميرا كما هي.
تمديد الفيديو
تمديد للخلف
[النتيجة النهائية]
[المواد المرجعية]
▲ فيديو 1
[المطالبة]
قم بإنشاءفيديو 1المحتوى بعد، يركض الرجلان المتأخران إليهما، يجتمع الخمسة أخيرًا ويتحدثون بود.
تمديد للأمام
[النتيجة النهائية]
[المواد المرجعية]
▲ فيديو 1
[المطالبة]
تمديد للأمامفيديو 1، لقطة فوق كتف الرجل ذو القميص الأبيض، يقول الرجل ذو القميص الأبيض: “It’s not that bad. You're just stressed. Everyone goes through this, you just need to keep going.”
ملء المسار
مثال مرجعي:
[النتيجة النهائية]
[المطالبة]
فيديو 1، لحظة سقوط الأوراق، تثير تأثير جزيئات ذهبية، تهب رياح، ثمالفيديو2.
[المواد المرجعية]
▲ فيديو 1
▲ فيديو 2