عرض لفترة محدودة! أطلق عام كامل من الإبداع بلا حدود مع الخطط السنوية بخصم يصل إلى 27%.

عرض الخطة ›
أدلة الفيديو

دليل Seedance 2.0

O
فريق OpenArt
Apr 24, 2026 · قراءة لمدة 7 دقائق
The Seedance 2.0 Handbook

In February 2026, ByteDance dropped Seedance 2.0. Within 24 hours it was everywhere, because a filmmaker generated a Hollywood-quality fight scene with a two-line prompt. The Deadpool screenwriter saw it and publicly posted that it was likely over for screenwriters. Elon Musk replied. The Motion Picture Association issued a formal statement the same day. ByteDance pulled the ability to generate real celebrity likenesses, tightened the guardrails, and the internet held its breath wondering if the model had been gutted in the process.

لم يكن كذلك. فالقدرة الأساسية، والحركة، والفيزياء، والانتقال، والأداء العاطفي، بقيت كلها سليمة. وبصراحة، هذه النقاشات يجب أن تحدث. فالذكاء الاصطناعي التوليدي يتقدم أسرع من قدرة أي إطار قانوني على مواكبته، وكيفية تعامل الصناعة مع ذلك أمر مهم. لكن ذلك فيديو آخر. ما يمكننا إخبارك به هو أن Seedance 2.0 هو أقوى نموذج فيديو في السوق حالياً، وهو متاح الآن على OpenArt.

شرح Ermin Monzon، رئيس قسم محتوى الوسائط والتعليم لدينا، سبب أهمية النموذج من الناحية التقنية. واختبر مبدعنا الداخلي Bob كل نوع مرجعي يمكن أن يخطر بباله بشكل مكثّف. وبنت شريكتنا Mia Meow دليل سير عمل من 10 نصائح بناءً على أسابيع من الاختبار. يجمع هذا الدليل أقوى المواد من الثلاثة ليمنحك صورة كاملة واحدة.

ما الذي يمكن أن يفعله Seedance 2.0 ← نظرة عامة من Ermin

قبل الخوض في نصائح سير العمل، من المفيد أن نفهم سبب ردود الفعل التي يثيرها هذا النموذج. استعرض Ermin سلسلة من العروض التوضيحية التي تُظهر أين يتفوق Seedance 2.0 على كل ما هو موجود في السوق.

The fight scene that broke the internet is the obvious headline, but the demo that surprised Ermin more was a dancer with neon light trails sweeping around them in orbital arcs. It looks like a Nike commercial or a music video with a serious production budget. The reason this is technically significant is that the light trails are not composited over the dancer. The model generated both simultaneously. The motion and the effect interact with each other: the trails bend around the dancer's body, and the lighting from the trails actually reflects on the floor beneath them. That is called coherent VFX generation. The model understands that light behaves physically. It does not just paint glowing lines on top of video. For anyone doing music video content, UGC ads, or anything with a visual effects component, this is where Seedance 2.0 stands apart.

عرض توضيحي آخر يستحق المشاهدة: متزلج ينطلق من فوق جبل مع سلسلة جبال ألبية تملأ الخلفية. فيزياء رذاذ الثلج، ودوران الجسم، والهبوط. كلها مُنشأة، وكلها معقولة فيزيائيًا. يتعامل النموذج مع الحركة والأكشن على مستوى لا تضاهيه أي أداة أخرى متاحة للعامة حاليًا.

من النص إلى الفيديو: بنية الـ prompt للقطة الواحدة → عند 0:50 في فيديو Mia

كل ما تسمعه في عروض تحويل النص إلى فيديو من Mia — الصوت والصوت المحيط — تم توليده في اللحظة نفسها مع الفيديو. Prompt واحد، ولقطة واحدة. تكافح النماذج الأخرى لتحافظ على هذا الكم من التفاصيل في عملية توليد واحدة. أما Seedance 2.0 فيلتزم فعلاً بما تعطيه إياه.

بنية Mia للأوامر في اللقطات أحادية التصوير بسيطة. ابدأ بـ "continuous single take" وحركات الكاميرا التي تريدها. ثم صف ما تراه الكاميرا أثناء تحركها. واختم بكلمات مفتاحية للتحكم والأسلوب: no cuts, seamless transition, cinematic, high definition. هذه الصيغة وحدها ستمنحك نتائج قوية.

لمشاهد أكثر تعقيدًا، مثل مشهد قتال عند الدقيقة 2:13, Mia recommends starting with a clear beginning and end state. Describe the fight scene, describe how it ends (everyone on the ground, for example), and let the model fill the middle. She also found that describing specific camera angles creates a more cinematic feel, and adding a film genre reference to the end of the prompt helps set the visual tone. One thing she discovered through iteration: if you describe your characters physically in the prompt rather than leaving it vague, the model does a better job designing the scene and keeping characters visually distinct.

رؤية Mia الأساسية حول كتابة الأوامر: النموذج مُدرَّب جيداً على لغة السينما. فمصطلحات مثل "tracking shot" و"crane shot" و"whip pan"، وإيحاءات النوع مثل "gritty war film" أو "neo-noir thriller" تحدث فرقاً كبيراً.

How to add references and tag UI 2fps.gif

يغطي شرح Mia الكامل جميع نصائحها العشر لسير العمل، بما فيها تلك التي لخّصناها في هذا الدليل. شاهده بالتوازي أو عد إليه لاحقًا.

نظام المراجع: وضع علامات على الصور والفيديو والصوت داخل الـ prompt ← 4:27 في فيديو Mia · → تحليل Bob المعمّق للمراجع

هذه هي الآلية الأساسية التي تشغّل كل شيء آخر في Seedance 2.0 على OpenArt، وبمجرد أن تفهمها، سيصبح كل قسم يليها أكثر وضوحاً.

الفكرة بسيطة: يمكنك رفع صور ومقاطع فيديو وملفات صوتية كمراجع، ثم الإشارة إليها مباشرة داخل موجّهك النصي باستخدام رمز @. اكتب @ ويمكنك اختيار الملف المرفوع الذي تريد الإشارة إليه. من هناك، تخبر النموذج بالضبط بما تريد فعله بكل ملف. استخدم الوجه من الصورة الأولى. استخدم حركة الكاميرا من الفيديو الأول. زامِن الشفاه مع الصوت الأول. يقرأ النموذج موجّهك، وينظر إلى الملفات المُشار إليها، ويجمع كل شيء في إنشاء واحد.

Mia's جولة متعددة الوسائط عند 4:27 هي أوضح شرح لكيفية عمل ذلك. فقد رفعت فيديو رقص وصورتَي شخصيتين وأغنية، ثم أمرت النموذج باستخدام الفيديو كمرجع لحركة الكاميرا، والصورة الأولى للراقصة على اليسار، والصورة الثانية للراقصة على اليمين، والصوت كموسيقى خلفية. جميعها مُشار إليها بـ @، وكلها في موجّه واحد.

Bob pushed this further. In one of his demos, he referenced four different files in a single prompt: the face from image one, the overalls from image three, the shirt from image four, and a location from a reference video. The prompt was: the man in image one is walking down the street from the video wearing the overalls from image three and carrying the shirt from image four, talking to the camera. The model held consistency across every element. That is a remarkable amount of compositing happening from a single text prompt.

Bob 4-element compositing demo.jpg

بضعة أمور تعلّمها كلا المبدعَين عن كيفية تصرّف المراجع:

إذا كان الفيديو المرجعي يحتوي على صوت وأضفت أيضاً ملف صوت منفصلاً، يميل النموذج إلى تفضيل الصوت الموجود في الفيديو على المقطع الصوتي الذي رفعته. حل Mia البديل: ارفع الفيديو بدون صوت إذا أردت أن تكون الأولوية لموسيقاك أو تعليقك الصوتي.

لا تقتصر المراجع على العناصر الملموسة. يمكنك أيضًا الإشارة إلى فيديو والقول "أريده أن يبدو هكذا فقط" دون نسخ أي شيء آخر. استخدم Bob هذا لنقل أسلوب بصري (عدسة عين السمكة، إضاءة وامضة) من فيديو إلى مشهد جديد تمامًا.

لست مضطراً لاستخدام كل أنواع المراجع دفعة واحدة. استخدام صورة شخصية واحدة ضمن prompt نصي هو استخدام سليم تمامًا للنظام. تزداد قوته بحسب عدد العناصر التي تضيفها، لكنه يعمل بكفاءة عند كل مستوى من التعقيد.

Seedance Reference system wiring diagram.gif

مزامنة الشفاه والصوت والأداء ← الدقيقة 7:57 في فيديو Mia · ← تحليل Bob الصوتي المعمّق

يغطي فيديو Bob الكامل المراجع عبر الصور والصوت والفيديو بعمق. ويبرز حقًا في قسمي مزامنة الشفاه واستنساخ الصوت.

هذا هو القسم الذي يضم أكبر عدد من النصائح من أكبر عدد من المبدعين، ولسبب وجيه. قدرات الصوت في Seedance 2.0 هي الميزة التي تميّزه عن كل ما هو موجود في السوق حاليًا.

حيلة بوب في النص المكتوب

هذه هي أكثر نصيحة مفيدة عبر الفيديوهات الثلاثة كلها. عند مزامنة الشفاه مع مرجع صوتي، أدرج النص الفعلي للكلمات في الـ prompt إلى جانب الملف الصوتي. وإليك السبب.

Bob tested this with a clip of himself talking to camera. In his first attempt, he tagged the audio file and described the scene but did not include the exact words being spoken. The model listened to the audio and tried to replicate it, but got details wrong ("CGI 2.0" instead of "Seedance 2.0"). When he modified the prompt to explicitly spell out the words being said, the audio file combined with the written transcript produced dramatically better results. The lip sync was tighter, the words were accurate, and the overall performance was more convincing.

The transcript trick before after.jpg

الخلاصة: كلما أجريت مزامنة للشفاه، قدّم النص الفعلي مع الملف الصوتي. فأنت مضمون تقريبًا للحصول على نتيجة أفضل.

طابق مدة الصوت مع مدة الفيديو

تعلّمت ميا هذا بالطريقة الصعبة. إذا كان المرجع الصوتي لديك مدته 11 ثانية وضبطت الفيديو على 15 ثانية، فسيُضطر النموذج إلى تمديد الصوت أو ضغطه ليتناسب، ومن شبه المؤكد أنك ستفقد التزامن. طابق دائمًا إعداد المدة مع الطول الفعلي لملفك الصوتي.

استنساخ الصوت

عرض Bob استنساخ الصوت باستخدام مقطع مدته 15 ثانية من صوت Ermin (العم Monz في مكتب OpenArt). طريقة الإعداد: سجّل نحو 15 ثانية من الصوت بطريقة تلتقط الصفات التي تريد نسخها. صنّف ذلك المقطع الصوتي كمرجع صوتي وليس كمصدر لمزامنة الشفاه. ثم اكتب الحوار الفعلي في الـ prompt، وسيولّد النموذج كلامًا جديدًا بذلك الصوت.

كانت المحاولة الأولى سريعة جدًا مقارنةً بإيقاع إرمين الطبيعي. فأعطى بوب النموذج 14 ثانية كاملة بدلًا من 9، وجاءت النتيجة أشبه بكثير بطريقة كلام إرمين الحقيقية. الدرس المستفاد: الإيقاع لا يقل أهمية عن عيّنة الصوت. امنح النموذج وقتًا كافيًا لأداء الكلمات بالسرعة المناسبة لذلك الصوت.

يمكنك إعادة استخدام مرجع الصوت نفسه عبر عدة فيديوهات للحفاظ على اتساق صوت الشخصية.

نصائح Mia لإخراج الأداء → 12:20 في فيديو Mia

اكتشفت ميا أنه بإمكانك توجيه الأداء العاطفي وطاقة الشخصية عبر الـ prompt نفسه. فالكلمات التي تكتبها تؤثر في طريقة إلقاء الشخصية للحوار، لا في مضمونه فقط. إذا كتبت "يقولها بحماس"، تتغيّر لغة جسد الشخصية وطاقة صوتها. وإذا كتبت "تهمس بتوتر"، يتغيّر الأداء بأكمله.

ينطبق هذا أيضًا على شخصيات متعددة في المشهد ذاته. عند 11:10 في فيديو Miaتُظهر كيفية منح شخصيتين شخصيتين صوتيتين وحالتين عاطفيتين مختلفتين في prompt واحد، ويحافظ النموذج على تمييزهما.

نصيحة Mia حول الحاجز السلبي

عندما تريد انتقالات نظيفة من مشهد إلى مشهد دون تحوّل تدريجي بينها (على سبيل المثال، السرد عبر أربع صور مختلفة)، تعلّمت Mia إضافة ضوابط سلبية إلى المطالبة: "no morphing, no ghosting, no camera cuts". فبدونها، يمزج النموذج أحيانًا المشاهد معًا بطرق تبدو كخلل بصري. ومع الضوابط، تحصل على انتقالات واضحة من مشهد إلى آخر.

Lip sync and voice tips.jpg

مراجع متقدمة: الحركة واللوحات القصصية والأسلوب ← 13:22 في فيديو Mia · ← مراجع فيديو Bob

بمجرد أن تفهم كيف يعمل نظام المراجع للوجوه والأصوات، إليك ما يمكنك توجيهه إليه أيضًا.

نقل الحركة والكاميرا

إذا كانت لديك لقطة تعجبك فيها طريقة تحرك الكاميرا، يمكنك نقل حركة الكاميرا تلك إلى مشهد جديد تماماً. أوضح Bob هذا بفيديو لكلب يقفز صعوداً وهبوطاً بينما تتحرك الكاميرا حوله. أدخل ذلك الفيديو كمرجع وقال "استخدم هذا الفيديو كمرجع لحركة الكاميرا والشخصية لتوجيه فزّاعة تقفز على ترامبولين." نقل الناتج كلاً من حركة الكاميرا وحركة القفز إلى الشخصية والمشهد الجديدين.

كما عرض نقل الحركة باستخدام لقطات حقيقية. باستخدام مقطع لإميلي وهي تركض عند 19:15، قال: «استبدل المرأة في الفيديو الأول بالرجل في الصورة الأولى مع تساقط الثلج.» فبدّل النموذج الشخصية، وأضاف أجواء الشتاء، وحافظ على حركة الجري كما هي. تغيّرت بعض تفاصيل الخلفية (تحوّل المشهد العام إلى ألوان رمادية شتوية)، لكن الحركة الأساسية بقيت ثابتة.

Character Swap Split Screen LRB.mp4

من لوحة القصة إلى الفيديو ← 13:22 في فيديو Mia

يمكنك رفع شبكة على نمط لوحات القصص المصورة أو لوحة سيناريو، وسيحاول النموذج التحريك عبرها لوحة تلو الأخرى. اختبرت Mia هذا باستخدام شبكة مرسومة يدويًا ووجدت أن النموذج اتبع اللوحات بالترتيب، لكن المنطق الاتجاهي بين اللوحات لم يكن دائمًا واضحًا للنموذج من المرئيات وحدها.

نصيحتان جعلتا هذا يعمل بشكل أفضل. أولًا، صف المنطق السردي بين اللوحات في الـ prompt الخاص بك. فالنموذج يحتاج إلى فهم تطور القصة، وليس مجرد التسلسل البصري. ثانيًا، إذا كانت لوحتك القصصية تحتوي على نص أو تعليقات، أضف "text overlay no captions on screen" إلى الـ prompt لمنع تسرب النص إلى الفيديو المُولَّد.

تشير Mia أيضًا إلى أنه يمكنك استخدام صفحات كتب مصوّرة فعلية لهذا الغرض، لكن كن حذرًا مع أي شيء يتعلق بملكية فكرية قائمة.

المراجع الأسلوبية واستنساخ القوالب ← 14:45 في فيديو Mia

Mia's template replication tip is a practical one for anyone producing content at volume. If you have a video with a visual style you like, you can reference it and tell the model to replicate just the style, not the content. She tested this by pointing to a video and saying she only wanted the fisheye lens effect and the flickering double-exposure look, then combined it with character images and outfit references to create a fashion sequence. The model picked up the abstract visual qualities without copying the specific content of the reference video.

هذا مفيد للحفاظ على هوية بصرية متسقة عبر سلسلة من مقاطع الفيديو. أنشئ فيديو يعجبك، ثم اعتمد نمطه مرجعًا لكل عملية توليد لاحقة.

ما بعد التوليد: التمديد والتعديل → 16:06 في فيديو Mia

الفيديو لا ينتهي بمجرد توليده. يتيح لك Seedance 2.0 التمديد والتحرير وإعادة الكتابة لاحقاً.

Extend Video__Extend Video.gif

توسيع. ارفع فيديو تريد متابعته، واختر التمديد للأمام (أو للخلف)، وحدّد عدد الثواني، واضبط إعداد المدة ليتطابق، وصِف ما تريد حدوثه في الجزء الجديد. مدّدت Mia فيديو للأمام بمقدار 10 ثوانٍ، ثم مدّدته للخلف بمقدار 10 ثوانٍ ودمجتهما في مشهد سلس أطول من حد الإنشاء البالغ 15 ثانية. هذا اختراق حقيقي. كان حد الـ 15 ثانية سقفًا صارمًا. يمكنك الآن مواصلة بناء مشاهد سلسة أطول دون قطعات.

تحرير. إذا أردت تغيير شيء حدث بالفعل في فيديو مُولّد، يمكنك التحدث إلى النموذج حول الفيديو الحالي وإخباره بما تريد تعديله. يعمل هذا بطريقة مشابهة للتحرير من فيديو إلى فيديو في Wan 2.7 لكن بفهم أقوى من Seedance 2.0 لما يحدث في المشهد.

الخلاصة

Seedance 2.0 is the most capable video model available on OpenArt right now, and the reference system is the reason to pay attention. The ability to tag images, video, and audio into a single prompt and have the model hold consistency across all of them is not something any other model is doing at this level. The lip sync is strong. The voice cloning works. The motion transfer is clean. The coherent VFX generation, where lighting and effects actually interact with the scene physically, is new territory entirely.

ثلاثة مبدعين، ثلاثة مقاطع، وخلاصة واحدة متسقة: هذا النموذج يُصغي. فهو يتّبع الـprompts المعقّدة متعددة العناصر أفضل من أي شيء آخر متوفر. وأفضل ما يمكنك فعله هو الدخول والبدء بطلب ما تريد منه، فلديه خيال مذهل. هذه كلمات Bob، وهو محقّ.

👉 جرّب Seedance 2.0 على OpenArt

أبدع بلا حدود

انضم إلى ملايين المبدعين الذين يستخدمون OpenArt لإنشاء الصور والفيديوهات والشخصيات والقصص - كلها في منصة واحدة.

ابدأ مجانًا →