دليل موجّهات Seedance 2.5: البنية والكاميرا والتوقيت والصوت والمراجع
كيف تكتب موجّهات Seedance 2.5: الصيغة الأساسية، ولغة الكاميرا، والطوابع الزمنية، وصيغة الحوار والصوت، والمراجع، والتحرير، وما يختلف في 2.0.
اقرأ بصيغة Markdownالموجّه الجيد لـ Seedance 2.5 يقول من يفعل ماذا، وأين، وكيف تصوّره الكاميرا، وماذا نسمع، بهذا الترتيب: الموضوع والحدث أولًا، ثم المشهد، فالأسلوب البصري، فالكاميرا، فالصوت. قسّم المقاطع الأطول إلى نطاقات زمنية مثل "0-3s" أو إلى لقطات مرقّمة، وسمِّ كل ملف مرجعي برقمه ("Image 1" و"Video 1")، واضبط طول المقطع ونسبة الأبعاد والدقة بصفتها معاملات في الطلب، لا في النص. القواعد أدناه مأخوذة من أدلة الموجّهات الرسمية التي نشرتها ByteDance لـ Seedance 2.5 و2.0، وتم التحقق منها في 29 سبتمبر 2026. وكل موجّه في الأمثلة كُتب لهذه التدوينة.
كيف تكتب موجّهًا لـ Seedance 2.5؟
ابدأ من الصيغة الأساسية لدى ByteDance: "الموضوع + الحدث أو الواقعة + المشهد والبيئة (اختياري) + الأسلوب البصري (اختياري) + حركة الكاميرا/القطع (اختياري) + الصوت (اختياري)". الجزء الأول وحده إلزامي. ويصف الدليل الموضوع والحدث بأنهما "أساس الفيديو"، ويتيح لك حذف الأجزاء التي لا تحتاجها.
عمليًا، تصبح الصيغة أربع جمل قصيرة:
<Subject> performs <main action or event> in <scene and environment>.
The visuals feature <visual style>.
Use <shot size, camera angle, camera movement, or cuts>.
Audio includes <dialogue, ambience, sound effects, or music>.نسخة مكتملة:
A street baker pulls a tray of round loaves from a brick oven at night and sets it on a flour-dusted counter.
Warm orange light from the oven, visible steam, shallow depth of field, realistic film look.
Start with a close-up of the oven door opening, then pull back slowly to a medium shot of the counter.
Audio: crackling wood, the scrape of the metal tray, quiet street noise outside.ثلاث عادات تصنع الفرق:
- صِف ما تريده، لا ما لا تريده. يطلب الدليل الرسمي "أوصافًا إيجابية كلما أمكن"، ويذكر الترجمة النصية والصوت بوصفهما الموضعين اللذين تُدعم فيهما التعليمات السلبية (انظر أدناه).
- أبقِ المعاملات خارج الموجّه. طول المقطع ونسبة الأبعاد والدقة وتوليد الصوت من عدمه كلها حقول في الطلب (
durationوratioوresolutionوgenerate_audio)؛ ويقول الدليل إن المعاملات "لا تحتاج إلى أن تُضمَّن في الموجّه". - اختم بالأشياء التي يجب أن تبقى ثابتة، مثل زاوية الكاميرا والمكان والجو العام، كي تثبت طوال المقطع.
كيف تتحكم في الكاميرا واللقطات؟
اكتب مصطلحات الكاميرا مباشرة. تسرد ByteDance أحجام اللقطات (واسعة جدًا، واسعة، متوسطة، متوسطة قريبة، قريبة)، والحركات (اقتراب، ابتعاد، تحريك أفقي، تتبّع، ملاحقة، دوران حول الموضوع، إمالة للأعلى، اهتزاز محمول باليد)، والزوايا (زاوية منخفضة، من الأعلى، منظور الشخص الأول)، إضافة إلى تقنيات مسمّاة مثل اللقطة الواحدة/اللقطة الطويلة، وdolly zoom، وFPV، وbullet time، وspeed ramp.
ولأي مصطلح أقل شيوعًا، أضف بعده شرحًا بلغة بسيطة. ومثال الدليل نفسه: "تحويل البؤرة: تنتقل البؤرة بسلاسة؛ فالأشجار التي كانت واضحة في المقدمة تصبح ضبابية، بينما تتضح الشخصية في الخلفية تدريجيًا."
وللقطع أو الانتقال، اذكر اللحظة والطريقة معًا، مثل "At the 5-second mark, a quick whip pan to the left into the next scene." (عند الثانية الخامسة، تحريك سريع خاطف إلى اليسار نحو المشهد التالي). ويضيف دليل Seedance 2.0 قاعدة ما زالت مفيدة على 2.5: حركة كاميرا واحدة لكل لقطة، لأن طلب "الاقتراب والابتعاد والتحريك والتنقل في الوقت نفسه" يجعل الصورة أقل ثباتًا.
والمشهد متعدد الكاميرات ليس سوى عدة لقطات مرقّمة، لكل منها تأطيرها:
Shot 1: Wide shot, locked-off camera, eye level. Two chess players sit across a table in an empty library.
Shot 2: Over-the-shoulder shot from behind the older player. The younger player moves a knight and looks up.
Shot 3: Close-up of the older player's hand hovering over the board, then tapping the table once.
Quiet room tone, the soft click of chess pieces, no music.هل يلتزم Seedance بالطوابع الزمنية؟
يلتزم بها Seedance 2.5، بالثواني الكاملة. أما Seedance 2.0 فلا. ومقارنة ByteDance صريحة: "لا يستجيب Seedance 2.0 للطوابع الزمنية ويستجيب لأرقام اللقطات فقط، بينما يدعم Seedance 2.5 الطوابع الزمنية بالثواني الصحيحة."
ثلاث صيغ تعمل على 2.5:
- النطاقات: "0-3s … 3-7s … 7-15s"، دون فجوات بينها.
- النقاط: "At the 2-second mark, a gust of wind lifts the tablecloth." (عند الثانية الثانية، ترفع هبة ريح مفرش الطاولة).
- التوقيت النسبي: "She waits by the door. After 3 seconds, the light in the hallway goes out." (تنتظر عند الباب. بعد 3 ثوانٍ، ينطفئ ضوء الممر).
وزّع المحتوى بما يتناسب مع الوقت الذي تمنحه له. فإذا حدث القليل في نطاق ما، يرتجل النموذج؛ وإذا حدث الكثير، يحذّر الدليل من أن النتيجة "قد تحتوي على قطعات مفرطة أو تُسقط أجزاء من الحبكة". ولا تستخدم الطوابع الزمنية لحركة متكررة سريعة، مثل هز الرأس ثلاث مرات في الثانية.
ولمقطع يصل إلى حد Seedance 2.5 البالغ 30 ثانية، اكتبه على مراحل، ولكل مرحلة حالة نهائية واضحة:
A lighthouse keeper's evening routine, realistic, cool blue dusk turning to night, no music.
0-6s: Wide shot of a lighthouse on a rocky coast at dusk. The keeper climbs the outside stairs with a lantern.
6-14s: Inside the lamp room, medium shot. He wipes the large lens with a cloth, then checks a brass gauge.
14-22s: Close-up of his hand turning a wheel. The main lamp starts to rotate and throws a beam across the room.
22-30s: Aerial shot pulling back from the tower. The beam sweeps over dark water. Waves and wind only.كيف تكتب الحوار والصوت والترجمة النصية؟
يولّد Seedance 2.5 الصوت مع الفيديو افتراضيًا (قيمة generate_audio هي true). ويمكن وصف كل شيء بجمل عادية، لكن الدليل الرسمي يحدد أقواسًا لحالات الحاجة إلى فصل أنواع الصوت:
| المحتوى | الصيغة | مثال |
|---|---|---|
| الموسيقى | ( ) | (soft piano plays in the background) |
| المؤثر الصوتي | < > | <a bell rings in the distance> |
| الحوار | { } | {Welcome back.} |
| الترجمة النصية | 【 】 | 【Chapter One】 |
وللحوار بلغة أو لهجة محددة، اذكرها قبل الجملة. وصيغة الدليل هي Dialogue Language + Regional Variety or Accent + Delivery Style + Speaker + {Dialogue}، مثل: Dialogue language: American English. The girl says in natural, conversational American English: {I thought you weren't coming.} وتقول ByteDance إن Seedance 2.5 يولّد الكلام أصليًا بأكثر من 10 لغات؛ ولا يسرد الدليل هذه اللغات، لذا اختبر لغتك. ولا تخلط اللغات داخل جملة واحدة، وهو ما يحذّر منه دليل 2.0، باستثناء أسماء العلم.
وحين تتحدث عدة شخصيات، اكتب طريقة الإلقاء مرة واحدة لكل جملة بالصيغة "جملة الشخصية (الانفعال): المحتوى". وقد وجد الدليل أن تكرار الكلمات بعد الجملة، أو إلحاق ملاحظات منفصلة عن النبرة والحركة بكلمات بعينها، من الأمور التي تدفع النموذج إلى إضافة ترجمة نصية.
والتعليمات السلبية تعمل هنا: "No subtitles" (بلا ترجمة نصية)، و"No BGM; only ambient and action sounds" (بلا موسيقى خلفية؛ أصوات المحيط والحركة فقط)، أو "No audio." (بلا صوت). وقد تتسلل الترجمة النصية رغم ذلك، وإن كان ذلك أقل مما في 2.0 بحسب ByteDance، كما أن فيديو مرجعيًا يحتوي على ترجمة نصية قد يتغلب على "no subtitles". ولمنح شخصية صوتًا أو أغنية موجودة، أرفقها بصفتها مرجعًا صوتيًا واربطها بتلك الشخصية، كما في مثال الدليل: "تصوّر Image 1 البطل John وتستخدم نبرة الصوت من Audio 1."
كيف تشير إلى الصور ومقاطع الفيديو والصوت في الموجّه؟
رقّم كل ملف بحسب ترتيب إرفاقه واربطه في النص. أمثلة ByteDance تُقرأ هكذا: "Images 1-2 هما الشخصية 1 وتقابلان Audio 1؛ وImages 3-4 هما الشخصية 2 وتقابلان Audio 2." ولا تعتمد على اسم مكتوب داخل الصورة؛ إذ يقول الدليل إن تسمية صورة "John" ثم كتابة "John is at school" "قد يسبب بسهولة خلطًا بين الشخصيات أو تكرارها".
قل ما الغرض من كل ملف، وما الذي يجب تجاهله:
Image 1 defines the courier's face, hairstyle and yellow raincoat. Do not use the image background.
Image 2 defines the narrow alley, wet cobblestones and neon reflections. Do not use any people in it.
Video 1 defines the running pace and the handheld follow camera only.
The courier from Image 1 runs through the alley from Image 2 at night, jumps a puddle, and stops at a green door.وإذا كان الفيديو المرجعي يعرض الحركة المطلوبة بالضبط، فقل "follow the actions and camera movement in Video 1" (اتبع الحركات وحركة الكاميرا في Video 1) بدلًا من إعادة وصف كل خطوة؛ فإعادة الوصف قد تتعارض مع الفيديو. وحين تعرض عدة صور الشيء نفسه من زوايا مختلفة، قل ذلك ("All four images show the same desk lamp; only one lamp appears")، وإلا فقد يعاملها النموذج كأشياء منفصلة.
كم ملفًا تستخدم: يقبل Seedance 2.5 ما يصل إلى 30 صورة و10 مقاطع فيديو و10 مقاطع صوتية (ولمقاطع الفيديو والصوت 30 ثانية كحد أقصى لإجمالي كل منهما). وتوصي ByteDance بعدد من 1 إلى 8 موضوعات عبر صور الموضوعات، ومن 1 إلى 5 موضوعات بطول 5 إلى 10 ثوانٍ لكل منها في مراجع الفيديو أو الصوت؛ والأكثر مسموح به لكنه أقل ثباتًا. ويقبل Seedance 2.0 ما يصل إلى 9 صور و3 مقاطع فيديو و3 مقاطع صوتية، ويوصي دليله بـ 4 إلى 5 ملفات إجمالًا. ولشكل الطلب الخاص بكل نوع من المراجع، راجع كيف تضيف صورًا ومقاطع فيديو وصوتًا. والصور ومقاطع الفيديو المرجعية التي تظهر فيها وجوه أشخاص حقيقيين تُرفض؛ وهذه التدوينة تشرح الخطأ وما المسموح به.
كيف تكتب موجّهًا لتحرير فيديو أو تمديده؟
على SeedRouter، التحرير والتمديد من ميزات Seedance 2.5: أرسل فيديو مرجعيًا واحدًا واضبط omni_reference_task_type على edit أو extend. وعندها على الموجّه أن يؤدي أمرين.
في التحرير، حدّد النطاق وصِف التغيير من A إلى B. ضمّن كلمة مفتاحية مثل add أو remove أو replace أو change to (أضف، احذف، استبدل، غيّر إلى)، واستخدم نطاقًا زمنيًا للتعديلات الجزئية. ومثال الدليل: "غيّر حركة الرجل من شرب القهوة إلى مسح الأرضية من الثانية 4 إلى 6 في Video 1، واترك بقية المحتوى دون تغيير." واستبدال شيء بآخر يتبع النمط نفسه:
Edit Video 1: replace the paper coffee cup on the desk with the green ceramic mug from Image 1. Keep the person, the camera and the audio unchanged.في التمديد، قل في أي اتجاه وابدأ من الإطار الحدّي. استخدم "extend forward" أو "extend backward" أو "continue"، ثم صِف ما يحدث بعد ذلك:
Continue Video 1: the cyclist reaches the top of the hill, stops, and takes off her helmet. The camera stays on the same side angle. Wind and distant birds.يحتفظ التحرير والتمديد بنسبة أبعاد الفيديو المصدر، لذا اترك ratio على adaptive؛ ويحتفظ التحرير أيضًا بطوله، لذا يجب أن تكون duration هي -1. وتوصي ByteDance بصيغة MOV للمدخلات والمخرجات معًا (output_format: "mov") للحصول على أفضل استمرارية في الألوان والصوت. وإذا أعطى طلب يجمع المراجع والتعديلات نتائج غير مستقرة، فحلّ الدليل هو تقسيمه إلى مهمة مراجع ثم مهمة تحرير. وأجسام الطلبات الدقيقة موجودة في كيف تحرّر مقطعًا أو تمدّده.
كيف تستخدم لوحات القصة والإطارات المفتاحية؟
لكل منهما وظيفة مختلفة. لوحة القصة متعددة الخانات، أي عدة إطارات في صورة واحدة، مرجع مرن للحبكة: فالنموذج "لا يلتزم بها بدقة". أما الإطارات المفتاحية، وهي صور منفصلة مرفقة بالترتيب، فيتبعها النموذج عن قرب.
- لوحة القصة: استخدم رسومًا خطية بسيطة أو شخصيات عيدانية بلا نص، وبعدد 15 خانة أو أقل. حدّد صورة لوحة القصة أولًا، واكتب ملخصًا للقصة في سطر واحد، ثم صِف كل لقطة لتكمل ما لا يُظهره الرسم (الحركة، والكاميرا، والأسلوب).
- الإطارات المفتاحية: أرفق كل إطار بصفته صورة مرجعية مستقلة، وافتتح الموجّه بعبارة "Use Images 1 to 6 in order as keyframes." (استخدم الصور من 1 إلى 6 بالترتيب كإطارات مفتاحية).
- الإطار الأول والأخير: اضبط دور الصورتين على
first_frameوlast_frame. يثبّت هذا المخرجات على نسبة أبعاد الصورة الأولى، لذا استخدم صورتين بالنسبة نفسها. أما ضبطهما بصفتهماreference_imageوكتابة "Image 1 is the first frame" فلا يثبّت النسبة، لكن المخرجات قد لا تطابق الصورتين تمامًا.
ما الذي يختلف عند كتابة موجّه لـ Seedance 2.0؟
البنية نفسها (الموضوع، والحدث، والمشهد، والكاميرا، والأسلوب، والصوت)، لكن دليل 2.0 يطلب أمورًا قليلة لم يعد 2.5 يحتاج إليها:
- لقطات، لا ثوانٍ. نظّم المقطع بصيغة "Shot 1 / Shot 2 / Shot 3" ودع النموذج يضبط الإيقاع؛ فدليل 2.0 يصف التوقيت الدقيق بأنه "غير مستقر".
- حركة هادئة ومتصلة. يفضّل "الحركات الدقيقة البطيئة والهادئة والمتماسكة" على العدو والقفزات الكبيرة والتدحرج العنيف، ويطلب منك وصف كيف تنساب حركة إلى التي تليها.
- مشاعر تظهر في صورة أفعال. بدلًا من "حزينة جدًا"، اكتب "تخفض رأسها، وكتفاها ترتجفان قليلًا، وعيناها تحمرّان".
- صورة قريبة واحدة للوجه وصورة واحدة للجسم كاملًا لكل شخصية، لا لوحة متعددة الزوايا قد يقرؤها 2.0 على أنها عدة أشخاص. أما Seedance 2.5 فيقبل الصور متعددة الزوايا.
- أشِر إلى الموضوع بالطريقة نفسها في كل مرة، مثل "the woman in the red coat@Image 1"، أو عرّف اسمًا مرة واحدة وأعد استخدامه.
تتراوح مقاطع Seedance 2.0 بين 4 و15 ثانية (5 افتراضيًا)، وله نسختا Fast وMini تقبلان الطلب نفسه، بدقة 480p أو 720p فقط. ويغطي دليل المقارنة بين الإصدارين ودليل Seedance 2.0 وFast وMini أي نموذج تختار. وتحذّر ByteDance أيضًا من أن للإصدارين "تفضيلات جمالية مختلفة إلى حد كبير"، لذا لن يعطي الموجّه نفسه المظهر نفسه.
لماذا لا يلتزم Seedance بموجّهي؟
ترجع معظم الإخفاقات إلى عدد قليل من الأسباب التي تذكرها الأسئلة الشائعة الرسمية:
- الكثير في وقت قليل. وزّع الأحداث على وقت أطول أو زِد
duration. - التناقضات. وصفان مختلفان للشخصية نفسها، أو حركة كاميرا تتعارض مع الحدث.
- تبادل الشخصيات بين المراجع. أرفق الملفات المرجعية بترتيب أول ظهور للشخصيات، وأعد ترقيم الموجّه ليطابقها.
- عيون متوهجة. الكلمات القوية مثل "متعصب" أو "مصدوم للغاية" قد تجعل الحدقتين تتوهجان. استخدم صياغة أهدأ وأضف "normal human eyes; no glowing eyes" (عيون بشرية طبيعية؛ بلا توهج في العيون).
- نص على الشاشة بأخطاء إملائية. اكتب الكلمة حرفًا حرفًا، أو قدّم النص الدقيق كصورة مرجعية.
- طلب واحد يحاول فعل الكثير. افصل المراجع والتعديلات في مهام منفصلة.
- وجه محظور. تُرفض وجوه الأشخاص الحقيقيين في المراجع؛ راجع خطأ الشخص الحقيقي.
جرّب المسودة بدقة 480p ومع duration قصيرة، ثم أنتج النسخة التي تحتفظ بها بدقة أعلى. المهام الفاشلة لا تُحتسب؛ ولمعرفة تكلفة المقطع المكتمل، راجع أسعار Seedance API.
الأسئلة الشائعة
هل يجب أن أكتب موجّهات Seedance بصيغة JSON؟
لا تُشترط أي صيغة. يقول دليل ByteDance إن الموجّهات "يمكن كتابتها بالكامل باللغة الطبيعية"، وكل قوالبه جمل عادية مع تسميات اختيارية مثل "Shot 1" أو "0-3s". البنية تساعد؛ أما صيغة JSON فغير ضرورية.
كيف أصنع مشهد قتال في Seedance 2.5؟
صِف القتال بعبارات عامة، واحتفظ بالتفاصيل لحركة أو حركتين رئيسيتين؛ إذ يوصي الدليل بصياغة مثل "الطرفان يشتبكان في قتال متلاحم" بدلًا من سرد كل لكمة. ضع المراحل على خط زمني، وحافظ على حركة كاميرا واحدة لكل لقطة، وصِف الصوت بمؤثرات < >.
ما أقصى طول لفيديو Seedance 2.5؟
حتى 30 ثانية لكل طلب، ويُضبط عبر duration (من 4 إلى 30، أو -1 ليختار النموذج). أما Seedance 2.0 فيصل إلى 15 ثانية.
هل توجد أداة رسمية لتحسين موجّهات Seedance؟
نعم. تنشر ByteDance مهارة موجّهات لـ Seedance 2.5 باسم sd25-pe، يمكن لمساعدات البرمجة استخدامها لإعادة صياغة موجّهك قبل إرساله. وأمر التثبيت موجود في الدليل الرسمي.
هل يمكنني استخدام صورة لنفسي كمرجع؟
لا. يرفض Seedance الصور ومقاطع الفيديو المرجعية التي تحتوي على وجوه بشرية حقيقية. ويشرح دليل خطأ الشخص الحقيقي ما تسمح به ByteDance بدلًا من ذلك.
جرّب موجّهك
الصق موجّهًا في Playground الخاص بـ Seedance 2.5 أو Playground الخاص بـ Seedance 2.0، أو أرسله من الشفرة باستخدام مرجع Seedance 2.5 API. تشحن رصيدك مرة واحدة دون اشتراك، والرصيد لا تنتهي صلاحيته، والمهمة الفاشلة لا تكلّف شيئًا.



