Claude Opus 5.5 متاح الآن على SeedRouter
SeedRouter Docs

SD Video

ولّد مقاطع مدتها 5–15 ثانية مع حوار وصوت متطابقين باستخدام SD Video: من نص إلى فيديو، ومن صورة إلى فيديو، ومن المراجع إلى فيديو، بدقة 480p أو 768p، وتُسلَّم عبر مهمة.

View Markdown

SD Video هو نموذج توليد الفيديو من SeedRouter، وهو مبني على MiniMax H3. يصنع الطلب الواحد المشهد كله، الصورة والصوت معًا: مقطع مدته 5–15 ثانية بحواره وأجوائه الصوتية ومؤثراته الخاصة. أرسل الطلب، واحتفظ بمعرّف المهمة المُعاد، ثم اقرأ الفيديو المكتمل من المهمة. وتُرسل الإطارات الأولى والمراجع على شكل روابط URL.

معرّفات النموذج

معرّف النموذجالأوضاعالدقاتالطول
sd-videotext_to_video، image_to_video، reference_to_video480p، 768p5–15 ثانية

راجع صفحة النموذج للاطلاع على الأسعار الحالية.

مثال سريع

curl https://api.seedrouter.ai/v1/videos/generations \
  -H "Authorization: Bearer $SEEDROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "sd-video",
    "mode": "text_to_video",
    "prompt": "A lighthouse keeper in a wool coat stands on a wet stone pier at dawn and says, \"The fog lifts at seven.\" Locked-off shot, waves slapping the stones, no music.",
    "duration": 5,
    "resolution": "768p",
    "aspect_ratio": "16:9"
  }'

نقطة النهاية

POST https://api.seedrouter.ai/v1/videos/generations
الترويسةالقيمة
AuthorizationBearer YOUR_API_KEY
Content-Typeapplication/json

الاستجابة مهمة ({"id": "task_...", "status": "processing"}) لا الفيديو المكتمل. استعلم GET /v1/tasks/{task_id} للحصول على النتيجة. واحتفظ بمفاتيح API في شفرة تعمل على الخادم.

المعاملات

الحقلالنوعالقيمة الافتراضيةملاحظات
modelstringمطلوبsd-video
modeenumreference_to_videotext_to_video، image_to_video، reference_to_video. وتُقبل الصيغ المختصرة t2v وi2v وref2va.
promptstringمطلوبمن 1 إلى 32,000 حرف. يصف الصورة والصوت.
durationinteger5أي عدد صحيح من 5 إلى 15 ثانية.
resolutionenum768p480p أو 768p.
aspect_ratioenumحسب الوضع21:9، 16:9، 4:3، 1:1، 3:4، 9:16، إضافةً إلى adaptive في reference_to_video. ويتبع image_to_video الإطار الأول.
prompt_enhancementenumturboturbo أو quality أو disabled.
seedintegerعشوائيعدد صحيح بلا إشارة بطول 32 بت. اضبطه لتكرار لقطة.
imageمرجعفي image_to_video فقط، وهو مطلوب فيه. الإطار الأول.
reference_imagesarray[]في reference_to_video فقط. حتى 9.
reference_videosarray[]في reference_to_video فقط. حتى 3.
reference_audioarray[]في reference_to_video فقط. حتى 3.

المخطط صارم: تُرفض الحقول غير المعروفة بدلًا من تجاهلها. وcallback_url وcallback_id غير متاحين؛ استعلم عن المهمة بدلًا منهما.

الأوضاع

يحدّد mode طريقة توجيه النموذج. لكل وضع حقوله الخاصة؛ والحقل التابع لوضع آخر يعيد 400 إذا كان يحمل قيمة (القائمة الفارغة أو null تمرّ).

الوضعيتطلبيقبل
text_to_videopromptالحقول المشتركة
image_to_videoprompt وimageimage بوصفها الإطار الأول
reference_to_video (الافتراضي)prompt وصورة أو فيديو مرجعي واحد على الأقلreference_images، reference_videos، reference_audio

يعامل image_to_video الصورة على أنها الإطار الأول حرفيًا، فيبدأ المقطع تمامًا كما تبدو تلك الصورة الثابتة. ولوضع منتج أو شخص داخل مشهد من اختيارك، استخدم reference_to_video وصِف المشهد من حوله.

المراجع وتسميات الموجّه

في reference_to_video، يصبح ترتيب القائمة هو التسمية التي تستخدمها في الموجّه. العنصر الأول في reference_images هو <Picture 1>، والثاني هو <Picture 2>؛ والعنصر الأول في reference_videos هو <Video 1>، وهكذا. وتُرقَّم الصور والفيديوهات والصوت كلٌّ على حدة. ويمكن لتحسين الموجّه أن يعيد صياغة بقية الموجّه لكن ليس هذه التسميات؛ اضبط prompt_enhancement على disabled للإبقاء على نصك كما كتبته.

{
  "model": "sd-video",
  "mode": "reference_to_video",
  "prompt": "A supervisor wearing the harness in <Picture 1> stands still and speaks to camera.",
  "reference_images": [{ "type": "url", "url": "https://example.com/harness.jpg" }],
  "duration": 10
}

مدخلات الوسائط

كل مرجع، وكذلك الإطار الأول في image_to_video، هو كائن يحمل رابط ⁦HTTP(S)⁩ عامًا:

{ "type": "url", "url": "https://example.com/photo.jpg" }
المُدخلالحجم الأقصى
صورة16 ميغابايت
فيديو أو صوت32 ميغابايت

بحد أقصى 9 صور و3 فيديوهات و3 مقاطع صوتية، أي 12 مرجعًا إجمالًا. ولا تُقبل بيانات Base64 ولا معرّفات الأصول: ارفع الملف إلى تخزينك الخاص ومرّر رابطه. ويجب أن يكون الرابط قابلًا للوصول دون عمليات إعادة توجيه.

عوامل التكلفة

راجع قسم أسعار النموذج للاطلاع على الأسعار الحالية. يُحتسب SD Video لكل ثانية من الفيديو، بسعر يحدّده الوضع ودقة المخرجات:

billed seconds = duration                                                   (text_to_video, image_to_video)
billed seconds = duration + ceil(Σ min(each reference video's seconds, 5))  (reference_to_video)
cost = billed seconds × rate per second

يضيف كل فيديو مرجعي طوله حتى 5 ثوانٍ؛ والمقطع الأطول يضيف 5 أيضًا. ولا تُحتسب الصور المرجعية ولا الصوت المرجعي. وتُقاس الفيديوهات المرجعية عند قبول الطلب، لذا فالمبلغ المحجوز هو المبلغ المُحتسب. راجع الرسوم النهائية في سجل الاستخدام الخاص بحسابك. ولا تُحتسب رسوم على المهام الفاشلة.

بنية المخرجات

يعيد الإرسال المهمة:

{"id": "task_...", "model": "sd-video", "status": "processing", "created_at": 1789689600}

الاستعلام عن المهمة

GET https://api.seedrouter.ai/v1/tasks/{task_id}

استعلم كل 10–20 ثانية حتى تصبح قيمة status هي completed أو failed. وانتهاء مهلة الشبكة أثناء الاستعلام لا يعني فشل التوليد: احتفظ بمعرّف المهمة واستأنف التحقق منها. ولا تنشئ مهمة أخرى لمعرفة التقدّم.

المهمة المكتملة

{
  "id": "task_...",
  "model": "sd-video",
  "status": "completed",
  "created_at": 1789689600,
  "finished_at": 1789689720,
  "output": {
    "video_url": "https://static.seedrouter.ai/media/tasks/task_example/0.mp4",
    "duration": 5,
    "width": 1344,
    "height": 768,
    "aspect_ratio": "16:9",
    "seed": 42
  }
}

الفيديو بصيغة ⁦MP4 (H.264)⁩ بمعدل 24 fps مع صوت AAC ستيريو بتردد 32 kHz. ومع aspect_ratio صريحة، يكون الحجم ثابتًا:

aspect_ratio768p480p
21:91536 × 672960 × 416
16:91344 × 768832 × 480
4:31024 × 768640 × 480
1:1768 × 768480 × 480
3:4768 × 1024480 × 640
9:16768 × 1344480 × 832

القيمة الافتراضية لـ text_to_video هي 16:9. والقيمة الافتراضية لـ reference_to_video هي adaptive: شكل الصورة المرجعية الأولى، أو الفيديو المرجعي الأول عند عدم وجود صور. ويتبع image_to_video دائمًا الإطار الأول، بما في ذلك اتجاه EXIF الخاص به؛ قُصّ الصورة لتغيير الشكل. ويحافظ المقطع ذو النسبة adaptive على شكل المصدر، مع تحجيمه إلى الضلع الأقصر للدقة وتقريب كل ضلع إلى مضاعف للعدد 32، ويُبلغ عن aspect_ratio على أنها نسبة البكسلات المختزلة، مثل 23:15.

تُبلغ المهمة المكتملة عن قيمة seed التي استخدمتها. والموجّه نفسه مع البذرة نفسها يعيدان المقطع نفسه؛ وإذا حذفت seed تختار كل عملية طلب قيمة جديدة.

الأخطاء

الطلبات المرفوضة قبل إنشاء المهمة تعيد خطأ HTTP مصحوبًا بكائن error ولا تُحتسب عليها رسوم. أما المهمة التي تفشل بعد قبولها فتعيد عند الاستعلام رمز HTTP 200 مع status: "failed" وكائن error.

راجع كتالوج الأخطاء المشترك للاطلاع على الرموز وحالات HTTP وإرشادات إعادة المحاولة.

{
  "id": "task_...",
  "model": "sd-video",
  "status": "failed",
  "error": {
    "code": 60001,
    "message": "The request was rejected by the content policy. Please revise the prompt or input images."
  }
}

إذا انتهت مهلة الإرسال نفسه، فراجع مهامك قبل الإرسال مجددًا: فربما قُبل الطلب الأول.

نصائح

  • اكتب موجّهات طويلة. بضع مئات من الأحرف أو أكثر تمنح مخرجات أفضل؛ ولا عقوبة على التفاصيل.
  • سمِّ الكاميرا لا الحالة المزاجية: هيكل الكاميرا والعدسة وفتحة العدسة تغيّر الصورة، أما «cinematic» فلا تكاد تفعل شيئًا.
  • صِف الصوت: صوت المكان، والمؤثرات ومدى بُعدها. اكتب no music إذا كنت لا تريد خلفية موسيقية. ويتسع الحوار لنحو 2.5 كلمة في الثانية.
  • أضف no logos, brand names, printed words or badges anywhere in frame لإبعاد العلامات المختلقة عن الإطار.
  • اجعل الكتابة قصيرة ومكتوبة بحروفها الدقيقة، وحدّدها على أنها الكتابة الوحيدة في الإطار.
  • فضّل السكون: موضوع واحد، ومكان واحد، وكاميرا ثابتة. والعمل اليدوي عن قرب والحركة الناعمة مثل الشعر أو الورق هي أضعف المجالات.
  • ثبّت seed وغيّر عبارة واحدة في كل مرة لتطوير لقطة تدريجيًا.

مواضيع ذات صلة