SD Video
יצירת קליפים של 5–15 שניות עם דיאלוג וסאונד תואמים בעזרת SD Video: מטקסט לווידאו, מתמונה לווידאו ומייחוס לווידאו ב-480p או ב-768p, עם מסירה כמשימה.
SD Video הוא מודל יצירת הווידאו של SeedRouter, שבנוי על MiniMax H3. בקשה אחת יוצרת את כל הסצנה, תמונה וסאונד יחד: קליפ של 5–15 שניות עם דיאלוג, סאונד סביבה ואפקטים משלו. שלח את הבקשה, שמור את מזהה המשימה שהוחזר, וקרא את הווידאו המוכן מתוך המשימה. פריימים ראשונים וייחוסים נשלחים ככתובות URL.
מזהי מודל
| מזהה מודל | מצבים | רזולוציות | אורך |
|---|---|---|---|
sd-video | text_to_video, image_to_video, reference_to_video | 480p, 768p | 5–15 שניות |
המחירים הנוכחיים מופיעים בדף המודל.
דוגמה מהירה
curl https://api.seedrouter.ai/v1/videos/generations \
-H "Authorization: Bearer $SEEDROUTER_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "sd-video",
"mode": "text_to_video",
"prompt": "A lighthouse keeper in a wool coat stands on a wet stone pier at dawn and says, \"The fog lifts at seven.\" Locked-off shot, waves slapping the stones, no music.",
"duration": 5,
"resolution": "768p",
"aspect_ratio": "16:9"
}'נקודת קצה
POST https://api.seedrouter.ai/v1/videos/generations| כותרת | ערך |
|---|---|
| Authorization | Bearer YOUR_API_KEY |
| Content-Type | application/json |
התשובה היא משימה ({"id": "task_...", "status": "processing"}), ולא הווידאו המוכן. תשאל את GET /v1/tasks/{task_id} כדי לקבל את התוצאה. שמור את מפתחות ה-API בקוד שרץ בצד השרת.
פרמטרים
| שדה | סוג | ברירת מחדל | הערות |
|---|---|---|---|
model | string | חובה | sd-video |
mode | enum | reference_to_video | text_to_video, image_to_video, reference_to_video. גם הצורות המקוצרות t2v, i2v ו-ref2va מתקבלות. |
prompt | string | חובה | בין 1 ל-32,000 תווים. מתאר את התמונה ואת הסאונד. |
duration | integer | 5 | כל מספר שלם בין 5 ל-15 שניות. |
resolution | enum | 768p | 480p או 768p. |
aspect_ratio | enum | לפי המצב | 21:9, 16:9, 4:3, 1:1, 3:4, 9:16, ובנוסף adaptive ב-reference_to_video. ב-image_to_video הוא נקבע לפי הפריים הראשון. |
prompt_enhancement | enum | turbo | turbo, quality או disabled. |
seed | integer | אקראי | מספר שלם של 32 ביט ללא סימן. הגדר אותו כדי לחזור על שוט. |
image | reference | רק ב-image_to_video, ושם הוא חובה. הפריים הראשון. | |
reference_images | array | [] | רק ב-reference_to_video. עד 9. |
reference_videos | array | [] | רק ב-reference_to_video. עד 3. |
reference_audio | array | [] | רק ב-reference_to_video. עד 3. |
הסכמה מחמירה: שדות לא מוכרים נדחים ולא מתעלמים מהם. callback_url ו-callback_id אינם זמינים; תשאל את המשימה במקום זאת.
מצבים
mode קובע על מה המודל מתבסס. לכל מצב יש שדות משלו; שדה ממצב אחר מחזיר 400 כשיש בו ערך (רשימה ריקה או null עוברים).
| מצב | דורש | מקבל |
|---|---|---|
text_to_video | prompt | השדות המשותפים |
image_to_video | prompt ו-image | image כפריים הראשון |
reference_to_video (ברירת מחדל) | prompt ולפחות תמונת ייחוס אחת או סרטון ייחוס אחד | reference_images, reference_videos, reference_audio |
image_to_video מתייחס לתמונה כפריים הראשון כפשוטו, כך שהקליפ נפתח בדיוק כמו שהתמונה הזו נראית. כדי למקם מוצר או אדם בתוך סצנה משלך, השתמש ב-reference_to_video ותאר את הסצנה שסביבו.
ייחוסים ותוויות בפרומפט
ב-reference_to_video, הסדר ברשימה הופך לתווית שבה משתמשים בפרומפט. הפריט הראשון ב-reference_images הוא <Picture 1>, השני הוא <Picture 2>; הפריט הראשון ב-reference_videos הוא <Video 1>, וכן הלאה. תמונות, סרטונים ואודיו ממוספרים כל אחד בנפרד. שיפור הפרומפט יכול לנסח מחדש את שאר הפרומפט אבל לא את התוויות האלה; הגדר את prompt_enhancement ל-disabled כדי לשמור על הטקסט שלך כפי שכתבת אותו.
{
"model": "sd-video",
"mode": "reference_to_video",
"prompt": "A supervisor wearing the harness in <Picture 1> stands still and speaks to camera.",
"reference_images": [{ "type": "url", "url": "https://example.com/harness.jpg" }],
"duration": 10
}קלטי מדיה
כל ייחוס, וגם הפריים הראשון של image_to_video, הוא אובייקט עם כתובת URL ציבורית ב-HTTP(S):
{ "type": "url", "url": "https://example.com/photo.jpg" }| קלט | גודל מרבי |
|---|---|
| תמונה | 16 MB |
| וידאו או אודיו | 32 MB |
לכל היותר 9 תמונות, 3 סרטונים ו-3 קטעי אודיו, 12 ייחוסים בסך הכול. נתוני base64 ומזהי נכסים אינם מתקבלים: העלה את הקובץ לאחסון שלך והעבר את הכתובת שלו. הכתובת חייבת להיות נגישה בלי הפניות מחדש.
גורמי עלות
בדוק את מדור המחירים של המודל לתעריפים הנוכחיים. SD Video מחויב לפי שנייה של וידאו, בתעריף שנקבע לפי המצב ורזולוציית הפלט:
billed seconds = duration (text_to_video, image_to_video)
billed seconds = duration + ceil(Σ min(each reference video's seconds, 5)) (reference_to_video)
cost = billed seconds × rate per secondכל סרטון ייחוס מוסיף את האורך שלו עד 5 שניות; קליפ ארוך יותר עדיין מוסיף 5. תמונות ייחוס ואודיו ייחוס אינם מחויבים. סרטוני הייחוס נמדדים כשהבקשה מתקבלת, ולכן הסכום שנשמר מראש הוא הסכום שמחויב. את החיובים הסופיים תראה בהיסטוריית השימוש של החשבון שלך. משימות שנכשלו אינן מחויבות.
מבנה הפלט
השליחה מחזירה את המשימה:
{"id": "task_...", "model": "sd-video", "status": "processing", "created_at": 1789689600}קבלת המשימה
GET https://api.seedrouter.ai/v1/tasks/{task_id}תשאל כל 10–20 שניות עד ש-status יהיה completed או failed. פקיעת זמן ברשת במהלך התשאול אינה מעידה שהיצירה נכשלה: שמור את מזהה המשימה והמשך בבדיקה. אל תיצור משימה נוספת כדי לבדוק התקדמות.
משימה שהושלמה
{
"id": "task_...",
"model": "sd-video",
"status": "completed",
"created_at": 1789689600,
"finished_at": 1789689720,
"output": {
"video_url": "https://static.seedrouter.ai/media/tasks/task_example/0.mp4",
"duration": 5,
"width": 1344,
"height": 768,
"aspect_ratio": "16:9",
"seed": 42
}
}הווידאו הוא MP4 (H.264) ב-24 fps עם אודיו AAC סטריאו ב-32 kHz. כש-aspect_ratio מוגדר במפורש, הגודל קבוע:
aspect_ratio | 768p | 480p |
|---|---|---|
21:9 | 1536 × 672 | 960 × 416 |
16:9 | 1344 × 768 | 832 × 480 |
4:3 | 1024 × 768 | 640 × 480 |
1:1 | 768 × 768 | 480 × 480 |
3:4 | 768 × 1024 | 480 × 640 |
9:16 | 768 × 1344 | 480 × 832 |
ברירת המחדל של text_to_video היא 16:9. ברירת המחדל של reference_to_video היא adaptive: הצורה של תמונת הייחוס הראשונה, או של סרטון הייחוס הראשון כשאין תמונות. image_to_video תמיד עוקב אחרי הפריים הראשון, כולל כיוון ה-EXIF שלו; חתוך את התמונה כדי לשנות את הצורה. קליפ adaptive שומר על צורת המקור, מוקטן או מוגדל לצלע הקצרה של הרזולוציה כשכל צלע מעוגלת לכפולה של 32, ומדווח את aspect_ratio כיחס הפיקסלים המצומצם, למשל 23:15.
המשימה שהושלמה מדווחת את ה-seed שבו השתמשה. אותו פרומפט ואותו seed מחזירים את אותו קליפ; אם משמיטים את seed, כל בקשה בוחרת ערך חדש.
שגיאות
בקשות שנדחות לפני יצירת המשימה מחזירות שגיאת HTTP יחד עם אובייקט error ואינן מחויבות. משימה שנכשלת לאחר שהתקבלה מחזירה בתשאול HTTP 200, עם status: "failed" ואובייקט error.
ראה את קטלוג השגיאות המשותף לקודים, לסטטוסי HTTP ולהנחיות ניסיון חוזר.
{
"id": "task_...",
"model": "sd-video",
"status": "failed",
"error": {
"code": 60001,
"message": "The request was rejected by the content policy. Please revise the prompt or input images."
}
}אם השליחה עצמה חורגת מהזמן הקצוב, בדוק את המשימות שלך לפני שליחה חוזרת: ייתכן שהבקשה הראשונה כבר התקבלה.
טיפים
- כתוב פרומפטים ארוכים. כמה מאות תווים ומעלה נותנים פלט טוב יותר; אין שום מחיר לפירוט.
- ציין את המצלמה, לא את האווירה: גוף מצלמה, עדשה וצמצם משנים את התמונה, "cinematic" כמעט לא עושה כלום.
- תאר את הסאונד: סאונד חדר, אפקטים והמרחק שלהם. כתוב
no musicאם אתה לא רוצה רקע מוזיקלי. דיאלוג נכנס בקצב של בערך 2.5 מילים לשנייה. - הוסף
no logos, brand names, printed words or badges anywhere in frameכדי למנוע סימנים מומצאים. - שמור על כיתוב קצר ומאוית בדיוק, וציין שזה הכיתוב היחיד בפריים.
- העדף שקט ויציבות: נושא אחד, מקום אחד, מצלמה סטטית. עבודת ידיים מקרוב ותנועה רכה כמו שיער או נייר הם התחומים החלשים ביותר.
- קבע את
seedושנה פסוקית אחת בכל פעם כדי לשכלל שוט.
