Claude Opus 5.5 متاح الآن على SeedRouter
SeedRouter Docs

MiniMax H3

ولّد مقاطع مدتها 4–15 ثانية مع الصوت بدقة 768P أو 2K باستخدام MiniMax H3: من نص إلى فيديو، ومن الإطار الأول والأخير، ومن المراجع إلى فيديو، بصيغة الطلب الرسمية من MiniMax، وتُسلَّم عبر مهمة.

View Markdown

⁦MiniMax H3 (Hailuo 03)⁩ هو نموذج الفيديو متعدد الوسائط من MiniMax. يصنع الطلب الواحد الصورة والصوت معًا: مقطع مدته 4–15 ثانية بدقة 768P أو 2K بحواره وأجوائه الصوتية ومؤثراته الخاصة. جسم الطلب بصيغة MiniMax الرسمية مع معرّف النموذج minimax-h3. أرسل الطلب، واحتفظ بمعرّف المهمة المُعاد، ثم اقرأ الفيديو المكتمل من المهمة. وتُرسل الإطارات والمراجع على شكل روابط URL.

معرّفات النموذج

معرّف النموذجالمدخلاتالدقاتالطول
minimax-h3نص، وإطار أول وأخير، وصور وفيديوهات وصوت مرجعية768P، 2K4–15 ثانية

راجع صفحة النموذج للاطلاع على الأسعار الحالية.

مثال سريع

curl https://api.seedrouter.ai/v1/videos/generations \
  -H "Authorization: Bearer $SEEDROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "minimax-h3",
    "content": [
      {"type": "text", "text": "A small sailboat glides across a calm turquoise bay at sunrise, seagulls in the distance, the sound of water and wind. No text, no logos."}
    ],
    "resolution": "768P",
    "duration": 5,
    "ratio": "16:9"
  }'

نقطة النهاية

POST https://api.seedrouter.ai/v1/videos/generations
الترويسةالقيمة
AuthorizationBearer YOUR_API_KEY
Content-Typeapplication/json

الاستجابة مهمة ({"id": "task_...", "status": "processing"}) لا الفيديو المكتمل. استعلم GET /v1/tasks/{task_id} للحصول على النتيجة. واحتفظ بمفاتيح API في شفرة تعمل على الخادم.

المعاملات

الحقلالنوعالقيمة الافتراضيةملاحظات
modelstringمطلوبminimax-h3
contentarrayمطلوبالموجّه وأي وسائط، على شكل عناصر موضّحة أدناه. عنصر text واحد غير فارغ بالضبط.
resolutionenumمطلوب768P أو 2K.
durationintegerمطلوبأي عدد صحيح من 4 إلى 15 ثانية.
ratioenumحسب المدخلاتadaptive، 21:9، 16:9، 4:3، 1:1، 3:4، 9:16. مطلوب للنص وحده، حيث لا تُقبل adaptive.
content_filterbooleantrueفلتر المحتوى من SeedRouter، الموضّح أدناه. لا يُرسل إلى النموذج.

المخطط صارم: تُرفض الحقول غير المعروفة بدلًا من تجاهلها. وcallback_url غير متاح؛ استعلم عن المهمة بدلًا منه. أما extra فيخص MiniMax-H3-Max ولا يُقبل في هذا النموذج.

عناصر content

typeالعنصرrole
text{"type": "text", "text": "..."}، حتى 7,000 حرفلا يوجد
image_url{"type": "image_url", "image_url": {"url": "https://..."}, "role": "..."}first_frame أو last_frame أو reference_image
video_url{"type": "video_url", "video_url": {"url": "https://..."}, "role": "reference_video"}reference_video
audio_url{"type": "audio_url", "audio_url": {"url": "https://..."}, "role": "reference_audio"}reference_audio

الصورة الواحدة بلا role هي الإطار الأول. ومع أكثر من صورة، تحتاج كل صورة إلى role.

الأوضاع

تحدّد العناصر الموجودة في content الوضع؛ ولا يوجد حقل للوضع.

الوضعيحتوي content علىratio
من نص إلى فيديوعنصر text واحدمطلوب، وليس adaptive
من صورة إلى فيديوtext إضافةً إلى صورة first_frame و/أو last_frameأي قيمة تُعامل على أنها adaptive: الصورة تحدّد الشكل
من المراجع إلى فيديوtext إضافةً إلى أي مزيج يصل إلى 9 عناصر reference_image و3 reference_video و3 reference_audioاختياري، والقيمة الافتراضية adaptive

لا يمكن الجمع بين الإطارات والمراجع في طلب واحد.

{
  "model": "minimax-h3",
  "content": [
    {"type": "text", "text": "The person in the photo speaks to camera: Follow the wind. Voice follows the reference audio."},
    {"type": "image_url", "image_url": {"url": "https://example.com/person.jpg"}, "role": "reference_image"},
    {"type": "audio_url", "audio_url": {"url": "https://example.com/voice.mp3"}, "role": "reference_audio"}
  ],
  "resolution": "2K",
  "duration": 6
}

مدخلات الوسائط

كل عنصر صورة وفيديو وصوت هو رابط ⁦HTTP(S)⁩ عام. ولا تُقبل روابط بيانات Base64 ولا معرّفات mm_file://: ارفع الملف إلى تخزينك الخاص ومرّر رابطه.

المُدخلالصيغةالحدود
صورةJPG، JPEG، PNG، WebP، HEIC، HEIF30 ميغابايت أو أقل؛ كل ضلع 256–5760 px؛ العرض / الارتفاع 0.4–2.5
فيديوMP4 أو MOV، بترميز H.264 أو H.26550 ميغابايت أو أقل؛ 2–15 ثانية لكل منها، و15 ثانية إجمالًا؛ كل ضلع 256–5760 px؛ العرض / الارتفاع 0.4–2.5؛ 23.976–60 fps
صوتWAV، MP315 ميغابايت أو أقل؛ 2–15 ثانية لكل منها، و15 ثانية إجمالًا

تُقاس الفيديوهات المرجعية عند قبول الطلب؛ والفيديو الذي يتعذّر قراءة طوله يُرفض دون احتساب أي شيء. أما الحدود الأخرى فتُفحص قبل التوليد، والطلب الذي يخالف أحدها يفشل دون رسوم.

فلتر المحتوى

قيمة content_filter هي true ما لم تغيّرها. ومع تفعيل الفلتر، يُفحص النص وكل صورة وثلاثة إطارات من كل فيديو مرجعي (الأول والأوسط والأخير) قبل تشغيل النموذج. والطلب الذي يرصده الفلتر يفشل بالرمز 60001 ولا يُحتسب؛ وكذلك الطلب الذي يتعذّر فحصه. ولا يُفحص الصوت المرجعي. اضبط content_filter على false لتخطّي الفحص؛ أما Playground على الموقع فيُبقيه مفعّلًا دائمًا.

عوامل التكلفة

راجع قسم أسعار النموذج للاطلاع على الأسعار الحالية. يُحتسب MiniMax H3 لكل ثانية من الفيديو، بسعر تحدّده دقة المخرجات، إضافةً إلى الصور المُدخلة التي تتجاوز الخمس الأولى:

billed seconds = duration + ceil(Σ each reference video's seconds)
extra images   = max(0, number of images − 5)
cost = billed seconds × rate per second + extra images × rate per image

تُحتسب الإطارات الأولى والإطارات الأخيرة والصور المرجعية كلها صورًا. ولا يُحتسب الصوت المرجعي. وتُعرف الكميتان كلتاهما عند قبول الطلب، لذا فالمبلغ المحجوز هو المبلغ المُحتسب. راجع الرسوم النهائية في سجل الاستخدام الخاص بحسابك. ولا تُحتسب رسوم على المهام الفاشلة.

بنية المخرجات

يعيد الإرسال المهمة:

{"id": "task_...", "model": "minimax-h3", "status": "processing", "created_at": 1789689600}

الاستعلام عن المهمة

GET https://api.seedrouter.ai/v1/tasks/{task_id}

استعلم كل 10–20 ثانية حتى تصبح قيمة status هي completed أو failed. وانتهاء مهلة الشبكة أثناء الاستعلام لا يعني فشل التوليد: احتفظ بمعرّف المهمة واستأنف التحقق منها. ولا تنشئ مهمة أخرى لمعرفة التقدّم.

المهمة المكتملة

{
  "id": "task_...",
  "model": "minimax-h3",
  "status": "completed",
  "created_at": 1789689600,
  "finished_at": 1789689740,
  "output": {
    "video_url": "https://static.seedrouter.ai/media/tasks/task_example/0.mp4",
    "resolution": "768P",
    "ratio": "16:9",
    "duration": 5
  }
}

ratio هي نسبة العرض إلى الارتفاع التي صُنع بها المقطع، بما في ذلك النسبة المختارة عند adaptive. في اختبارنا، عاد مقطع مدته 4 ثوانٍ بدقة 768P ونسبة 16:9 بصيغة ⁦MP4 (H.264)⁩ بأبعاد ⁦1344 × 768⁩ ومعدل 24 fps، مع مسار صوتي AAC ستيريو بتردد 32 kHz.

الأخطاء

الطلبات المرفوضة قبل إنشاء المهمة تعيد خطأ HTTP مصحوبًا بكائن error ولا تُحتسب عليها رسوم. أما المهمة التي تفشل بعد قبولها فتعيد عند الاستعلام رمز HTTP 200 مع status: "failed" وكائن error.

راجع كتالوج الأخطاء المشترك للاطلاع على الرموز وحالات HTTP وإرشادات إعادة المحاولة.

{
  "id": "task_...",
  "model": "minimax-h3",
  "status": "failed",
  "error": {
    "code": 60001,
    "message": "the request was blocked by content moderation"
  }
}

إذا انتهت مهلة الإرسال نفسه، فراجع مهامك قبل الإرسال مجددًا: فربما قُبل الطلب الأول.

نصائح

  • صِف اللقطة وصوتها معًا: الموضوع، والمكان، والكاميرا، والإضاءة، والحوار، والمؤثرات.
  • اكتب الحوار داخل الموجّه وأرفق مقطعًا صوتيًا مرجعيًا عندما ينبغي أن يتبعه الصوت.
  • أعدّ مسودة بدقة 768P، ثم ولّد اللقطة النهائية بدقة 2K بالطلب نفسه.
  • استخدم إطارًا أول وإطارًا أخيرًا للتحكم في بداية اللقطة ونهايتها؛ واستخدم المراجع للحفاظ على منتج أو شخص أو حركة.
  • أضف no text, no logos لإبعاد العلامات المختلقة عن الإطار.

مواضيع ذات صلة