Claude Opus 5.5 已在 SeedRouter 上線
SeedRouter Docs

MiniMax H3

用 MiniMax H3 產生 4–15 秒、768P 或 2K 的有聲影片:支援文字轉影片、首尾影格轉影片和參考素材轉影片,採用 MiniMax 官方請求格式,以任務形式交付。

View Markdown

MiniMax H3(Hailuo 03)是 MiniMax 的多模態影片模型。一次請求就能同時產生畫面和聲音:一段 4–15 秒、768P 或 2K 的影片,自帶對白、環境音和音效。請求本文採用 MiniMax 官方格式,模型 ID 為 minimax-h3。送出請求,保存回傳的任務 ID,再從該任務讀取生成完成的影片。首尾影格和參考素材以 URL 形式傳入。

模型 ID

模型 ID輸入解析度長度
minimax-h3文字、首影格與尾影格、參考圖片、影片和音訊768P、2K4–15 秒

目前價格請查看模型頁面。

快速範例

curl https://api.seedrouter.ai/v1/videos/generations \
  -H "Authorization: Bearer $SEEDROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "minimax-h3",
    "content": [
      {"type": "text", "text": "A small sailboat glides across a calm turquoise bay at sunrise, seagulls in the distance, the sound of water and wind. No text, no logos."}
    ],
    "resolution": "768P",
    "duration": 5,
    "ratio": "16:9"
  }'

端點

POST https://api.seedrouter.ai/v1/videos/generations
標頭值
AuthorizationBearer YOUR_API_KEY
Content-Typeapplication/json

回應是一個任務({"id": "task_...", "status": "processing"}),而不是生成完成的影片。請輪詢 GET /v1/tasks/{task_id} 取得結果。請把 API 金鑰保存在伺服器端程式碼中。

參數

欄位類型預設值說明
modelstring必填minimax-h3
contentarray必填提示詞和所有素材,依下文說明的項目組成。必須恰好包含一個非空的 text 項目。
resolutionenum必填768P 或 2K。
durationinteger必填4 到 15 秒之間的任意整數。
ratioenum依輸入而定adaptive、21:9、16:9、4:3、1:1、3:4、9:16。只用文字時必填,且不接受 adaptive。
content_filterbooleantrueSeedRouter 的內容過濾,見下文。不會傳送給模型。

請求結構採嚴格驗證:未知欄位會被拒絕,而不是被忽略。不支援 callback_url;請改為輪詢任務。extra 屬於 MiniMax-H3-Max,本模型不接受這個欄位。

Content 項目

type項目role
text{"type": "text", "text": "..."},最多 7,000 個字元無
image_url{"type": "image_url", "image_url": {"url": "https://..."}, "role": "..."}first_frame、last_frame 或 reference_image
video_url{"type": "video_url", "video_url": {"url": "https://..."}, "role": "reference_video"}reference_video
audio_url{"type": "audio_url", "audio_url": {"url": "https://..."}, "role": "reference_audio"}reference_audio

只有一張圖片且沒有 role 時,它就是首影格。多於一張圖片時,每張圖片都需要 role。

模式

由 content 中的項目決定模式;沒有獨立的模式欄位。

模式content 內容ratio
文字轉影片一個 text 項目必填,不能是 adaptive
圖片轉影片text,加上一張 first_frame 和/或一張 last_frame 圖片任何值都當作 adaptive:畫面比例由圖片決定
參考素材轉影片text,加上最多 9 個 reference_image、3 個 reference_video 和 3 個 reference_audio 項目的任意組合選填,預設 adaptive

同一個請求中,首尾影格和參考素材不能同時使用。

{
  "model": "minimax-h3",
  "content": [
    {"type": "text", "text": "The person in the photo speaks to camera: Follow the wind. Voice follows the reference audio."},
    {"type": "image_url", "image_url": {"url": "https://example.com/person.jpg"}, "role": "reference_image"},
    {"type": "audio_url", "audio_url": {"url": "https://example.com/voice.mp3"}, "role": "reference_audio"}
  ],
  "resolution": "2K",
  "duration": 6
}

媒體輸入

每個圖片、影片和音訊項目都是一個公開的 HTTP(S) URL。不接受 Base64 data URI 和 mm_file:// ID:請把檔案上傳到你自己的儲存空間,再傳入它的 URL。

輸入格式限制
圖片JPG、JPEG、PNG、WebP、HEIC、HEIF不超過 30 MB;每邊 256–5760 px;寬 / 高 0.4–2.5
影片MP4、MOV(H.264 或 H.265)不超過 50 MB;每段 2–15 秒,總計 15 秒;每邊 256–5760 px;寬 / 高 0.4–2.5;23.976–60 fps
音訊WAV、MP3不超過 15 MB;每段 2–15 秒,總計 15 秒

參考影片在請求受理時量測長度;無法讀取長度的影片會被拒絕,且不收費。其他限制會在生成前檢查,違反任何一項的請求會失敗,且不收費。

內容過濾

除非你自行設定,content_filter 預設為 true。開啟過濾時,文字、每張圖片以及每段參考影片的三個影格(第一、中間和最後一個)會在模型執行前接受檢查。被標記的請求會以錯誤碼 60001 失敗,且不收費;無法完成檢查的請求也一樣。參考音訊不做檢查。把 content_filter 設為 false 可略過檢查;網站上的 Playground 一律保持開啟。

計費維度

目前費率請查看模型定價區塊。MiniMax H3 按影片秒數計費,費率由輸出解析度決定,另外會對前五張之後的輸入圖片計費:

billed seconds = duration + ceil(Σ each reference video's seconds)
extra images   = max(0, number of images − 5)
cost = billed seconds × rate per second + extra images × rate per image

首影格、尾影格和參考圖片都算作圖片。參考音訊不計費。這兩個數量在請求受理時就已確定,因此預扣金額就是實際扣款金額。最終扣款請在帳戶的用量紀錄中查看。失敗的任務不計費。

輸出結構

送出後回傳任務:

{"id": "task_...", "model": "minimax-h3", "status": "processing", "created_at": 1789689600}

查詢任務

GET https://api.seedrouter.ai/v1/tasks/{task_id}

每 10–20 秒輪詢一次,直到 status 變為 completed 或 failed。輪詢過程中出現網路逾時,並不代表生成失敗:請保留任務 ID 並繼續查詢。不要為了查看進度而再建立一個任務。

完成的任務

{
  "id": "task_...",
  "model": "minimax-h3",
  "status": "completed",
  "created_at": 1789689600,
  "finished_at": 1789689740,
  "output": {
    "video_url": "https://static.seedrouter.ai/media/tasks/task_example/0.mp4",
    "resolution": "768P",
    "ratio": "16:9",
    "duration": 5
  }
}

ratio 是影片實際採用的寬高比,包括為 adaptive 選定的那一個。在我們的測試中,一段 4 秒、16:9 的 768P 影片以 MP4(H.264)回傳,解析度 1344 × 768、24 fps,附帶 32 kHz 的立體聲 AAC 音軌。

錯誤

在任務建立之前就被拒絕的請求,會回傳 HTTP 錯誤狀態碼和一個 error 物件,且不計費。受理之後才失敗的任務,在查詢時回傳 HTTP 200,並帶有 status: "failed" 和一個 error 物件。

錯誤碼、HTTP 狀態碼和重試建議請參閱共用錯誤目錄。

{
  "id": "task_...",
  "model": "minimax-h3",
  "status": "failed",
  "error": {
    "code": 60001,
    "message": "the request was blocked by content moderation"
  }
}

如果提交本身逾時,請先檢查你的任務清單再重新提交:第一次請求有可能已經被受理。

實用建議

  • 把畫面和聲音一起描述:主體、地點、鏡頭、光線、對白和音效。
  • 把對白寫進提示詞;希望聲音照著某個人時,附上一段參考音訊。
  • 先用 768P 做草稿,再用同一個請求以 2K 算繪最終鏡頭。
  • 用首影格和尾影格控制鏡頭的起點和終點;用參考素材保留某個產品、某個人或某種動作。
  • 加上 no text, no logos,避免出現憑空編造的標記。

相關內容