MiniMax H3
用 MiniMax H3 產生 4–15 秒、768P 或 2K 的有聲影片:支援文字轉影片、首尾影格轉影片和參考素材轉影片,採用 MiniMax 官方請求格式,以任務形式交付。
MiniMax H3(Hailuo 03)是 MiniMax 的多模態影片模型。一次請求就能同時產生畫面和聲音:一段 4–15 秒、768P 或 2K 的影片,自帶對白、環境音和音效。請求本文採用 MiniMax 官方格式,模型 ID 為 minimax-h3。送出請求,保存回傳的任務 ID,再從該任務讀取生成完成的影片。首尾影格和參考素材以 URL 形式傳入。
模型 ID
| 模型 ID | 輸入 | 解析度 | 長度 |
|---|---|---|---|
minimax-h3 | 文字、首影格與尾影格、參考圖片、影片和音訊 | 768P、2K | 4–15 秒 |
目前價格請查看模型頁面。
快速範例
curl https://api.seedrouter.ai/v1/videos/generations \
-H "Authorization: Bearer $SEEDROUTER_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "minimax-h3",
"content": [
{"type": "text", "text": "A small sailboat glides across a calm turquoise bay at sunrise, seagulls in the distance, the sound of water and wind. No text, no logos."}
],
"resolution": "768P",
"duration": 5,
"ratio": "16:9"
}'端點
POST https://api.seedrouter.ai/v1/videos/generations| 標頭 | 值 |
|---|---|
| Authorization | Bearer YOUR_API_KEY |
| Content-Type | application/json |
回應是一個任務({"id": "task_...", "status": "processing"}),而不是生成完成的影片。請輪詢 GET /v1/tasks/{task_id} 取得結果。請把 API 金鑰保存在伺服器端程式碼中。
參數
| 欄位 | 類型 | 預設值 | 說明 |
|---|---|---|---|
model | string | 必填 | minimax-h3 |
content | array | 必填 | 提示詞和所有素材,依下文說明的項目組成。必須恰好包含一個非空的 text 項目。 |
resolution | enum | 必填 | 768P 或 2K。 |
duration | integer | 必填 | 4 到 15 秒之間的任意整數。 |
ratio | enum | 依輸入而定 | adaptive、21:9、16:9、4:3、1:1、3:4、9:16。只用文字時必填,且不接受 adaptive。 |
content_filter | boolean | true | SeedRouter 的內容過濾,見下文。不會傳送給模型。 |
請求結構採嚴格驗證:未知欄位會被拒絕,而不是被忽略。不支援 callback_url;請改為輪詢任務。extra 屬於 MiniMax-H3-Max,本模型不接受這個欄位。
Content 項目
type | 項目 | role |
|---|---|---|
text | {"type": "text", "text": "..."},最多 7,000 個字元 | 無 |
image_url | {"type": "image_url", "image_url": {"url": "https://..."}, "role": "..."} | first_frame、last_frame 或 reference_image |
video_url | {"type": "video_url", "video_url": {"url": "https://..."}, "role": "reference_video"} | reference_video |
audio_url | {"type": "audio_url", "audio_url": {"url": "https://..."}, "role": "reference_audio"} | reference_audio |
只有一張圖片且沒有 role 時,它就是首影格。多於一張圖片時,每張圖片都需要 role。
模式
由 content 中的項目決定模式;沒有獨立的模式欄位。
| 模式 | content 內容 | ratio |
|---|---|---|
| 文字轉影片 | 一個 text 項目 | 必填,不能是 adaptive |
| 圖片轉影片 | text,加上一張 first_frame 和/或一張 last_frame 圖片 | 任何值都當作 adaptive:畫面比例由圖片決定 |
| 參考素材轉影片 | text,加上最多 9 個 reference_image、3 個 reference_video 和 3 個 reference_audio 項目的任意組合 | 選填,預設 adaptive |
同一個請求中,首尾影格和參考素材不能同時使用。
{
"model": "minimax-h3",
"content": [
{"type": "text", "text": "The person in the photo speaks to camera: Follow the wind. Voice follows the reference audio."},
{"type": "image_url", "image_url": {"url": "https://example.com/person.jpg"}, "role": "reference_image"},
{"type": "audio_url", "audio_url": {"url": "https://example.com/voice.mp3"}, "role": "reference_audio"}
],
"resolution": "2K",
"duration": 6
}媒體輸入
每個圖片、影片和音訊項目都是一個公開的 HTTP(S) URL。不接受 Base64 data URI 和 mm_file:// ID:請把檔案上傳到你自己的儲存空間,再傳入它的 URL。
| 輸入 | 格式 | 限制 |
|---|---|---|
| 圖片 | JPG、JPEG、PNG、WebP、HEIC、HEIF | 不超過 30 MB;每邊 256–5760 px;寬 / 高 0.4–2.5 |
| 影片 | MP4、MOV(H.264 或 H.265) | 不超過 50 MB;每段 2–15 秒,總計 15 秒;每邊 256–5760 px;寬 / 高 0.4–2.5;23.976–60 fps |
| 音訊 | WAV、MP3 | 不超過 15 MB;每段 2–15 秒,總計 15 秒 |
參考影片在請求受理時量測長度;無法讀取長度的影片會被拒絕,且不收費。其他限制會在生成前檢查,違反任何一項的請求會失敗,且不收費。
內容過濾
除非你自行設定,content_filter 預設為 true。開啟過濾時,文字、每張圖片以及每段參考影片的三個影格(第一、中間和最後一個)會在模型執行前接受檢查。被標記的請求會以錯誤碼 60001 失敗,且不收費;無法完成檢查的請求也一樣。參考音訊不做檢查。把 content_filter 設為 false 可略過檢查;網站上的 Playground 一律保持開啟。
計費維度
目前費率請查看模型定價區塊。MiniMax H3 按影片秒數計費,費率由輸出解析度決定,另外會對前五張之後的輸入圖片計費:
billed seconds = duration + ceil(Σ each reference video's seconds)
extra images = max(0, number of images − 5)
cost = billed seconds × rate per second + extra images × rate per image首影格、尾影格和參考圖片都算作圖片。參考音訊不計費。這兩個數量在請求受理時就已確定,因此預扣金額就是實際扣款金額。最終扣款請在帳戶的用量紀錄中查看。失敗的任務不計費。
輸出結構
送出後回傳任務:
{"id": "task_...", "model": "minimax-h3", "status": "processing", "created_at": 1789689600}查詢任務
GET https://api.seedrouter.ai/v1/tasks/{task_id}每 10–20 秒輪詢一次,直到 status 變為 completed 或 failed。輪詢過程中出現網路逾時,並不代表生成失敗:請保留任務 ID 並繼續查詢。不要為了查看進度而再建立一個任務。
完成的任務
{
"id": "task_...",
"model": "minimax-h3",
"status": "completed",
"created_at": 1789689600,
"finished_at": 1789689740,
"output": {
"video_url": "https://static.seedrouter.ai/media/tasks/task_example/0.mp4",
"resolution": "768P",
"ratio": "16:9",
"duration": 5
}
}ratio 是影片實際採用的寬高比,包括為 adaptive 選定的那一個。在我們的測試中,一段 4 秒、16:9 的 768P 影片以 MP4(H.264)回傳,解析度 1344 × 768、24 fps,附帶 32 kHz 的立體聲 AAC 音軌。
錯誤
在任務建立之前就被拒絕的請求,會回傳 HTTP 錯誤狀態碼和一個 error 物件,且不計費。受理之後才失敗的任務,在查詢時回傳 HTTP 200,並帶有 status: "failed" 和一個 error 物件。
錯誤碼、HTTP 狀態碼和重試建議請參閱共用錯誤目錄。
{
"id": "task_...",
"model": "minimax-h3",
"status": "failed",
"error": {
"code": 60001,
"message": "the request was blocked by content moderation"
}
}如果提交本身逾時,請先檢查你的任務清單再重新提交:第一次請求有可能已經被受理。
實用建議
- 把畫面和聲音一起描述:主體、地點、鏡頭、光線、對白和音效。
- 把對白寫進提示詞;希望聲音照著某個人時,附上一段參考音訊。
- 先用
768P做草稿,再用同一個請求以2K算繪最終鏡頭。 - 用首影格和尾影格控制鏡頭的起點和終點;用參考素材保留某個產品、某個人或某種動作。
- 加上
no text, no logos,避免出現憑空編造的標記。
