MiniMax H3
MiniMax H3로 768P 또는 2K, 4~15초 길이의 사운드 포함 클립을 생성하세요. 텍스트로 동영상 생성, 첫 프레임과 마지막 프레임, 참조로 동영상 생성을 지원하며 MiniMax 공식 요청 형식으로 작업을 전달합니다.
MiniMax H3(Hailuo 03)는 MiniMax의 멀티모달 동영상 모델입니다. 요청 한 번으로 화면과 소리를 함께 만듭니다. 결과는 대사, 앰비언스, 효과음이 담긴 768P 또는 2K, 4~15초 클립입니다. 요청 본문은 MiniMax 공식 형식이며 모델 ID는 minimax-h3입니다. 요청을 보내고, 반환된 작업 ID를 보관한 뒤, 완성된 동영상을 작업에서 읽어 오세요. 프레임과 참조는 URL로 전달합니다.
모델 ID
| 모델 ID | 입력 | 해상도 | 길이 |
|---|---|---|---|
minimax-h3 | 텍스트, 첫 프레임과 마지막 프레임, 참조 이미지·동영상·오디오 | 768P, 2K | 4~15초 |
현재 가격은 모델 페이지에서 확인하세요.
간단한 예제
curl https://api.seedrouter.ai/v1/videos/generations \
-H "Authorization: Bearer $SEEDROUTER_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "minimax-h3",
"content": [
{"type": "text", "text": "A small sailboat glides across a calm turquoise bay at sunrise, seagulls in the distance, the sound of water and wind. No text, no logos."}
],
"resolution": "768P",
"duration": 5,
"ratio": "16:9"
}'엔드포인트
POST https://api.seedrouter.ai/v1/videos/generations| 헤더 | 값 |
|---|---|
| Authorization | Bearer YOUR_API_KEY |
| Content-Type | application/json |
응답은 완성된 동영상이 아니라 작업({"id": "task_...", "status": "processing"})입니다. 결과는 GET /v1/tasks/{task_id}를 폴링해서 받으세요. API 키는 서버 측 코드에 보관하세요.
파라미터
| 필드 | 타입 | 기본값 | 설명 |
|---|---|---|---|
model | string | 필수 | minimax-h3 |
content | array | 필수 | 프롬프트와 미디어를 아래 설명한 항목으로 담습니다. 비어 있지 않은 text 항목이 정확히 하나 있어야 합니다. |
resolution | enum | 필수 | 768P 또는 2K. |
duration | integer | 필수 | 4~15초 사이의 정수. |
ratio | enum | 입력에 따라 다름 | adaptive, 21:9, 16:9, 4:3, 1:1, 3:4, 9:16. 텍스트만 쓸 때는 필수이며, 이때 adaptive는 받지 않습니다. |
content_filter | boolean | true | SeedRouter의 콘텐츠 필터(아래 설명). 모델에는 전송되지 않습니다. |
스키마는 엄격합니다. 알 수 없는 필드는 무시되지 않고 거부됩니다. callback_url은 사용할 수 없으니 작업을 폴링하세요. extra는 MiniMax-H3-Max용이며 이 모델에서는 받지 않습니다.
Content 항목
type | 항목 | role |
|---|---|---|
text | {"type": "text", "text": "..."}, 최대 7,000자 | 없음 |
image_url | {"type": "image_url", "image_url": {"url": "https://..."}, "role": "..."} | first_frame, last_frame 또는 reference_image |
video_url | {"type": "video_url", "video_url": {"url": "https://..."}, "role": "reference_video"} | reference_video |
audio_url | {"type": "audio_url", "audio_url": {"url": "https://..."}, "role": "reference_audio"} | reference_audio |
role 없는 이미지가 하나뿐이면 그 이미지가 첫 프레임입니다. 이미지가 둘 이상이면 모든 이미지에 role이 필요합니다.
모드
모드는 content의 항목으로 정해집니다. 모드 필드는 없습니다.
| 모드 | content 내용 | ratio |
|---|---|---|
| 텍스트로 동영상 생성 | text 항목 하나 | 필수, adaptive 불가 |
| 이미지로 동영상 생성 | text와 first_frame 및/또는 last_frame 이미지 | 어떤 값이든 adaptive로 처리되며, 이미지가 화면 형태를 정합니다 |
| 참조로 동영상 생성 | text와 최대 9개의 reference_image, 3개의 reference_video, 3개의 reference_audio 항목의 자유로운 조합 | 선택, 기본값 adaptive |
한 요청에서 프레임과 참조를 함께 쓸 수 없습니다.
{
"model": "minimax-h3",
"content": [
{"type": "text", "text": "The person in the photo speaks to camera: Follow the wind. Voice follows the reference audio."},
{"type": "image_url", "image_url": {"url": "https://example.com/person.jpg"}, "role": "reference_image"},
{"type": "audio_url", "audio_url": {"url": "https://example.com/voice.mp3"}, "role": "reference_audio"}
],
"resolution": "2K",
"duration": 6
}미디어 입력
이미지, 동영상, 오디오 항목은 모두 공개 HTTP(S) URL입니다. Base64 data URI와 mm_file:// ID는 받지 않습니다. 파일을 자체 스토리지에 업로드하고 그 URL을 전달하세요.
| 입력 | 형식 | 제한 |
|---|---|---|
| 이미지 | JPG, JPEG, PNG, WebP, HEIC, HEIF | 30 MB 이하, 각 변 256 |
| 동영상 | MP4, MOV(H.264 또는 H.265) | 50 MB 이하, 각 2 |
| 오디오 | WAV, MP3 | 15 MB 이하, 각 2~15초, 합계 15초 |
참조 동영상은 요청이 접수될 때 길이를 측정합니다. 길이를 읽을 수 없는 동영상은 거부되며 과금되지 않습니다. 그 밖의 제한은 생성 전에 검사하며, 하나라도 어긴 요청은 과금 없이 실패합니다.
콘텐츠 필터
직접 설정하지 않으면 content_filter는 true입니다. 필터가 켜져 있으면 모델이 실행되기 전에 텍스트, 모든 이미지, 그리고 각 참조 동영상의 세 프레임(처음, 중간, 마지막)을 검사합니다. 표시된 요청은 코드 60001로 실패하며 과금되지 않습니다. 검사할 수 없는 요청도 마찬가지입니다. 참조 오디오는 검사하지 않습니다. content_filter를 false로 설정하면 검사를 건너뜁니다. 웹사이트의 Playground는 항상 켜 둡니다.
과금에 영향을 주는 요소
현재 요율은 모델 가격 섹션에서 확인하세요. MiniMax H3는 동영상 초 단위로 과금되며, 요율은 출력 해상도로 정해집니다. 여기에 처음 다섯 개를 넘는 입력 이미지가 더해집니다:
billed seconds = duration + ceil(Σ each reference video's seconds)
extra images = max(0, number of images − 5)
cost = billed seconds × rate per second + extra images × rate per image첫 프레임, 마지막 프레임, 참조 이미지는 모두 이미지로 셉니다. 참조 오디오는 과금되지 않습니다. 두 수량 모두 요청이 접수될 때 확정되므로, 예약된 금액이 곧 과금되는 금액입니다. 최종 과금액은 계정의 사용 내역에서 확인하세요. 실패한 작업은 과금되지 않습니다.
출력 스키마
제출하면 작업이 반환됩니다:
{"id": "task_...", "model": "minimax-h3", "status": "processing", "created_at": 1789689600}작업 조회
GET https://api.seedrouter.ai/v1/tasks/{task_id}status가 completed 또는 failed가 될 때까지 10~20초마다 폴링하세요. 폴링 중 네트워크 타임아웃이 났다고 생성이 실패한 것은 아닙니다. 작업 ID를 보관하고 다시 확인하세요. 진행 상황을 보려고 작업을 새로 만들지 마세요.
완료된 작업
{
"id": "task_...",
"model": "minimax-h3",
"status": "completed",
"created_at": 1789689600,
"finished_at": 1789689740,
"output": {
"video_url": "https://static.seedrouter.ai/media/tasks/task_example/0.mp4",
"resolution": "768P",
"ratio": "16:9",
"duration": 5
}
}ratio는 클립이 만들어진 화면비이며, adaptive로 선택된 값도 포함합니다. 테스트에서 16:9의 4초 768P 클립은 MP4(H.264), 1344 × 768, 24 fps로 반환되었고, 32 kHz 스테레오 AAC 트랙이 포함되어 있었습니다.
오류
작업이 생성되기 전에 거부된 요청은 HTTP 오류와 error 객체를 반환하며 과금되지 않습니다. 접수된 뒤 실패한 작업은 조회 시 HTTP 200과 함께 status: "failed" 및 error 객체를 반환합니다.
코드, HTTP 상태, 재시도 지침은 공통 오류 카탈로그를 참고하세요.
{
"id": "task_...",
"model": "minimax-h3",
"status": "failed",
"error": {
"code": 60001,
"message": "the request was blocked by content moderation"
}
}제출 자체가 타임아웃된 경우에는 다시 보내기 전에 작업 목록을 확인하세요. 첫 번째 요청이 이미 접수되었을 수 있습니다.
팁
- 샷과 그 소리를 함께 설명하세요. 피사체, 장소, 카메라, 빛, 대사, 효과음입니다.
- 대사는 프롬프트에 쓰고, 목소리가 따라야 한다면 참조 오디오 클립을 첨부하세요.
768P로 초안을 만든 뒤, 같은 요청으로 최종 샷을2K로 렌더링하세요.- 샷의 시작과 끝은 첫 프레임과 마지막 프레임으로, 제품·인물·움직임을 유지하려면 참조로 제어하세요.
- 지어낸 표시가 들어가지 않도록
no text, no logos를 추가하세요.
