Video
Kling 3.0
Genera con Kling 3.0 clips de 3 a 15 segundos a partir de texto o de un primer y un último fotograma, con sonido nativo opcional, prompts multitoma y elementos reutilizables, entregados como tarea.
Kling 3.0 es el modelo de generación de vídeo de Kuaishou. Una sola solicitud crea un clip de 3 a 15 segundos a partir de un prompt, o de un primer fotograma y un último fotograma opcional, en tres modos de calidad (std, pro, 4K), con sonido nativo cuando lo pides. Un clip también puede ser una secuencia de hasta cinco tomas, cada una con su propio prompt y duración. Envía la solicitud, guarda el identificador de tarea devuelto y lee el vídeo terminado desde la tarea. Las imágenes se envían como URL.
ID de modelo
| ID de modelo | Entradas | Modos | Duración |
|---|---|---|---|
kling-3-0 | texto, primer y último fotograma, elementos | std, pro, 4K | De 3 a 15 segundos |
Consulta la página del modelo para ver los precios actuales.
Ejemplo rápido
curl https://api.seedrouter.ai/v1/videos/generations \
-H "Authorization: Bearer $SEEDROUTER_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "kling-3-0",
"prompt": "A red paper boat drifting on a calm pond at sunrise, soft mist on the water, slow push-in, no text, no logos.",
"mode": "pro",
"duration": 5,
"aspect_ratio": "16:9"
}'Endpoint
POST https://api.seedrouter.ai/v1/videos/generations| Encabezado | Valor |
|---|---|
| Authorization | Bearer YOUR_API_KEY |
| Content-Type | application/json |
La respuesta es una tarea ({"id": "task_...", "status": "processing"}), no el vídeo terminado. Consulta GET /v1/tasks/{task_id} para obtener el resultado. Guarda las claves de API en código del lado del servidor.
Parámetros
| Campo | Tipo | Por defecto | Notas |
|---|---|---|---|
model | string | obligatorio | kling-3-0 |
prompt | string | obligatorio para una sola toma | Hasta 2500 caracteres. Opcional en modo multitoma. |
image_urls | array de URL | ninguno | Hasta 2 imágenes: la primera es el primer fotograma y la segunda, el último. Sin imágenes, el clip es de texto a vídeo. |
mode | enum | pro | std, pro o 4K (K mayúscula). |
duration | integer | 5 | De 3 a 15 segundos. |
aspect_ratio | enum | 16:9 | 16:9, 9:16 o 1:1. |
sound | boolean | false | Genera sonido nativo con el vídeo. |
multi_shots | boolean | false | Crea el clip a partir de las tomas de multi_prompt. |
multi_prompt | array | ninguno | Hasta 5 tomas, cada una {"prompt", "duration"}: un prompt de hasta 500 caracteres y un número entero de segundos de 1 a 12. Obligatorio cuando multi_shots es true. |
kling_elements | array | ninguno | Hasta 3 elementos, cada uno {"name", "description", "element_input_urls"} con de 2 a 4 URL de imágenes. |
El esquema es estricto: los campos desconocidos se rechazan en lugar de ignorarse. callback_url no está disponible; consulta la tarea en su lugar.
Clips multitoma
Establece multi_shots en true y describe cada toma en multi_prompt. Las duraciones de las tomas deben sumar de 3 a 15 segundos; esa suma es la duración del clip y duration no se usa. prompt se puede omitir o usar para lo que comparten todas las tomas.
{
"model": "kling-3-0",
"mode": "pro",
"multi_shots": true,
"multi_prompt": [
{"prompt": "A red paper boat on a calm pond at sunrise, wide shot", "duration": 3},
{"prompt": "The boat drifts under a small wooden bridge, low angle", "duration": 3}
]
}Elementos
Un elemento es un sujeto que el modelo mantiene coherente en todo el clip: una persona, un producto o un personaje. Dale un name, una description breve y de 2 a 4 imágenes suyas, y luego menciónalo por su nombre en el prompt (por ejemplo, @hero).
{
"model": "kling-3-0",
"prompt": "@hero slowly turns toward the camera in soft window light",
"kling_elements": [
{
"name": "hero",
"description": "a young woman with short black hair and a yellow raincoat",
"element_input_urls": ["https://example.com/hero-front.png", "https://example.com/hero-side.png"]
}
]
}Entradas multimedia
Cada imagen es una URL HTTP(S) pública. No se aceptan data URI en base64: sube el archivo a tu propio almacenamiento y pasa su URL. Usa imágenes JPG o PNG de 10 MB o menos.
Factores de coste
Consulta la sección de precios del modelo para ver las tarifas actuales. Kling 3.0 se factura por segundo de vídeo, con una tarifa que fijan el modo y si sound está activado:
billed seconds = duration (single shot)
billed seconds = Σ multi_prompt[].duration (multi_shots: true)
cost = billed seconds × rate per secondLos segundos facturados se conocen cuando se acepta la solicitud, así que el importe reservado es el importe cobrado. Consulta los cargos definitivos en el historial de uso de tu cuenta. Las tareas fallidas no se cobran.
Esquema de salida
El envío devuelve la tarea:
{"id": "task_...", "model": "kling-3-0", "status": "processing", "created_at": 1789689600}Consultar la tarea
GET https://api.seedrouter.ai/v1/tasks/{task_id}Sondea cada 10–20 segundos hasta que status sea completed o failed. Que se agote el tiempo de red durante el sondeo no significa que la generación haya fallado: conserva el identificador de tarea y reanuda la comprobación. No crees otra tarea para consultar el progreso.
Tarea completada
{
"id": "task_...",
"model": "kling-3-0",
"status": "completed",
"created_at": 1789689600,
"finished_at": 1789689710,
"output": {
"video_url": "https://static.seedrouter.ai/media/tasks/task_example/0.mp4"
}
}En nuestras pruebas, un clip std de 3 segundos llegó como MP4 (H.264) a 1280 × 720, y un clip pro de 5 segundos con sound a 1920 × 1080 con pista de audio, cada uno en unos dos o tres minutos.
Errores
Las solicitudes rechazadas antes de crear una tarea devuelven un error HTTP con un objeto error y no se cobran. Una tarea que falla después de aceptarse devuelve HTTP 200 al consultarla, con status: "failed" y un objeto error.
Consulta el catálogo de errores común para ver códigos, estados HTTP y pautas de reintento.
{
"id": "task_...",
"model": "kling-3-0",
"status": "failed",
"error": {
"code": 60001,
"message": "The request was rejected by the content policy. Please revise the prompt or input images."
}
}Si el propio envío agota el tiempo de espera, revisa tus tareas antes de volver a enviar: puede que la primera solicitud se haya aceptado.
Consejos
- Describe el sujeto, el lugar, el movimiento de cámara y la luz con una frase cada uno; Kling sigue el lenguaje de cámara, como «lento acercamiento» y «contrapicado».
- Haz el borrador en
stdy luego renderiza la toma final enproo4Kcon la misma solicitud. - Usa un primer y un último fotograma para controlar dónde empieza y termina una toma.
- Divide una escena en tomas con
multi_prompten lugar de describir varios cortes en un solo prompt. - Añade
no text, no logospara evitar marcas inventadas.
