Claude Opus 5.5 ya está disponible en SeedRouter
LogoSeedRouter

Busca modelos por nombre, p. ej. 'nano banana'

Busca modelos por nombre, p. ej. 'nano banana'

Cómo usar la API de Kling 3.0: clave, solicitud, sondeo, fotogramas y multitoma

Usa la API de Kling 3.0 paso a paso: crea una clave, envía una tarea, sondéala hasta la URL del vídeo, usa primer y último fotograma y crea clips multitoma.

Leer en Markdown

Para usar la API de Kling 3.0, crea una clave de API, envía por POST un cuerpo JSON con el ID de modelo kling-3-0 y tu prompt, y sondea la tarea que devuelve hasta que la URL del vídeo esté lista. Un solo endpoint cubre texto a vídeo, vídeo con primer y último fotograma, clips multitoma y referencias de elementos; los campos del cuerpo deciden cuál.

Esta guía recorre cada paso con código que funciona y después muestra los fotogramas, los clips multitoma, los elementos y las solicitudes que se rechazan antes de cobrar nada.

¿Qué necesitas antes de la primera solicitud?

  1. Una clave de API. Crea una en la página de claves de API y guárdala en tu servidor. Nunca la pongas en código del navegador.
  2. Créditos. Añade saldo en la página de facturación. Los créditos nunca caducan y las tareas fallidas no se cobran.
  3. El ID de modelo kling-3-0.
export SEEDROUTER_API_KEY="your-key"

¿Cómo se envía una solicitud a Kling 3.0?

Envía la tarea por POST a /v1/videos/generations:

curl https://api.seedrouter.ai/v1/videos/generations \
  -H "Authorization: Bearer $SEEDROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "kling-3-0",
    "prompt": "A red paper boat drifting on a calm pond at sunrise, soft mist on the water, slow push-in, no text, no logos.",
    "mode": "std",
    "duration": 5,
    "aspect_ratio": "16:9"
  }'

La respuesta es una tarea, no un vídeo:

{"id": "task_...", "model": "kling-3-0", "status": "processing", "created_at": 1789689600}

Todos los campos salvo model y prompt tienen un valor por defecto:

CampoPor defectoValores
modeprostd (720p), pro (1080p), 4K
duration5De 3 a 15 segundos
aspect_ratio16:916:9, 9:16, 1:1
soundfalsetrue genera sonido nativo

El esquema es estricto: un campo desconocido se rechaza con HTTP 400 antes de crear la tarea, así que una errata nunca acaba en un clip pagado con el ajuste ignorado en silencio.

¿Cómo se obtiene el vídeo?

Sondea GET /v1/tasks/{id} cada 10–20 segundos hasta que status sea completed o failed. En nuestras pruebas, un clip std de 3 segundos terminó en unos dos minutos y un clip pro de 5 segundos con sonido, en unos dos minutos y medio.

import os
import time
import requests

API = "https://api.seedrouter.ai/v1"
HEADERS = {"Authorization": f"Bearer {os.environ['SEEDROUTER_API_KEY']}"}

task = requests.post(
    f"{API}/videos/generations",
    headers=HEADERS,
    json={
        "model": "kling-3-0",
        "prompt": "A red paper boat drifting on a calm pond at sunrise, slow push-in, no text, no logos.",
        "mode": "std",
        "duration": 5,
    },
    timeout=60,
)
task.raise_for_status()
task_id = task.json()["id"]

while True:
    result = requests.get(f"{API}/tasks/{task_id}", headers=HEADERS, timeout=60).json()
    if result["status"] in ("completed", "failed"):
        break
    time.sleep(15)

if result["status"] == "completed":
    print(result["output"]["video_url"])
else:
    print(result["error"])

Una tarea terminada tiene este aspecto:

{
  "id": "task_...",
  "model": "kling-3-0",
  "status": "completed",
  "output": {"video_url": "https://static.seedrouter.ai/media/tasks/task_example/0.mp4"}
}

std llegó a 1280 × 720 y pro a 1920 × 1080, ambos en MP4 (H.264); con sound activado, el archivo lleva una pista de audio estéreo. Descarga el archivo a tu propio almacenamiento: los enlaces alojados no son permanentes. Que se agote el tiempo de red durante el sondeo no significa que la generación haya fallado, así que guarda el identificador de tarea y vuelve a consultarlo en lugar de enviar una tarea nueva.

¿Cómo se parte de un primer y un último fotograma?

Pasa una o dos URL de imágenes en image_urls. La primera imagen abre el clip; una segunda marca dónde termina. Sin imágenes, el clip se crea solo a partir del prompt.

{
  "model": "kling-3-0",
  "prompt": "The camera glides from the empty street to the lit shop window",
  "image_urls": ["https://example.com/start.png", "https://example.com/end.png"],
  "mode": "pro",
  "duration": 6
}

Las imágenes deben ser URL HTTP(S) públicas, en JPG o PNG. Los datos en base64 se rechazan; sube antes el archivo a tu propio almacenamiento.

¿Cómo se crea un clip multitoma?

Establece multi_shots en true y describe cada toma en multi_prompt, hasta cinco tomas de 1 a 12 segundos cada una. Las duraciones de las tomas deben sumar de 3 a 15 segundos, y esa suma es la duración del clip que se te factura; duration no se usa.

{
  "model": "kling-3-0",
  "mode": "pro",
  "sound": true,
  "multi_shots": true,
  "multi_prompt": [
    {"prompt": "Wide shot of a small open kitchen, a chef tosses vegetables in a wok, flames rising, warm light.", "duration": 3},
    {"prompt": "Close-up of the wok, vegetables flipping through the flames, oil sizzling, steam drifting.", "duration": 3}
  ]
}

Este es el clip que produjo esa solicitud en nuestra prueba: un solo vídeo de 6 segundos que corta de un plano general a un primer plano:

Kling 3.0, pro (1080p), multitoma de 3 + 3 segundos, con sonido.

¿Cómo se mantiene coherente a una persona o un producto?

Añádelo a kling_elements: un name, una description breve y de 2 a 4 URL de imágenes del sujeto, hasta tres elementos por solicitud. Menciona el elemento por su nombre en el prompt.

{
  "model": "kling-3-0",
  "prompt": "@hero slowly turns toward the camera in soft window light",
  "kling_elements": [
    {
      "name": "hero",
      "description": "a young woman with short black hair and a yellow raincoat",
      "element_input_urls": ["https://example.com/hero-front.png", "https://example.com/hero-side.png"]
    }
  ]
}

¿Qué solicitudes se rechazan antes de cobrar nada?

Estas devuelven HTTP 400 al enviarlas, sin crear ninguna tarea y sin cobrar nada:

SolicitudMotivo
Un clip multitoma cuyas tomas suman menos de 3 o más de 15 segundosKling 3.0 crea clips de 3 a 15 segundos
Un elemento sin descriptionTodos los elementos la necesitan
Más de 2 image_urls, más de 5 tomas o más de 3 elementosFuera de los límites del modelo
mode: "4k" en minúsculaEl valor es 4K
Imágenes en base64, o cualquier campo que no esté en la tabla de arribaLos archivos multimedia se envían como URL; el esquema es estricto

Una tarea que se acepta y luego falla, por ejemplo por la política de contenido del modelo, devuelve status: "failed" con un código de error y no se cobra. El catálogo de errores enumera los códigos.

¿En qué se diferencia de la API propia de Kling?

La API para desarrolladores de Kling usa sus propios nombres de campo, y su versión heredada y la actual difieren entre sí.[1][2] Si vas a migrar una integración, haz corresponder los campos:

SeedRouterAPI heredada de Kling
model: "kling-3-0"model_name: "kling-v3"
sound: true / falsesound: "on" / "off"
duration: 5 (entero)duration: "5" (cadena)
mode: "4K"mode: "4k"
image_urls: [first, last]image y image_tail
multi_shots + multi_prompt: [{prompt, duration}]multi_shot + shot_type: "customize" + multi_prompt: [{index, prompt, duration}]
kling_elements: [{name, description, element_input_urls}]element_list: [{element_id}], creados de antemano

SeedRouter entrega los resultados como una tarea que sondeas; callback_url no se ofrece.

¿Puede ejecutarlo un agente de programación por ti?

Sí. La página de Kling 3.0 tiene un prompt listo para Claude Code, Codex o Cursor que lee la clave de tu entorno, te muestra la solicitud y su coste, espera tu aprobación y después envía, sondea y descarga el clip. La misma página tiene un Playground que envía exactamente el cuerpo que enviaría tu código.

Preguntas sobre la API de Kling 3.0

¿Hay una API oficial de Kling 3.0?

Sí. Kling publica una API para desarrolladores con sus propias claves, facturación por unidades y formato de solicitud.[1][3] SeedRouter es otra forma de llamar a Kling 3.0, con una sola clave y un saldo compartido con otros modelos.

¿Cuánto cuesta la API de Kling 3.0?

Se factura por segundo de vídeo, según el modo y según si el sonido está activado. La guía de precios de la API de Kling 3.0 calcula el coste de cada clip, y la página del modelo muestra las tarifas actuales.

¿Puedo cancelar una tarea?

No. Una vez aceptada, una tarea se ejecuta hasta completarse o fallar. Las tareas fallidas no se cobran.

Referencias

  1. Kling AI. Kling 3.0: Text to Video (referencia de la API, versión heredada). Obtenido el 6 de octubre de 2026 de kling.ai.
  2. Kling AI. Kling 3.0: Image to Video (referencia de la API, versión heredada). Obtenido el 6 de octubre de 2026 de kling.ai.
  3. Kling AI. Pricing: Video (API para desarrolladores). Obtenido el 6 de octubre de 2026 de kling.ai.

Guías relacionadas