Claude Opus 5.5 è disponibile su SeedRouter
LogoSeedRouter

Cerca modelli per nome, es. 'nano banana'

Cerca modelli per nome, es. 'nano banana'

Guida ai prompt di Kling 3.0: movimenti di camera, scene multi-inquadratura, dialoghi e personaggi coerenti

Prompt per Kling 3.0: cinque parti di un buon prompt video, linguaggio di ripresa efficace, scene multi-inquadratura, dialoghi con audio e personaggi coerenti.

Leggi in Markdown

Un buon prompt di Kling 3.0 nomina cinque cose in linguaggio semplice: il soggetto, cosa fa in modo visibile, dove si trova, come la camera lo inquadra e si muove, e la luce e l'atmosfera. La guida ai prompt di Kling lo dice allo stesso modo: i prompt efficaci «partono da una scrittura umana chiara: soggetto, azione, ambientazione, linguaggio di ripresa, illuminazione e atmosfera».[2] Tutto il resto di questa guida, scene multi-inquadratura, dialoghi e personaggi coerenti, si basa su questa struttura.

Cosa deve contenere un prompt di Kling 3.0?

La guida ai prompt di Kling elenca le parti di un prompt chiaro e cosa fa ciascuna:[2]

ParteCosa definisceEsempio
SoggettoIl personaggio, prodotto o luogo principaleUna donna con una camicia a righe; una boccetta di profumo su un piedistallo di velluto
AzioneMovimento visibileCammina verso la camera, fa roteare il succo in un bicchiere
ScenaLuogo e dettagli circostantiTerrazza all'aperto, una vecchia strada di Madrid
CameraInquadratura, angolazione e movimentoPrimo piano, ripresa dal basso, lenta carrellata in avanti, carrellata laterale
Luce e atmosferaL'atmosferaGolden hour, notte blu e fredda, foschia leggera

Descrivi il soggetto in modo concreto. La stessa guida suggerisce di sostituire una parola vaga come «magia» con «particelle di energia blu vorticanti con un bagliore etereo», così il modello ha qualcosa da disegnare.[2] Descrivi movimenti che lo spettatore può vedere, come il fumo che sale o un corridore che si sporge in avanti, invece di sentimenti o intenzioni.

Un prompt dei nostri test, con tutte e cinque le parti in una sola frase:

Un violinista di strada suona sotto un arco di pietra di notte mentre cade una pioggia leggera, lenta carrellata in avanti dall'altro lato della piazza, calda luce dei lampioni sui ciottoli bagnati, la melodia del violino riecheggia con la pioggia leggera. Niente testo, niente loghi.

Kling 3.0, 1080p, 5 secondi, con audio.

Quali indicazioni di camera segue Kling 3.0?

Indica la camera come farebbe un regista. La guida di Kling consiglia termini semplici di inquadratura e movimento e indica questi usi:[2]

IndicazioneCome scriverlaUtile per
Primo pianoPrimo piano sul volto di chi parlaDialoghi, emozione, dettaglio di prodotto
Campo lungoCampo lungo che mostra la terrazza ed entrambi i personaggiAmbientazione e scala
Carrellata in avantiLa camera avanza lentamente verso il soggettoEnfasi, tensione, una rivelazione
Panoramica orizzontale o verticaleLa camera fa una panoramica sulla stanza, o si inclina verso l'alto fino all'insegnaRivelare spazio o altezza
Carrellata lateraleLa camera segue il corridore al suo fiancoAzione e continuità

Aggiungi il ritmo quando conta: «lento» per calma o suspense, «stabile» per un'azione leggibile, «rapido» per dare energia.[2] Termini di inquadratura come primissimo piano, mezzo primo piano, figura intera e campo lungo di ambientazione dicono al modello quanto lo spettatore è distante dal soggetto.[2]

Come si scrive una scena multi-inquadratura?

Kling 3.0 può dividere una clip in più inquadrature. Kling descrive due modi: lasciare che il modello pianifichi gli stacchi da un solo prompt, oppure definire tu ogni inquadratura e la sua durata, che Kling chiama Custom Multi-Shot e che, a suo dire, il modello «seguirà rigorosamente».[1] Gli esempi di Kling scrivono ogni inquadratura come una riga di inquadratura più azione: «Inquadratura 1, campo lungo posteriore dal basso, in carrellata dietro il motociclista… Inquadratura 2, primo piano laterale dal basso, un dettaglio della ruota della moto…»[1]

Tramite API la versione personalizzata è multi_shots: true con una lista multi_prompt, una voce per inquadratura con prompt e durata propri. Il nostro test ha chiesto due inquadrature di 3 secondi:

{
  "model": "kling-3-0",
  "mode": "pro",
  "sound": true,
  "multi_shots": true,
  "multi_prompt": [
    {"prompt": "Wide shot of a small open kitchen, a chef tosses vegetables in a wok, flames rising, warm light. No text, no logos.", "duration": 3},
    {"prompt": "Close-up of the wok, vegetables flipping through the flames, oil sizzling, steam drifting. No text, no logos.", "duration": 3}
  ]
}

Kling 3.0, 1080p, due inquadrature di 3 secondi, con audio.

Dai a ogni inquadratura la sua impostazione e descrivi il soggetto allo stesso modo in ciascuna, così risulta la stessa persona o lo stesso oggetto. Le durate delle inquadrature devono sommare 3–15 secondi.

Come si scrivono dialoghi e audio nel prompt?

Scrivi la battuta nel prompt e attribuiscila al personaggio che la pronuncia. La guida di Kling mostra lo schema «Personaggio (tono): battuta», ad esempio «Mamma (piano, con tono sorpreso): Wow, non mi aspettavo proprio questa trama», e dice che Kling 3.0 assegna ogni battuta al personaggio giusto anche con tre o più personaggi nell'inquadratura.[1]

  • Lingue. I dialoghi funzionano in cinese, inglese, giapponese, coreano e spagnolo, e i personaggi possono cambiare lingua all'interno della stessa clip. Kling dice che una battuta in qualsiasi altra lingua viene tradotta in inglese.[1]
  • Accenti e dialetti. Indicali accanto alla battuta, ad esempio «parla in inglese con accento indiano»; Kling elenca gli accenti inglesi americano, britannico e indiano e diversi dialetti cinesi, tra cui il cantonese e il sichuanese.[1]
  • Ambiente. Indica anche il suono di fondo: l'esempio di Kling si apre con «un debole ronzio del condizionatore del soggiorno in sottofondo».[1]

L'audio viene generato solo se lo chiedi: imposta sound su true nella richiesta.

Come si mantiene coerente un personaggio o un prodotto?

Usa un elemento. In Kling 3.0 un elemento è un soggetto costruito da 2–4 immagini di riferimento; una volta collegato, secondo Kling il soggetto resta «nitido e stabile, senza spostarsi né scomparire» durante zoom e panoramiche orizzontali e verticali.[1] Nell'API va in kling_elements con un name, una breve description e gli URL delle immagini, e il prompt lo cita per nome:

{
  "prompt": "@hero walks out of the elevator, takes off her sunglasses and nods to a colleague, steady tracking shot",
  "kling_elements": [
    {
      "name": "hero",
      "description": "a professional woman in a camel coat with a black commuter bag",
      "element_input_urls": ["https://example.com/hero-front.png", "https://example.com/hero-side.png"]
    }
  ]
}

Usa una vista frontale come prima immagine e aggiungi viste laterali o di tre quarti; la descrizione deve indicare ciò che non deve cambiare, come l'abbigliamento o un logo su un prodotto.

Come si controllano i tempi in una clip di 15 secondi?

Segna i momenti chiave con i tempi. L'esempio di 15 secondi di Kling fa avanzare l'azione sul cronometro: «Al 4° secondo, la camera accelera in avanti con lei… All'8° secondo, la camera stringe gradualmente su un piano medio… Al 12° secondo, musica e movimento raggiungono il culmine… Negli ultimi 3 secondi…»[1] Per un'unica inquadratura continua, dillo in modo esplicito, come fa l'altro esempio di Kling: «un'unica inquadratura ininterrotta, senza transizioni di montaggio».[1] La durata della clip è un qualsiasi numero intero da 3 a 15 secondi, quindi adattala al numero di momenti che hai scritto.

Cosa conviene lasciare fuori?

  • Parole vaghe sulla qualità, da sole. «Cinematografico» o «capolavoro» senza un movimento di camera o una luce danno al modello poco su cui lavorare.[2]
  • Testo e marchi indesiderati. Kling 3.0 rende bene le scritte, comprese le insegne e i loghi che gli vengono richiesti.[1] Se non ne vuoi, chiudi il prompt con «niente testo, niente loghi», come fanno tutti i nostri prompt di prova.
  • Più stacchi in una sola frase. Se una scena richiede stacchi precisi, usa la multi-inquadratura con una voce per inquadratura invece di concatenare «poi la camera stacca su…» in un unico prompt.

Domande sui prompt di Kling 3.0

Quanto può essere lungo un prompt di Kling 3.0?

Fino a 2.500 caratteri su SeedRouter, e fino a 500 caratteri per inquadratura in una richiesta multi-inquadratura. La maggior parte dei prompt efficaci va da una a quattro frasi.

Kling 3.0 supporta i prompt negativi?

La richiesta di Kling 3.0 su SeedRouter non ha un campo separato per il prompt negativo. Scrivi ciò da evitare nel prompt stesso, ad esempio «niente testo, niente loghi». Anche l'API attuale di Kling lo integra nel prompt: la sua documentazione dice che «il prompt può includere descrizioni positive e negative».[3]

Quali prompt di movimento di camera funzionano bene con Kling 3.0?

Lenta carrellata in avanti, carrellata laterale, panoramica orizzontale, panoramica verticale e rivelazione dal basso sono i movimenti che usa la guida di Kling, scritti come frasi semplici, ad esempio «la camera avanza lentamente verso il soggetto».[2]

Dove posso provare un prompt?

Il Playground di Kling 3.0 esegue la stessa richiesta accettata dall'API, e la guida all'API di Kling 3.0 mostra come inviarla dal codice.

Riferimenti

  1. Kling AI. Kling VIDEO 3.0 Model User Guide. 6 febbraio 2026. Consultato il 6 ottobre 2026 su kling.ai.
  2. Kling AI. Kling AI Prompt Guide: The Secret to Cinematic Video Prompts. 7 agosto 2026. Consultato il 6 ottobre 2026 su kling.ai.
  3. Kling AI. Kling 3.0: Text to Video (riferimento API). Consultato il 6 ottobre 2026 su kling.ai.

Guide correlate