Guida ai prompt di Seedance 2.5: struttura, camera, tempi, audio e riferimenti
Come scrivere prompt per Seedance 2.5: formula di base, linguaggio della camera, timestamp, dialoghi e suoni, riferimenti, modifiche e differenze con la 2.0.
Leggi in MarkdownUn buon prompt per Seedance 2.5 dice chi fa cosa, dove, come lo riprende la camera e cosa si sente, in quest'ordine: prima soggetto e azione, poi scena, stile visivo, camera e audio. Suddividi le clip più lunghe in intervalli di tempo come "0-3s" o in inquadrature numerate, indica ogni file di riferimento con il suo numero ("Image 1", "Video 1") e imposta durata, proporzioni e risoluzione come parametri della richiesta, non nel testo. Le regole che seguono provengono dalle guide ufficiali ai prompt di ByteDance per Seedance 2.5 e 2.0, verificate il 29 settembre 2026. Ogni prompt di esempio è stato scritto per questo articolo.
Come si scrive un prompt per Seedance 2.5?
Parti dalla formula di base di ByteDance: «Soggetto + Azione o Evento + Scena e Ambiente (facoltativo) + Stile visivo (facoltativo) + Movimento di camera/Stacco (facoltativo) + Audio (facoltativo)». Solo la prima parte è obbligatoria. La guida definisce soggetto e azione «la base del video» e ti lascia eliminare le parti che non ti servono.
In pratica, diventano quattro frasi brevi:
<Subject> performs <main action or event> in <scene and environment>.
The visuals feature <visual style>.
Use <shot size, camera angle, camera movement, or cuts>.
Audio includes <dialogue, ambience, sound effects, or music>.Una versione compilata:
A street baker pulls a tray of round loaves from a brick oven at night and sets it on a flour-dusted counter.
Warm orange light from the oven, visible steam, shallow depth of field, realistic film look.
Start with a close-up of the oven door opening, then pull back slowly to a medium shot of the counter.
Audio: crackling wood, the scrape of the metal tray, quiet street noise outside.Tre abitudini fanno la differenza:
- Descrivi ciò che vuoi, non ciò che non vuoi. La guida ufficiale chiede «descrizioni in positivo quando possibile» e indica sottotitoli e audio come i casi in cui le istruzioni negative sono supportate (vedi sotto).
- Tieni i parametri fuori dal prompt. Durata della clip, proporzioni, risoluzione e generazione del suono sono campi della richiesta (
duration,ratio,resolution,generate_audio); la guida dice che i parametri «non devono essere inclusi nel prompt». - Chiudi con ciò che deve restare costante, come l'angolo di ripresa, l'ambientazione e l'atmosfera, così che si mantenga per tutta la clip.
Come si controllano camera e inquadrature?
Scrivi direttamente i termini di ripresa. ByteDance elenca i piani (campo lunghissimo, campo lungo, piano medio, primo piano largo, primo piano), i movimenti (push in, pull out, panoramica, carrellata, inseguimento, orbita, tilt verso l'alto, camera a mano mossa) e gli angoli (dal basso, dall'alto, in prima persona), oltre a tecniche con un nome proprio come piano sequenza, dolly zoom, FPV, bullet time e speed ramp.
Per i termini meno noti, aggiungi una spiegazione in parole semplici dopo il termine. L'esempio della guida stessa è «Rack focus: la messa a fuoco si sposta in modo fluido; gli alberi in primo piano, prima nitidi, diventano sfocati, mentre il personaggio sullo sfondo diventa gradualmente nitido.»
Per uno stacco o una transizione, indica sia il momento sia il metodo, per esempio «Al secondo 5, una rapida whip pan verso sinistra porta alla scena successiva.» La guida di Seedance 2.0 aggiunge una regola che aiuta anche sulla 2.5: usa un solo movimento di camera per inquadratura, perché chiedere di «avanzare, arretrare, fare una panoramica e muoversi contemporaneamente» rende l'immagine meno stabile.
Una scena con più camere è semplicemente una serie di inquadrature numerate, ciascuna con la propria composizione:
Shot 1: Wide shot, locked-off camera, eye level. Two chess players sit across a table in an empty library.
Shot 2: Over-the-shoulder shot from behind the older player. The younger player moves a knight and looks up.
Shot 3: Close-up of the older player's hand hovering over the board, then tapping the table once.
Quiet room tone, the soft click of chess pieces, no music.Seedance rispetta i timestamp?
Seedance 2.5 sì, in secondi interi. Seedance 2.0 no. Il confronto di ByteDance è diretto: «Seedance 2.0 non risponde ai timestamp e risponde solo ai numeri delle inquadrature, mentre Seedance 2.5 supporta timestamp in secondi interi.»
Sulla 2.5 funzionano tre forme:
- Intervalli: "0-3s … 3-7s … 7-15s", senza vuoti tra l'uno e l'altro.
- Istanti: "At the 2-second mark, a gust of wind lifts the tablecloth." (Al secondo 2, una folata di vento solleva la tovaglia.)
- Tempi relativi: "She waits by the door. After 3 seconds, the light in the hallway goes out." (Lei aspetta vicino alla porta. Dopo 3 secondi, la luce del corridoio si spegne.)
Dosa il contenuto in base al tempo che gli concedi. Se in un intervallo succede troppo poco, il modello improvvisa; se succede troppo, la guida avverte che il risultato «può contenere stacchi eccessivi od omettere parti della trama». Non usare i timestamp per movimenti rapidi e ripetuti, come scuotere la testa tre volte al secondo.
Per una clip fino al limite di 30 secondi di Seedance 2.5, scrivila per fasi, ciascuna con uno stato finale chiaro:
A lighthouse keeper's evening routine, realistic, cool blue dusk turning to night, no music.
0-6s: Wide shot of a lighthouse on a rocky coast at dusk. The keeper climbs the outside stairs with a lantern.
6-14s: Inside the lamp room, medium shot. He wipes the large lens with a cloth, then checks a brass gauge.
14-22s: Close-up of his hand turning a wheel. The main lamp starts to rotate and throws a beam across the room.
22-30s: Aerial shot pulling back from the tower. The beam sweeps over dark water. Waves and wind only.Come si scrivono dialoghi, suoni e sottotitoli?
Seedance 2.5 genera l'audio insieme al video per impostazione predefinita (generate_audio è true). Tutto si può descrivere con frasi normali, ma la guida ufficiale definisce delle parentesi per quando devi separare i tipi di suono:
| Contenuto | Sintassi | Esempio |
|---|---|---|
| Musica | ( ) | (soft piano plays in the background) |
| Effetto sonoro | < > | <a bell rings in the distance> |
| Dialogo | { } | {Welcome back.} |
| Sottotitoli | 【 】 | 【Chapter One】 |
Per un dialogo in una lingua o con un accento specifici, indicali prima della battuta. La formula della guida è Dialogue Language + Regional Variety or Accent + Delivery Style + Speaker + {Dialogue}, per esempio: Dialogue language: American English. The girl says in natural, conversational American English: {I thought you weren't coming.} ByteDance dichiara che Seedance 2.5 genera il parlato in modo nativo in più di 10 lingue; la guida non le elenca, quindi prova la tua. Non mescolare lingue nella stessa battuta, cosa da cui mette in guardia la guida della 2.0, tranne che per i nomi propri.
Quando parlano più personaggi, scrivi l'intonazione una sola volta per battuta nella forma "Battuta del personaggio (emozione): contenuto". La guida ha rilevato che ripetere parole dopo una battuta, o associare note separate di tono e azione a singole parole, è una delle cose che spingono il modello ad aggiungere sottotitoli.
Qui le istruzioni negative funzionano: "No subtitles" (niente sottotitoli), "No BGM; only ambient and action sounds" (niente musica di sottofondo; solo suoni ambientali e d'azione) o "No audio." (niente audio). I sottotitoli possono comunque comparire, meno spesso che sulla 2.0 secondo ByteDance, e un video di riferimento che contiene sottotitoli può prevalere su "no subtitles". Per dare a un personaggio una voce o una canzone esistente, allegala come riferimento audio e associala a quel personaggio, come nell'esempio della guida: «Image 1 raffigura il protagonista John e usa il timbro vocale di Audio 1.»
Come si inseriscono immagini, video e audio di riferimento nel prompt?
Numera ogni file secondo l'ordine in cui lo alleghi e collegalo nel testo. Gli esempi di ByteDance sono così: «Images 1-2 sono il Personaggio 1 e corrispondono ad Audio 1; Images 3-4 sono il Personaggio 2 e corrispondono ad Audio 2.» Non affidarti a un nome scritto dentro l'immagine; la guida dice che etichettare un'immagine "John" e poi scrivere "John is at school" «può facilmente causare confusione o duplicazione dei personaggi».
Indica a cosa serve ogni file e cosa ignorare:
Image 1 defines the courier's face, hairstyle and yellow raincoat. Do not use the image background.
Image 2 defines the narrow alley, wet cobblestones and neon reflections. Do not use any people in it.
Video 1 defines the running pace and the handheld follow camera only.
The courier from Image 1 runs through the alley from Image 2 at night, jumps a puddle, and stops at a green door.Se un video di riferimento mostra già il movimento esatto, scrivi "follow the actions and camera movement in Video 1" (segui le azioni e il movimento di camera di Video 1) invece di descrivere di nuovo ogni passaggio; ripeterlo può entrare in conflitto con il video. Quando più immagini mostrano lo stesso oggetto da angolazioni diverse, dillo ("All four images show the same desk lamp; only one lamp appears", cioè tutte e quattro le immagini mostrano la stessa lampada da scrivania e ne compare una sola), altrimenti il modello potrebbe trattarle come oggetti separati.
Quanti usarne: Seedance 2.5 accetta fino a 30 immagini, 10 video e 10 clip audio (video e audio al massimo 30 secondi in totale ciascuno). ByteDance consiglia 1–8 soggetti nelle immagini dei soggetti e 1–5 soggetti di 5–10 secondi ciascuno per i riferimenti video o audio; se ne possono usare di più, ma con meno stabilità. Seedance 2.0 accetta fino a 9 immagini, 3 video e 3 clip audio, e la sua guida consiglia 4–5 file in totale. Per la struttura della richiesta di ogni tipo di riferimento, vedi come si aggiungono immagini, video e audio. Le immagini e i video di riferimento con volti di persone reali vengono rifiutati; questo articolo spiega l'errore e cosa è consentito.
Come si scrive il prompt per modificare o estendere un video?
Su SeedRouter, modifica ed estensione sono funzioni di Seedance 2.5: invia un video di riferimento e imposta omni_reference_task_type su edit o extend. A quel punto il prompt deve fare due cose.
Per le modifiche, indica l'ambito e descrivi il cambiamento da A a B. Includi una parola chiave come aggiungi, rimuovi, sostituisci o cambia in, e usa un intervallo di tempo per le modifiche parziali. L'esempio della guida: «Cambia l'azione dell'uomo da bere il caffè a lavare il pavimento dal secondo 4 al 6 di Video 1, e lascia invariato il resto del contenuto.» La sostituzione di un oggetto segue lo stesso schema:
Edit Video 1: replace the paper coffee cup on the desk with the green ceramic mug from Image 1. Keep the person, the camera and the audio unchanged.Per le estensioni, indica la direzione e parti dal fotogramma di confine. Usa "extend forward", "extend backward" o "continue", poi descrivi cosa succede dopo:
Continue Video 1: the cyclist reaches the top of the hill, stops, and takes off her helmet. The camera stays on the same side angle. Wind and distant birds.Una modifica o un'estensione mantiene le proporzioni del video sorgente, quindi lascia ratio su adaptive; una modifica ne mantiene anche la durata, quindi duration deve essere -1. ByteDance consiglia MOV sia per l'input sia per l'output (output_format: "mov") per la migliore continuità di colore e audio. Se una richiesta che combina riferimenti e modifiche dà risultati instabili, la soluzione della guida è dividerla in un'attività di riferimento e poi un'attività di modifica. I corpi esatti delle richieste sono in come si modifica o si estende una clip.
Come si usano storyboard e keyframe?
Svolgono compiti diversi. Uno storyboard a più riquadri, cioè più fotogrammi in un'unica immagine, è un riferimento di trama approssimativo: il modello «non si allinea rigorosamente» a esso. I keyframe, immagini separate allegate in ordine, vengono seguiti da vicino.
- Storyboard: usa disegni al tratto semplici o figure stilizzate senza testo, al massimo 15 riquadri. Prima collega l'immagine dello storyboard, scrivi un riassunto della storia in una riga, poi descrivi ogni inquadratura per completare ciò che il disegno non mostra (azione, camera, stile).
- Keyframe: allega ogni fotogramma come immagine di riferimento a sé e apri il prompt con "Use Images 1 to 6 in order as keyframes." (usa le immagini da 1 a 6 in ordine come keyframe).
- Primo e ultimo fotogramma: imposta i ruoli delle immagini su
first_frameelast_frame. Questo vincola l'output alle proporzioni della prima immagine, quindi usa due immagini con le stesse proporzioni. Impostarle comereference_imagee scrivere "Image 1 is the first frame" non vincola le proporzioni, ma l'output potrebbe non corrispondere esattamente alle immagini.
Cosa cambia nei prompt per Seedance 2.0?
La struttura è la stessa (soggetto, azione, scena, camera, stile, audio), ma la guida della 2.0 chiede alcune cose di cui la 2.5 non ha più bisogno:
- Inquadrature, non secondi. Organizza la clip come "Shot 1 / Shot 2 / Shot 3" e lascia che il modello ne gestisca il ritmo; la guida della 2.0 definisce «instabile» una tempistica precisa.
- Movimento delicato e continuo. Preferisce «movimenti lenti, delicati, coerenti e sottili» a scatti, grandi salti e capriole violente, e ti chiede di descrivere come un'azione confluisce nella successiva.
- Emozioni mostrate come azioni. Invece di "molto triste", scrivi "abbassa la testa, le spalle tremano leggermente, gli occhi si arrossano".
- Un primo piano del volto e un'immagine a figura intera per personaggio, non una tavola con più angolazioni, che la 2.0 può interpretare come più persone. Seedance 2.5 accetta immagini multivista.
- Chiama un soggetto sempre allo stesso modo, per esempio "the woman in the red coat@Image 1", oppure definisci un nome una volta e riusalo.
Le clip di Seedance 2.0 durano 4–15 secondi (5 per impostazione predefinita), e il modello ha le versioni Fast e Mini che accettano la stessa richiesta, solo a 480p o 720p. Il confronto tra le versioni e la guida Seedance 2.0 vs Fast vs Mini spiegano quale modello scegliere. ByteDance avverte inoltre che le due versioni hanno «preferenze di stile estetico significativamente diverse», quindi lo stesso prompt non darà lo stesso risultato visivo.
Perché Seedance non segue il mio prompt?
La maggior parte dei problemi risale a poche cause indicate nelle FAQ ufficiali:
- Troppo in troppo poco tempo. Distribuisci gli eventi o aumenta
duration. - Contraddizioni. Due descrizioni diverse dello stesso personaggio, o un movimento di camera che contrasta con l'azione.
- Personaggi scambiati tra i riferimenti. Allega i file di riferimento nell'ordine in cui i personaggi compaiono per la prima volta e rinumera il prompt di conseguenza.
- Occhi luminosi. Parole forti come "fanatical" (fanatico) o "extremely shocked" (estremamente sconvolto) possono far brillare le pupille. Usa termini più pacati e aggiungi "normal human eyes; no glowing eyes".
- Testo a schermo scritto male. Scrivi la parola lettera per lettera, oppure fornisci il testo esatto come immagine di riferimento.
- Una sola richiesta che fa troppo. Dividi riferimenti e modifiche in attività separate.
- Un volto bloccato. I volti di persone reali nei riferimenti vengono rifiutati; vedi l'errore «real person».
Fai le bozze a 480p con una duration breve, poi genera la versione che tieni a una risoluzione più alta. Le attività non riuscite non vengono addebitate; per sapere quanto costa una clip finita, vedi Prezzi dell'API Seedance.
Domande frequenti
Devo scrivere i prompt di Seedance in JSON?
Non è richiesto alcun formato. La guida di ByteDance dice che i prompt «possono essere scritti interamente in linguaggio naturale», e tutti i suoi modelli sono frasi semplici con etichette facoltative come "Shot 1" o "0-3s". La struttura aiuta; la sintassi JSON non serve.
Come si crea una scena di combattimento con Seedance 2.5?
Descrivi il combattimento in termini generali e riserva il dettaglio a una o due mosse chiave; la guida consiglia formulazioni come «entrambe le parti impegnate in un combattimento ravvicinato» invece di elencare ogni pugno. Metti i momenti chiave su una timeline, mantieni un solo movimento di camera per inquadratura e descrivi il suono con effetti < >.
Quanto può durare un video di Seedance 2.5?
Fino a 30 secondi per richiesta, impostati con duration (4–30, oppure -1 per lasciar scegliere al modello). Seedance 2.0 arriva a 15 secondi.
Esiste un ottimizzatore di prompt ufficiale per Seedance?
Sì. ByteDance pubblica una skill per i prompt di Seedance 2.5, sd25-pe, che gli assistenti di programmazione possono usare per riscrivere il tuo prompt prima che tu lo invii. Il comando di installazione è nella guida ufficiale.
Posso usare una mia foto come riferimento?
No. Seedance rifiuta le immagini e i video di riferimento che contengono volti umani reali. La guida all'errore «real person» spiega cosa consente invece ByteDance.
Prova il tuo prompt
Incolla un prompt nel playground di Seedance 2.5 o nel playground di Seedance 2.0, oppure invialo dal codice con il riferimento API di Seedance 2.5. Ricarichi una volta senza abbonamento, i crediti non scadono mai e un'attività non riuscita non costa nulla.



