Claude Opus 5.5 est disponible sur SeedRouter

Guide des prompts Seedance 2.5 : structure, caméra, timing, audio et références

Comment écrire un prompt Seedance 2.5 : formule de base, langage caméra, horodatages, dialogues et sons, références, édition et différences avec la 2.0.

Lire en Markdown

Un bon prompt Seedance 2.5 dit qui fait quoi, où, comment la caméra le filme et ce que l’on entend, dans cet ordre : d’abord le sujet et l’action, puis la scène, le style visuel, la caméra et l’audio. Découpez les clips plus longs en plages de temps comme « 0-3s » ou en plans numérotés, désignez chaque fichier de référence par son numéro (« Image 1 », « Video 1 ») et définissez la durée, le ratio et la résolution comme paramètres de la requête, pas dans le texte. Les règles ci-dessous proviennent des guides de prompt officiels de ByteDance pour Seedance 2.5 et 2.0, vérifiés le 29 septembre 2026. Chaque exemple de prompt a été écrit pour cet article.

Comment écrire un prompt Seedance 2.5 ?

Partez de la formule de base de ByteDance : « Sujet + Action ou événement + Scène et environnement (facultatif) + Style visuel (facultatif) + Mouvement de caméra/Coupe (facultatif) + Audio (facultatif) ». Seule la première partie est obligatoire. Le guide appelle le sujet et l’action « le fondement de la vidéo » et vous laisse supprimer les parties dont vous n’avez pas besoin.

En pratique, cela donne quatre phrases courtes :

<Subject> performs <main action or event> in <scene and environment>.
The visuals feature <visual style>.
Use <shot size, camera angle, camera movement, or cuts>.
Audio includes <dialogue, ambience, sound effects, or music>.

Une version complétée :

A street baker pulls a tray of round loaves from a brick oven at night and sets it on a flour-dusted counter.
Warm orange light from the oven, visible steam, shallow depth of field, realistic film look.
Start with a close-up of the oven door opening, then pull back slowly to a medium shot of the counter.
Audio: crackling wood, the scrape of the metal tray, quiet street noise outside.

Trois habitudes font la différence :

  • Décrivez ce que vous voulez, pas ce que vous ne voulez pas. Le guide officiel demande des « descriptions positives chaque fois que possible » et cite les sous-titres et l’audio comme les cas où les instructions négatives sont prises en charge (voir plus bas).
  • Gardez les paramètres hors du prompt. La durée du clip, le ratio, la résolution et la génération ou non du son sont des champs de la requête (duration, ratio, resolution, generate_audio) ; selon le guide, les paramètres « n’ont pas besoin d’être inclus dans le prompt ».
  • Terminez par ce qui doit rester constant, comme l’angle de caméra, le décor et l’ambiance, pour que cela tienne sur tout le clip.

Comment contrôler la caméra et les plans ?

Écrivez directement les termes de caméra. ByteDance liste les valeurs de plan (très grand plan d’ensemble, plan d’ensemble, plan moyen, plan rapproché, gros plan), les mouvements (travelling avant, travelling arrière, panoramique, travelling latéral, suivi, orbite, panoramique vertical vers le haut, caméra à l’épaule tremblante) et les angles (contre-plongée, plongée zénithale, vue subjective), ainsi que des techniques nommées comme le plan-séquence, le dolly zoom, le FPV, le bullet time et le speed ramp.

Pour un terme plus obscur, ajoutez une explication en langage courant après le terme. L’exemple du guide lui-même : « Rack focus : la mise au point se déplace en douceur ; les arbres qui étaient nets au premier plan deviennent flous, tandis que le personnage à l’arrière-plan devient progressivement net. »

Pour une coupe ou une transition, indiquez à la fois le moment et la méthode, par exemple « At the 5-second mark, a quick whip pan to the left into the next scene. » (À la 5e seconde, un panoramique filé rapide vers la gauche vers la scène suivante.) Le guide de Seedance 2.0 ajoute une règle qui aide encore sur la 2.5 : un seul mouvement de caméra par plan, car demander de « pousser, tirer, panoramiquer et se déplacer en même temps » rend l’image moins stable.

Une scène multicaméra n’est qu’une suite de plans numérotés, chacun avec son propre cadrage :

Shot 1: Wide shot, locked-off camera, eye level. Two chess players sit across a table in an empty library.
Shot 2: Over-the-shoulder shot from behind the older player. The younger player moves a knight and looks up.
Shot 3: Close-up of the older player's hand hovering over the board, then tapping the table once.
Quiet room tone, the soft click of chess pieces, no music.

Seedance respecte-t-il les horodatages ?

Seedance 2.5 oui, à la seconde entière. Seedance 2.0 non. La comparaison de ByteDance est directe : « Seedance 2.0 ne réagit pas aux horodatages et ne réagit qu’aux numéros de plan, tandis que Seedance 2.5 prend en charge les horodatages en secondes entières. »

Trois formes fonctionnent sur la 2.5 :

  • Plages : « 0-3s … 3-7s … 7-15s », sans trous entre elles.
  • Instants : « At the 2-second mark, a gust of wind lifts the tablecloth. » (À la 2e seconde, une rafale de vent soulève la nappe.)
  • Timing relatif : « She waits by the door. After 3 seconds, the light in the hallway goes out. » (Elle attend près de la porte. Au bout de 3 secondes, la lumière du couloir s’éteint.)

Dosez le contenu en fonction du temps que vous lui accordez. Si une plage contient trop peu d’action, le modèle improvise ; si elle en contient trop, le guide prévient que le résultat « peut comporter des coupes excessives ou omettre des parties de l’intrigue ». N’utilisez pas d’horodatages pour un mouvement rapide et répété, comme secouer la tête trois fois par seconde.

Pour un clip allant jusqu’à la limite de 30 secondes de Seedance 2.5, écrivez-le en étapes, chacune avec un état final clair :

A lighthouse keeper's evening routine, realistic, cool blue dusk turning to night, no music.
0-6s: Wide shot of a lighthouse on a rocky coast at dusk. The keeper climbs the outside stairs with a lantern.
6-14s: Inside the lamp room, medium shot. He wipes the large lens with a cloth, then checks a brass gauge.
14-22s: Close-up of his hand turning a wheel. The main lamp starts to rotate and throws a beam across the room.
22-30s: Aerial shot pulling back from the tower. The beam sweeps over dark water. Waves and wind only.

Comment écrire les dialogues, le son et les sous-titres ?

Seedance 2.5 génère l’audio avec la vidéo par défaut (generate_audio vaut true). Tout peut être décrit en phrases simples, mais le guide officiel définit des signes de délimitation pour les cas où vous devez séparer les types de son :

ContenuSyntaxeExemple
Musique( )(soft piano plays in the background)
Effet sonore< ><a bell rings in the distance>
Dialogue{ }{Welcome back.}
Sous-titres【 】【Chapter One】

Pour un dialogue dans une langue ou avec un accent précis, nommez-le avant la réplique. La formule du guide est Dialogue Language + Regional Variety or Accent + Delivery Style + Speaker + {Dialogue}, par exemple : Dialogue language: American English. The girl says in natural, conversational American English: {I thought you weren't coming.} Selon ByteDance, Seedance 2.5 génère nativement de la parole dans plus de 10 langues ; le guide ne les liste pas, testez donc la vôtre. Ne mélangez pas les langues dans une même réplique, ce contre quoi le guide de la 2.0 met en garde, sauf pour les noms propres.

Quand plusieurs personnages parlent, indiquez l’interprétation une fois par réplique, sous la forme « Réplique du personnage (émotion) : contenu ». Le guide a constaté que répéter des mots après une réplique, ou attacher des notes de ton et d’action séparées à des mots isolés, fait partie de ce qui pousse le modèle à ajouter des sous-titres.

Les instructions négatives fonctionnent ici : « No subtitles », « No BGM; only ambient and action sounds » ou « No audio. » Des sous-titres peuvent tout de même apparaître, moins souvent que sur la 2.0 selon ByteDance, et une vidéo de référence qui contient des sous-titres peut l’emporter sur « no subtitles ». Pour donner à un personnage une voix ou une chanson existante, joignez-la comme référence audio et liez-la à ce personnage, comme dans l’exemple du guide : « Image 1 représente le protagoniste John et utilise le timbre de voix d’Audio 1. »

Comment référencer des images, des vidéos et de l’audio dans un prompt ?

Numérotez chaque fichier selon l’ordre dans lequel vous le joignez et liez-le dans le texte. Les exemples de ByteDance se lisent ainsi : « Images 1-2 sont le Personnage 1 et correspondent à Audio 1 ; Images 3-4 sont le Personnage 2 et correspondent à Audio 2. » Ne comptez pas sur un nom écrit dans l’image ; selon le guide, étiqueter une image « John » puis écrire « John is at school » « peut facilement provoquer une confusion ou une duplication des personnages ».

Dites à quoi sert chaque fichier, et ce qu’il faut ignorer :

Image 1 defines the courier's face, hairstyle and yellow raincoat. Do not use the image background.
Image 2 defines the narrow alley, wet cobblestones and neon reflections. Do not use any people in it.
Video 1 defines the running pace and the handheld follow camera only.
The courier from Image 1 runs through the alley from Image 2 at night, jumps a puddle, and stops at a green door.

Si une vidéo de référence montre déjà le mouvement exact, écrivez « follow the actions and camera movement in Video 1 » au lieu de redécrire chaque étape ; le reformuler peut entrer en conflit avec la vidéo. Quand plusieurs images montrent un même objet sous différents angles, dites-le (« All four images show the same desk lamp; only one lamp appears »), sinon le modèle risque de les traiter comme des objets distincts.

Combien en utiliser : Seedance 2.5 accepte jusqu’à 30 images, 10 vidéos et 10 clips audio (30 secondes au total au maximum pour les vidéos, de même pour l’audio). ByteDance recommande 1 à 8 sujets répartis sur les images de sujet, et 1 à 5 sujets de 5 à 10 secondes chacun pour les références vidéo ou audio ; davantage est permis mais moins stable. Seedance 2.0 accepte jusqu’à 9 images, 3 vidéos et 3 clips audio, et son guide recommande 4 à 5 fichiers au total. Pour la forme de la requête de chaque type de référence, consultez comment ajouter des images, des vidéos et de l’audio. Les images et vidéos de référence montrant le visage de vraies personnes sont rejetées ; cet article explique l’erreur et ce qui est autorisé.

Comment rédiger le prompt d’une édition ou d’une prolongation vidéo ?

Sur SeedRouter, l’édition et la prolongation sont des fonctions de Seedance 2.5 : envoyez une vidéo de référence et définissez omni_reference_task_type sur edit ou extend. Le prompt doit alors faire deux choses.

Pour une édition, précisez la portée et décrivez le changement de A vers B. Incluez un mot déclencheur comme add, remove, replace ou change to, et utilisez une plage de temps pour une édition partielle. L’exemple du guide : « Changer l’action de l’homme de 4 à 6 secondes dans Video 1, de boire un café à passer la serpillière, et laisser le reste du contenu inchangé. » Un remplacement d’objet suit le même schéma :

Edit Video 1: replace the paper coffee cup on the desk with the green ceramic mug from Image 1. Keep the person, the camera and the audio unchanged.

Pour une prolongation, indiquez la direction et partez de l’image de bord. Utilisez « extend forward », « extend backward » ou « continue », puis décrivez ce qui se passe ensuite :

Continue Video 1: the cyclist reaches the top of the hill, stops, and takes off her helmet. The camera stays on the same side angle. Wind and distant birds.

Une édition ou une prolongation conserve le ratio de la vidéo source, laissez donc ratio sur adaptive ; une édition conserve aussi sa durée, donc duration doit valoir -1. ByteDance recommande le MOV en entrée comme en sortie (output_format: "mov") pour la meilleure continuité des couleurs et de l’audio. Si une requête combinant références et édition donne des résultats instables, la solution du guide consiste à la scinder en une tâche de référence puis une tâche d’édition. Les corps de requête exacts se trouvent dans comment éditer ou prolonger un clip.

Comment utiliser les storyboards et les images clés ?

Ils n’ont pas le même rôle. Un storyboard à plusieurs cases, soit plusieurs images dans une seule, est une référence d’intrigue approximative : le modèle « ne s’aligne pas strictement » dessus. Les images clés, des images séparées jointes dans l’ordre, sont suivies de près.

  • Storyboard : utilisez des dessins au trait simples ou des bonshommes bâtons sans texte, 15 cases au maximum. Associez d’abord l’image du storyboard, écrivez un résumé de l’histoire en une ligne, puis décrivez chaque plan pour compléter ce que le dessin ne montre pas (action, caméra, style).
  • Images clés : joignez chaque image comme image de référence distincte et commencez le prompt par « Use Images 1 to 6 in order as keyframes. » (Utilisez les images 1 à 6 dans l’ordre comme images clés.)
  • Première et dernière image : définissez les rôles des images sur first_frame et last_frame. Cela fixe la sortie au ratio de la première image, utilisez donc deux images de même ratio. Les définir comme reference_image et écrire « Image 1 is the first frame » ne fixe pas le ratio, mais la sortie risque de ne pas correspondre exactement aux images.

Qu’est-ce qui change quand vous écrivez un prompt pour Seedance 2.0 ?

La structure est la même (sujet, action, scène, caméra, style, audio), mais le guide de la 2.0 demande quelques points dont la 2.5 n’a plus besoin :

  • Des plans, pas des secondes. Organisez le clip en « Shot 1 / Shot 2 / Shot 3 » et laissez le modèle gérer le rythme ; le guide de la 2.0 qualifie le timing précis d’« instable ».
  • Un mouvement doux et continu. Il préfère des « mouvements subtils lents, doux et cohérents » aux sprints, grands sauts et roulades violentes, et vous demande de décrire comment une action s’enchaîne avec la suivante.
  • Des émotions montrées par des actions. Au lieu de « très triste », écrivez « baisse la tête, les épaules tremblant légèrement, les yeux rougissant ».
  • Un gros plan du visage et une image en pied par personnage, pas une planche multi-angles, que la 2.0 peut interpréter comme plusieurs personnes. Seedance 2.5 accepte les images multivues.
  • Désignez un sujet toujours de la même façon, par exemple « the woman in the red coat@Image 1 », ou définissez un nom une fois et réutilisez-le.

Les clips de Seedance 2.0 durent de 4 à 15 secondes (5 par défaut), et le modèle existe en versions Fast et Mini qui acceptent la même requête, en 480p ou 720p uniquement. Le comparatif Seedance 2.5 vs Seedance 2.0 et le guide Seedance 2.0 vs Fast vs Mini expliquent quel modèle choisir. ByteDance prévient aussi que les deux versions ont des « préférences de style esthétique nettement différentes » : le même prompt ne donnera donc pas le même rendu.

Pourquoi Seedance ne suit-il pas mon prompt ?

La plupart des échecs remontent à une poignée de causes citées dans la FAQ officielle :

  • Trop de choses en trop peu de temps. Étalez les événements ou augmentez duration.
  • Des contradictions. Deux descriptions différentes d’un même personnage, ou un mouvement de caméra qui contrarie l’action.
  • Des personnages intervertis entre les références. Joignez les fichiers de référence dans l’ordre d’apparition des personnages et renumérotez le prompt en conséquence.
  • Des yeux lumineux. Des mots forts comme « fanatical » ou « extremely shocked » peuvent faire briller les pupilles. Employez une formulation plus calme et ajoutez « normal human eyes; no glowing eyes ».
  • Un texte à l’écran mal orthographié. Épelez le mot lettre par lettre, ou fournissez le texte exact comme image de référence.
  • Une requête qui en fait trop. Séparez les références et les éditions en tâches distinctes.
  • Un visage bloqué. Les visages de vraies personnes dans les références sont rejetés ; consultez l’erreur « may contain real person ».

Faites vos brouillons en 480p avec une duration courte, puis lancez le rendu de la version que vous gardez dans une résolution plus élevée. Les tâches échouées ne sont pas facturées ; pour le coût d’un clip terminé, consultez les prix de l’API Seedance.

Questions fréquentes

Faut-il écrire ses prompts Seedance en JSON ?

Aucun format n’est imposé. Le guide de ByteDance indique que les prompts « peuvent être entièrement écrits en langage naturel », et tous ses modèles sont des phrases simples avec des étiquettes facultatives comme « Shot 1 » ou « 0-3s ». La structure aide ; la syntaxe JSON n’est pas nécessaire.

Comment créer une scène de combat avec Seedance 2.5 ?

Décrivez le combat en termes généraux et réservez les détails à un ou deux mouvements clés ; le guide recommande une formulation comme « les deux camps s’affrontent au corps à corps » plutôt que de lister chaque coup. Placez les temps forts sur une chronologie, gardez un seul mouvement de caméra par plan et décrivez le son avec des effets < >.

Quelle durée peut atteindre une vidéo Seedance 2.5 ?

Jusqu’à 30 secondes par requête, définies avec duration (de 4 à 30, ou -1 pour laisser le modèle choisir). Seedance 2.0 va jusqu’à 15 secondes.

Existe-t-il un optimiseur de prompt Seedance officiel ?

Oui. ByteDance publie un skill de prompt pour Seedance 2.5, sd25-pe, que les assistants de code peuvent utiliser pour réécrire votre prompt avant que vous l’envoyiez. La commande d’installation figure dans le guide officiel.

Puis-je utiliser une photo de moi comme référence ?

Non. Seedance rejette les images et vidéos de référence qui contiennent de vrais visages humains. Le guide de l’erreur « may contain real person » présente ce que ByteDance autorise à la place.

Essayez votre prompt

Collez un prompt dans le playground Seedance 2.5 ou le playground Seedance 2.0, ou envoyez-le depuis votre code avec la référence de l’API Seedance 2.5. Vous rechargez une fois, sans abonnement, les crédits n’expirent jamais, et une tâche échouée ne coûte rien.

Guides associés