Seedance 2.5 Prompt-Guide: Aufbau, Kamera, Timing, Audio und Referenzen
So schreibst du Seedance 2.5 Prompts: die Grundformel, Kamerasprache, Zeitstempel, Syntax für Dialog und Ton, Referenzen, Edits und was bei 2.0 anders ist.
Als Markdown lesenEin guter Seedance 2.5 Prompt sagt, wer was wo tut, wie die Kamera es filmt und was man hört, und zwar in dieser Reihenfolge: zuerst Subjekt und Handlung, dann Szene, visueller Stil, Kamera und Audio. Teile längere Clips in Zeitbereiche wie „0-3s“ oder in nummerierte Einstellungen auf, benenne jede Referenzdatei über ihre Nummer („Image 1“, „Video 1“) und lege Länge, Seitenverhältnis und Auflösung als Anfrageparameter fest, nicht im Text. Die Regeln unten stammen aus ByteDances offiziellen Prompt-Guides für Seedance 2.5 und 2.0, geprüft am 29. September 2026. Jeder Beispiel-Prompt wurde für diesen Beitrag geschrieben.
Wie schreibst du einen Seedance 2.5 Prompt?
Beginne mit ByteDances Grundformel: „Subjekt + Handlung oder Ereignis + Szene und Umgebung (optional) + visueller Stil (optional) + Kamerabewegung/Schnitt (optional) + Audio (optional)“. Nur der erste Teil ist Pflicht. Der Guide nennt Subjekt und Handlung „das Fundament des Videos“ und erlaubt dir, die Teile wegzulassen, die du nicht brauchst.
In der Praxis werden daraus vier kurze Sätze:
<Subject> performs <main action or event> in <scene and environment>.
The visuals feature <visual style>.
Use <shot size, camera angle, camera movement, or cuts>.
Audio includes <dialogue, ambience, sound effects, or music>.Eine ausgefüllte Version:
A street baker pulls a tray of round loaves from a brick oven at night and sets it on a flour-dusted counter.
Warm orange light from the oven, visible steam, shallow depth of field, realistic film look.
Start with a close-up of the oven door opening, then pull back slowly to a medium shot of the counter.
Audio: crackling wood, the scrape of the metal tray, quiet street noise outside.Drei Gewohnheiten machen einen Unterschied:
- Beschreibe, was du willst, nicht was du nicht willst. Der offizielle Guide verlangt „wann immer möglich positive Beschreibungen“ und nennt Untertitel und Audio als die Stellen, an denen negative Anweisungen unterstützt werden (siehe unten).
- Halte Parameter aus dem Prompt heraus. Cliplänge, Seitenverhältnis, Auflösung und ob Ton erzeugt wird, sind Anfragefelder (
duration,ratio,resolution,generate_audio); laut Guide „müssen Parameter nicht in den Prompt aufgenommen werden“. - Schließe mit dem ab, was konstant bleiben muss, etwa Kamerawinkel, Schauplatz und Stimmung, damit es über den ganzen Clip hält.
Wie steuerst du Kamera und Einstellungen?
Schreib Kamerabegriffe direkt hin. ByteDance listet Einstellungsgrößen (extreme Totale, Totale, Halbnahe, Nahe, Großaufnahme), Bewegungen (Heranfahren, Zurückfahren, Schwenk, Kamerafahrt, Verfolgung, Umkreisen, Aufwärtsneigen, Handkamera-Wackeln) und Winkel (Untersicht, Aufsicht, Ego-Perspektive), dazu benannte Techniken wie One-Shot/Plansequenz, Dolly-Zoom, FPV, Bullet Time und Speed Ramp.
Für ausgefallenere Begriffe fügst du nach dem Begriff eine Erklärung in einfacher Sprache hinzu. Das Beispiel des Guides selbst: „Schärfeverlagerung: Der Fokus wandert fließend; die Bäume, die im Vordergrund zunächst scharf waren, werden unscharf, während die Figur im Hintergrund allmählich scharf wird.“
Gib bei einem Schnitt oder Übergang sowohl den Zeitpunkt als auch die Methode an, zum Beispiel „Bei der 5-Sekunden-Marke ein schneller Reißschwenk nach links in die nächste Szene.“ Der Guide zu Seedance 2.0 ergänzt eine Regel, die auch bei 2.5 noch hilft: eine Kamerabewegung pro Einstellung, denn wer „gleichzeitig heranfahren, zurückfahren, schwenken und bewegen“ verlangt, macht das Bild weniger stabil.
Eine Szene mit mehreren Kameras besteht einfach aus mehreren nummerierten Einstellungen, jede mit eigener Bildgestaltung:
Shot 1: Wide shot, locked-off camera, eye level. Two chess players sit across a table in an empty library.
Shot 2: Over-the-shoulder shot from behind the older player. The younger player moves a knight and looks up.
Shot 3: Close-up of the older player's hand hovering over the board, then tapping the table once.
Quiet room tone, the soft click of chess pieces, no music.Hält sich Seedance an Zeitstempel?
Seedance 2.5 tut es, in ganzen Sekunden. Seedance 2.0 nicht. ByteDances Vergleich ist eindeutig: „Seedance 2.0 reagiert nicht auf Zeitstempel und nur auf Einstellungsnummern, während Seedance 2.5 Zeitstempel in ganzen Sekunden unterstützt.“
Drei Formen funktionieren bei 2.5:
- Bereiche: „0-3s … 3-7s … 7-15s“, ohne Lücken dazwischen.
- Zeitpunkte: „At the 2-second mark, a gust of wind lifts the tablecloth.“ (Bei der 2-Sekunden-Marke hebt ein Windstoß die Tischdecke.)
- Relatives Timing: „She waits by the door. After 3 seconds, the light in the hallway goes out.“ (Sie wartet an der Tür. Nach 3 Sekunden geht das Licht im Flur aus.)
Stimme den Inhalt auf die Zeit ab, die du ihm gibst. Passiert in einem Bereich zu wenig, improvisiert das Modell; passiert zu viel, warnt der Guide, dass das Ergebnis „übermäßig viele Schnitte enthalten oder Teile der Handlung auslassen kann“. Nutze keine Zeitstempel für schnelle, wiederholte Bewegungen wie ein Kopfschütteln dreimal pro Sekunde.
Für einen Clip bis zum 30-Sekunden-Limit von Seedance 2.5 schreibst du ihn in Etappen, jede mit einem klaren Endzustand:
A lighthouse keeper's evening routine, realistic, cool blue dusk turning to night, no music.
0-6s: Wide shot of a lighthouse on a rocky coast at dusk. The keeper climbs the outside stairs with a lantern.
6-14s: Inside the lamp room, medium shot. He wipes the large lens with a cloth, then checks a brass gauge.
14-22s: Close-up of his hand turning a wheel. The main lamp starts to rotate and throws a beam across the room.
22-30s: Aerial shot pulling back from the tower. The beam sweeps over dark water. Waves and wind only.Wie schreibst du Dialoge, Ton und Untertitel?
Seedance 2.5 erzeugt Audio standardmäßig zusammen mit dem Video (generate_audio ist true). Alles lässt sich in einfachen Sätzen beschreiben, aber der offizielle Guide definiert Klammern für den Fall, dass du die Arten von Ton trennen musst:
| Inhalt | Syntax | Beispiel |
|---|---|---|
| Musik | ( ) | (soft piano plays in the background) |
| Soundeffekt | < > | <a bell rings in the distance> |
| Dialog | { } | {Welcome back.} |
| Untertitel | 【 】 | 【Chapter One】 |
Für Dialog in einer bestimmten Sprache oder mit einem Akzent nennst du diese vor der Zeile. Die Formel des Guides lautet Dialogue Language + Regional Variety or Accent + Delivery Style + Speaker + {Dialogue}, zum Beispiel: Dialogue language: American English. The girl says in natural, conversational American English: {I thought you weren't coming.} Laut ByteDance erzeugt Seedance 2.5 Sprache nativ in mehr als 10 Sprachen; der Guide listet sie nicht auf, teste deine also selbst. Mische keine Sprachen innerhalb einer Zeile, wovor der Guide zu 2.0 warnt, außer bei Eigennamen.
Wenn mehrere Figuren sprechen, schreibst du die Sprechweise einmal pro Zeile in der Form „Zeile der Figur (Emotion): Inhalt“. Der Guide stellte fest, dass Wörter nach einer Zeile zu wiederholen oder einzelnen Wörtern separate Ton- und Handlungsnotizen anzuhängen, zu den Dingen gehört, die das Modell dazu bringen, Untertitel hinzuzufügen.
Negative Anweisungen funktionieren hier: „No subtitles“, „No BGM; only ambient and action sounds“ oder „No audio.“ Untertitel können trotzdem durchrutschen, laut ByteDance seltener als bei 2.0, und ein Referenzvideo mit Untertiteln kann „no subtitles“ übersteuern. Um einer Figur eine vorhandene Stimme oder einen Song zu geben, hängst du diese als Audioreferenz an und ordnest sie der Figur zu, wie im Beispiel des Guides: „Image 1 zeigt den Protagonisten John und verwendet die Stimmfarbe aus Audio 1.“
Wie bindest du Bilder, Videos und Audio im Prompt ein?
Nummeriere jede Datei in der Reihenfolge, in der du sie anhängst, und ordne sie im Text zu. ByteDances Beispiele lauten so: „Images 1-2 sind Figur 1 und gehören zu Audio 1; Images 3-4 sind Figur 2 und gehören zu Audio 2.“ Verlass dich nicht auf einen Namen, der im Bild steht; laut Guide „kann es leicht zu Verwechslung oder Verdopplung von Figuren kommen“, wenn du ein Bild mit „John“ beschriftest und dann „John is at school“ schreibst.
Sag, wofür jede Datei da ist und was ignoriert werden soll:
Image 1 defines the courier's face, hairstyle and yellow raincoat. Do not use the image background.
Image 2 defines the narrow alley, wet cobblestones and neon reflections. Do not use any people in it.
Video 1 defines the running pace and the handheld follow camera only.
The courier from Image 1 runs through the alley from Image 2 at night, jumps a puddle, and stops at a green door.Zeigt ein Referenzvideo bereits genau die Bewegung, schreib „follow the actions and camera movement in Video 1“, statt jeden Schritt neu zu beschreiben; eine Wiederholung kann dem Video widersprechen. Zeigen mehrere Bilder ein Objekt aus verschiedenen Winkeln, sag das („All four images show the same desk lamp; only one lamp appears“), sonst behandelt das Modell sie womöglich als getrennte Objekte.
Wie viele du nutzen solltest: Seedance 2.5 nimmt bis zu 30 Bilder, 10 Videos und 10 Audioclips an (Videos und Audio jeweils höchstens 30 Sekunden insgesamt). ByteDance empfiehlt 1-8 Subjekte über die Subjektbilder hinweg sowie 1-5 Subjekte mit je 5-10 Sekunden für Video- oder Audioreferenzen; mehr ist erlaubt, aber weniger stabil. Seedance 2.0 nimmt bis zu 9 Bilder, 3 Videos und 3 Audioclips an, und sein Guide empfiehlt insgesamt 4-5 Dateien. Wie die Anfrage für jeden Referenztyp aussieht, zeigt wie du Bilder, Videos und Audio hinzufügst. Referenzbilder und -videos mit echten menschlichen Gesichtern werden abgelehnt; dieser Beitrag erklärt den Fehler und was erlaubt ist.
Wie promptest du eine Videobearbeitung oder -verlängerung?
Bei SeedRouter sind Bearbeiten und Verlängern Funktionen von Seedance 2.5: Sende ein Referenzvideo und setze omni_reference_task_type auf edit oder extend. Der Prompt muss dann zwei Dinge leisten.
Nenne bei Bearbeitungen den Umfang und beschreibe die Änderung von A nach B. Nutze ein Auslösewort wie add, remove, replace oder change to und einen Zeitbereich für Teilbearbeitungen. Das Beispiel des Guides: „Ändere die Handlung des Mannes in Video 1 von 4-6 Sekunden von Kaffeetrinken zu Bodenwischen und lass den restlichen Inhalt unverändert.“ Ein Objekttausch folgt demselben Muster:
Edit Video 1: replace the paper coffee cup on the desk with the green ceramic mug from Image 1. Keep the person, the camera and the audio unchanged.Sag bei Verlängerungen, in welche Richtung, und setze am Grenzframe an. Nutze „extend forward“, „extend backward“ oder „continue“ und beschreibe dann, was als Nächstes passiert:
Continue Video 1: the cyclist reaches the top of the hill, stops, and takes off her helmet. The camera stays on the same side angle. Wind and distant birds.Eine Bearbeitung oder Verlängerung behält das Seitenverhältnis des Quellvideos, lass ratio also auf adaptive; eine Bearbeitung behält außerdem die Länge, daher muss duration den Wert -1 haben. ByteDance empfiehlt MOV für Eingabe und Ausgabe (output_format: "mov"), um Farbe und Ton möglichst nahtlos fortzuführen. Liefert eine kombinierte Anfrage aus Referenzen und Bearbeitungen instabile Ergebnisse, lautet die Lösung des Guides, sie in eine Referenzaufgabe und danach eine Bearbeitungsaufgabe aufzuteilen. Die genauen Anfrage-Bodies stehen in wie du einen Clip bearbeitest oder verlängerst.
Wie nutzt du Storyboards und Keyframes?
Sie erfüllen unterschiedliche Aufgaben. Ein Storyboard mit mehreren Panels, also mehreren Frames in einem Bild, ist eine lose Handlungsreferenz: Das Modell „richtet sich nicht strikt danach“. Keyframes, also einzelne, der Reihe nach angehängte Bilder, werden genau befolgt.
- Storyboard: Nutze einfache Strichzeichnungen oder Strichmännchen ohne Text, höchstens 15 Panels. Ordne zuerst das Storyboard-Bild zu, schreib eine einzeilige Zusammenfassung der Geschichte und beschreibe dann jede Einstellung, um zu ergänzen, was die Zeichnung nicht zeigt (Handlung, Kamera, Stil).
- Keyframes: Hänge jeden Frame als eigenes Referenzbild an und beginne den Prompt mit „Use Images 1 to 6 in order as keyframes.“ (Nutze Bilder 1 bis 6 der Reihe nach als Keyframes.)
- Erster und letzter Frame: Setze die Rollen der Bilder auf
first_frameundlast_frame. Damit wird die Ausgabe auf das Seitenverhältnis des ersten Bildes festgelegt, nutze also zwei Bilder mit gleichem Seitenverhältnis. Setzt du sie alsreference_imageund schreibst „Image 1 is the first frame“, wird das Seitenverhältnis nicht festgelegt, aber die Ausgabe stimmt womöglich nicht genau mit den Bildern überein.
Was ist anders, wenn du Seedance 2.0 promptest?
Der Aufbau ist derselbe (Subjekt, Handlung, Szene, Kamera, Stil, Audio), aber der Guide zu 2.0 verlangt einige Dinge, die 2.5 nicht mehr braucht:
- Einstellungen statt Sekunden. Gliedere den Clip als „Shot 1 / Shot 2 / Shot 3“ und überlass dem Modell das Tempo; der Guide zu 2.0 nennt präzises Timing „instabil“.
- Sanfte, durchgehende Bewegung. Er bevorzugt „langsame, sanfte, zusammenhängende, feine Bewegungen“ gegenüber Sprints, großen Sprüngen und heftigem Rollen und verlangt, dass du beschreibst, wie eine Handlung in die nächste übergeht.
- Emotionen als Handlungen zeigen. Statt „sehr traurig“ schreibst du „senkt den Kopf, die Schultern zittern leicht, die Augen werden rot“.
- Ein Nahbild des Gesichts und ein Ganzkörperbild pro Figur, kein Blatt mit mehreren Ansichten, das 2.0 als mehrere Personen lesen kann. Seedance 2.5 akzeptiert Bilder mit mehreren Ansichten.
- Bezeichne ein Subjekt jedes Mal gleich, zum Beispiel „the woman in the red coat@Image 1“, oder lege einmal einen Namen fest und verwende ihn wieder.
Clips von Seedance 2.0 dauern 4-15 Sekunden (standardmäßig 5), und es gibt die Versionen Fast und Mini, die dieselbe Anfrage annehmen, nur in 480p oder 720p. Der Vergleich Seedance 2.5 vs Seedance 2.0 und der Leitfaden Seedance 2.0 vs Fast vs Mini helfen bei der Modellwahl. ByteDance warnt außerdem, dass die beiden Versionen „deutlich unterschiedliche ästhetische Stilvorlieben“ haben, derselbe Prompt liefert also nicht denselben Look.
Warum hält sich Seedance nicht an meinen Prompt?
Die meisten Fehlschläge gehen auf eine Handvoll Ursachen zurück, die die offiziellen FAQ nennen:
- Zu viel in zu wenig Zeit. Verteile die Ereignisse oder erhöhe
duration. - Widersprüche. Zwei verschiedene Beschreibungen derselben Figur oder eine Kamerabewegung, die gegen die Handlung arbeitet.
- Vertauschte Figuren zwischen Referenzen. Hänge Referenzdateien in der Reihenfolge an, in der die Figuren zuerst auftreten, und nummeriere den Prompt entsprechend neu.
- Leuchtende Augen. Starke Wörter wie „fanatical“ oder „extremely shocked“ können Pupillen leuchten lassen. Wähle ruhigere Formulierungen und ergänze „normal human eyes; no glowing eyes“.
- Falsch geschriebener Text im Bild. Buchstabiere das Wort Buchstabe für Buchstabe oder liefere den genauen Text als Referenzbild.
- Eine Anfrage, die zu viel will. Teile Referenzen und Bearbeitungen in getrennte Aufgaben auf.
- Ein blockiertes Gesicht. Echte menschliche Gesichter in Referenzen werden abgelehnt; siehe den Fehler „may contain real person“.
Erstelle Entwürfe in 480p mit kurzer duration und rendere die Version, die du behältst, in höherer Auflösung. Fehlgeschlagene Aufgaben werden nicht berechnet; was ein fertiger Clip kostet, steht in Seedance API Preise.
Häufige Fragen
Sollte ich Seedance Prompts in JSON schreiben?
Kein Format ist vorgeschrieben. Laut ByteDances Guide „können Prompts vollständig in natürlicher Sprache geschrieben werden“, und alle seine Vorlagen sind einfache Sätze mit optionalen Labels wie „Shot 1“ oder „0-3s“. Struktur hilft; JSON-Syntax ist nicht nötig.
Wie erstelle ich eine Kampfszene in Seedance 2.5?
Beschreibe den Kampf allgemein und spare dir Details für ein oder zwei Schlüsselbewegungen auf; der Guide empfiehlt Formulierungen wie „beide Seiten im Nahkampf“, statt jeden Schlag aufzuzählen. Leg die Beats auf eine Zeitachse, bleib bei einer Kamerabewegung pro Einstellung und beschreibe den Ton mit < >-Effekten.
Wie lang kann ein Seedance 2.5 Video sein?
Bis zu 30 Sekunden pro Anfrage, festgelegt mit duration (4-30 oder -1, damit das Modell wählt). Seedance 2.0 reicht bis 15 Sekunden.
Gibt es einen offiziellen Prompt-Optimierer für Seedance?
Ja. ByteDance veröffentlicht einen Prompt-Skill für Seedance 2.5, sd25-pe, mit dem Coding-Assistenten deinen Prompt umschreiben können, bevor du ihn absendest. Der Installationsbefehl steht im offiziellen Guide.
Kann ich ein Foto von mir selbst als Referenz nutzen?
Nein. Seedance lehnt Referenzbilder und -videos ab, die echte menschliche Gesichter enthalten. Der Leitfaden zum Fehler „may contain real person“ erklärt, was ByteDance stattdessen erlaubt.
Teste deinen Prompt
Füge einen Prompt in den Seedance 2.5 Playground oder den Seedance 2.0 Playground ein oder sende ihn aus deinem Code mit der API-Referenz zu Seedance 2.5. Du lädst einmal Guthaben auf, ohne Abo, Guthaben verfällt nie, und eine fehlgeschlagene Aufgabe kostet nichts.



