Claude Opus 5.5 jest już dostępny w SeedRouter

Poradnik promptów Seedance 2.5: struktura, kamera, czas, audio i referencje

Jak pisać prompty do Seedance 2.5: podstawowa formuła, język kamery, znaczniki czasu, składnia dialogów i dźwięku, referencje, edycja i różnice w 2.0.

Czytaj jako Markdown

Dobry prompt do Seedance 2.5 mówi, kto co robi, gdzie, jak filmuje to kamera i co słychać, w tej kolejności: najpierw podmiot i akcja, potem scena, styl wizualny, kamera i audio. Dłuższe klipy dziel na przedziały czasu, takie jak „0-3s”, albo na numerowane ujęcia, każdy plik referencyjny nazywaj jego numerem („Image 1”, „Video 1”), a długość, proporcje i rozdzielczość ustawiaj jako parametry żądania, nie w tekście. Poniższe zasady pochodzą z oficjalnych poradników ByteDance dotyczących promptów do Seedance 2.5 i 2.0, sprawdzonych 29 września 2026 roku. Każdy przykładowy prompt powstał na potrzeby tego wpisu.

Jak napisać prompt do Seedance 2.5?

Zacznij od podstawowej formuły ByteDance: „Podmiot + akcja lub zdarzenie + scena i otoczenie (opcjonalnie) + styl wizualny (opcjonalnie) + ruch kamery/cięcie (opcjonalnie) + audio (opcjonalnie)”. Wymagana jest tylko pierwsza część. Poradnik nazywa podmiot i akcję „fundamentem wideo” i pozwala pominąć części, których nie potrzebujesz.

W praktyce daje to cztery krótkie zdania:

<Subject> performs <main action or event> in <scene and environment>.
The visuals feature <visual style>.
Use <shot size, camera angle, camera movement, or cuts>.
Audio includes <dialogue, ambience, sound effects, or music>.

Wypełniona wersja:

A street baker pulls a tray of round loaves from a brick oven at night and sets it on a flour-dusted counter.
Warm orange light from the oven, visible steam, shallow depth of field, realistic film look.
Start with a close-up of the oven door opening, then pull back slowly to a medium shot of the counter.
Audio: crackling wood, the scrape of the metal tray, quiet street noise outside.

Trzy nawyki robią różnicę:

  • Opisuj to, czego chcesz, a nie to, czego nie chcesz. Oficjalny poradnik prosi o „pozytywne opisy, gdy tylko to możliwe” i wskazuje napisy oraz audio jako miejsca, w których negatywne instrukcje są obsługiwane (zobacz niżej).
  • Trzymaj parametry poza promptem. Długość klipu, proporcje, rozdzielczość i to, czy generować dźwięk, to pola żądania (duration, ratio, resolution, generate_audio); poradnik mówi, że parametrów „nie trzeba umieszczać w prompcie”.
  • Zakończ tym, co musi pozostać stałe, na przykład kątem kamery, miejscem akcji i nastrojem, aby utrzymały się przez cały klip.

Jak sterować kamerą i ujęciami?

Wpisuj terminy kamerowe wprost. ByteDance wymienia plany (plan totalny, plan ogólny, plan średni, plan amerykański, zbliżenie), ruchy (najazd, odjazd, panorama, jazda kamery, podążanie, orbita, pochylenie w górę, drżenie kamery z ręki) i kąty (żabia perspektywa, ujęcie z góry, perspektywa pierwszoosobowa), a także nazwane techniki, takie jak one-shot/długie ujęcie, dolly zoom, FPV, bullet time i speed ramp.

Przy mniej oczywistych terminach dodaj po nim wyjaśnienie prostym językiem. Własny przykład poradnika to „Przeniesienie ostrości: ostrość płynnie się przesuwa; drzewa, które początkowo były ostre na pierwszym planie, rozmywają się, a postać w tle stopniowo staje się ostra”.

Przy cięciu lub przejściu podaj zarówno moment, jak i sposób, na przykład „W 5. sekundzie szybka panorama z rozmyciem w lewo do następnej sceny”. Poradnik do Seedance 2.0 dodaje zasadę, która pomaga też w 2.5: jeden ruch kamery na ujęcie, bo prośba o to, by „najeżdżać, odjeżdżać, panoramować i poruszać się jednocześnie”, czyni obraz mniej stabilnym.

Scena z kilku kamer to po prostu kilka numerowanych ujęć, każde z własnym kadrem:

Shot 1: Wide shot, locked-off camera, eye level. Two chess players sit across a table in an empty library.
Shot 2: Over-the-shoulder shot from behind the older player. The younger player moves a knight and looks up.
Shot 3: Close-up of the older player's hand hovering over the board, then tapping the table once.
Quiet room tone, the soft click of chess pieces, no music.

Czy Seedance respektuje znaczniki czasu?

Seedance 2.5 tak, w pełnych sekundach. Seedance 2.0 nie. Porównanie ByteDance jest jednoznaczne: „Seedance 2.0 nie reaguje na znaczniki czasu i reaguje wyłącznie na numery ujęć, natomiast Seedance 2.5 obsługuje znaczniki czasu w pełnych sekundach”.

W 2.5 działają trzy formy:

  • Przedziały: „0-3s … 3-7s … 7-15s”, bez przerw między nimi.
  • Punkty: „At the 2-second mark, a gust of wind lifts the tablecloth.” (W 2. sekundzie podmuch wiatru unosi obrus.)
  • Czas względny: „She waits by the door. After 3 seconds, the light in the hallway goes out.” (Czeka przy drzwiach. Po 3 sekundach gaśnie światło w korytarzu.)

Dopasuj treść do czasu, który jej dajesz. Jeśli w przedziale dzieje się za mało, model improwizuje; jeśli za dużo, poradnik ostrzega, że wynik „może zawierać nadmiar cięć lub pomijać części fabuły”. Nie używaj znaczników czasu do szybkiego, powtarzalnego ruchu, takiego jak potrząsanie głową trzy razy na sekundę.

Klip sięgający 30-sekundowego limitu Seedance 2.5 rozpisz na etapy, każdy z wyraźnym stanem końcowym:

A lighthouse keeper's evening routine, realistic, cool blue dusk turning to night, no music.
0-6s: Wide shot of a lighthouse on a rocky coast at dusk. The keeper climbs the outside stairs with a lantern.
6-14s: Inside the lamp room, medium shot. He wipes the large lens with a cloth, then checks a brass gauge.
14-22s: Close-up of his hand turning a wheel. The main lamp starts to rotate and throws a beam across the room.
22-30s: Aerial shot pulling back from the tower. The beam sweeps over dark water. Waves and wind only.

Jak pisać dialogi, dźwięk i napisy?

Seedance 2.5 domyślnie generuje audio razem z wideo (generate_audio ma wartość true). Wszystko można opisać zwykłymi zdaniami, ale oficjalny poradnik definiuje nawiasy na wypadek, gdy trzeba rozdzielić rodzaje dźwięku:

TreśćSkładniaPrzykład
Muzyka( )(soft piano plays in the background)
Efekt dźwiękowy< ><a bell rings in the distance>
Dialog{ }{Welcome back.}
Napisy【 】【Chapter One】

Dla dialogu w konkretnym języku lub z akcentem nazwij go przed kwestią. Formuła poradnika to Dialogue Language + Regional Variety or Accent + Delivery Style + Speaker + {Dialogue}, na przykład: Dialogue language: American English. The girl says in natural, conversational American English: {I thought you weren't coming.} ByteDance podaje, że Seedance 2.5 natywnie generuje mowę w ponad 10 językach; poradnik ich nie wymienia, więc przetestuj swój. Nie mieszaj języków w jednej kwestii, przed czym ostrzega poradnik do 2.0, z wyjątkiem nazw własnych.

Gdy mówi kilka postaci, sposób wypowiedzi podawaj raz na kwestię w formie „Kwestia postaci (emocja): treść”. Poradnik ustalił, że powtarzanie słów po kwestii albo dopisywanie osobnych uwag o tonie i działaniu do pojedynczych słów należy do rzeczy, które skłaniają model do dodania napisów.

Tu negatywne instrukcje działają: „No subtitles”, „No BGM; only ambient and action sounds” albo „No audio.” Napisy mogą się mimo to przedostać, według ByteDance rzadziej niż w 2.0, a wideo referencyjne z napisami może przeważyć nad „no subtitles”. Aby nadać postaci istniejący głos lub piosenkę, dołącz je jako referencję audio i przypisz do tej postaci, jak w przykładzie z poradnika: „Image 1 przedstawia protagonistę Johna i używa barwy głosu z Audio 1”.

Jak odwoływać się w prompcie do obrazów, wideo i audio?

Numeruj każdy plik według kolejności dołączania i przypisuj go w tekście. Przykłady ByteDance brzmią tak: „Images 1-2 to Postać 1 i odpowiadają Audio 1; Images 3-4 to Postać 2 i odpowiadają Audio 2”. Nie polegaj na imieniu wpisanym w obrazek; poradnik mówi, że podpisanie obrazu „John” i napisanie potem „John is at school” „łatwo może spowodować pomylenie lub zdublowanie postaci”.

Powiedz, do czego służy każdy plik i co ma zostać pominięte:

Image 1 defines the courier's face, hairstyle and yellow raincoat. Do not use the image background.
Image 2 defines the narrow alley, wet cobblestones and neon reflections. Do not use any people in it.
Video 1 defines the running pace and the handheld follow camera only.
The courier from Image 1 runs through the alley from Image 2 at night, jumps a puddle, and stops at a green door.

Jeśli wideo referencyjne już pokazuje dokładny ruch, napisz „follow the actions and camera movement in Video 1”, zamiast opisywać każdy krok od nowa; powtórny opis może kłócić się z wideo. Gdy kilka obrazów pokazuje jeden obiekt z różnych kątów, powiedz to („All four images show the same desk lamp; only one lamp appears”), bo inaczej model może potraktować je jako osobne obiekty.

Ile ich użyć: Seedance 2.5 przyjmuje do 30 obrazów, 10 filmów i 10 klipów audio (filmy i audio łącznie maksymalnie po 30 sekund). ByteDance zaleca 1–8 podmiotów na obrazach podmiotów oraz 1–5 podmiotów po 5–10 sekund w referencjach wideo lub audio; więcej jest dozwolone, ale mniej stabilne. Seedance 2.0 przyjmuje do 9 obrazów, 3 filmów i 3 klipów audio, a jego poradnik zaleca łącznie 4–5 plików. Kształt żądania dla każdego typu referencji znajdziesz w części jak dodać obrazy, wideo i audio. Obrazy i filmy referencyjne z twarzami prawdziwych ludzi są odrzucane; ten wpis wyjaśnia błąd i to, co jest dozwolone.

Jak napisać prompt do edycji lub przedłużenia wideo?

W SeedRouter edycja i przedłużanie to funkcje Seedance 2.5: wyślij jedno wideo referencyjne i ustaw omni_reference_task_type na edit lub extend. Prompt musi wtedy zrobić dwie rzeczy.

Przy edycji określ zakres i opisz zmianę z A na B. Użyj słowa wyzwalającego, takiego jak add, remove, replace lub change to, a przy częściowej edycji podaj przedział czasu. Przykład z poradnika: „Zmień czynność mężczyzny z picia kawy na mycie podłogi w sekundach 4–6 w Video 1, a resztę treści pozostaw bez zmian”. Zamiana obiektu działa według tego samego wzoru:

Edit Video 1: replace the paper coffee cup on the desk with the green ceramic mug from Image 1. Keep the person, the camera and the audio unchanged.

Przy przedłużaniu podaj kierunek i zacznij od klatki granicznej. Użyj „extend forward”, „extend backward” lub „continue”, a potem opisz, co dzieje się dalej:

Continue Video 1: the cyclist reaches the top of the hill, stops, and takes off her helmet. The camera stays on the same side angle. Wind and distant birds.

Edycja lub przedłużenie zachowuje proporcje wideo źródłowego, więc zostaw ratio jako adaptive; edycja zachowuje też długość, więc duration musi mieć wartość -1. ByteDance zaleca MOV zarówno na wejściu, jak i na wyjściu (output_format: "mov") dla najlepszej ciągłości koloru i dźwięku. Jeśli połączone żądanie z referencjami i edycją daje niestabilne wyniki, poradnik zaleca rozbicie go na zadanie z referencjami, a potem zadanie edycji. Dokładne treści żądań znajdziesz w części jak edytować lub przedłużyć klip.

Jak używać storyboardów i klatek kluczowych?

Służą do różnych rzeczy. Storyboard z wieloma panelami, czyli kilka kadrów na jednym obrazie, to luźna referencja fabuły: model „nie dopasowuje się do niego ściśle”. Klatki kluczowe, czyli osobne obrazy dołączone po kolei, są odwzorowywane wiernie.

  • Storyboard: użyj prostych rysunków kreskowych lub ludzików bez tekstu, maksymalnie 15 paneli. Najpierw przypisz obraz storyboardu, napisz jednozdaniowe streszczenie historii, a potem opisz każde ujęcie, aby uzupełnić to, czego rysunek nie pokazuje (akcję, kamerę, styl).
  • Klatki kluczowe: dołącz każdą klatkę jako osobny obraz referencyjny i zacznij prompt od „Use Images 1 to 6 in order as keyframes.” (Użyj obrazów 1–6 po kolei jako klatek kluczowych.)
  • Pierwsza i ostatnia klatka: ustaw role obrazów na first_frame i last_frame. To wiąże wynik z proporcjami pierwszego obrazu, więc użyj dwóch obrazów o tych samych proporcjach. Ustawienie ich jako reference_image i napisanie „Image 1 is the first frame” nie wiąże proporcji, ale wynik może nie odpowiadać obrazom dokładnie.

Czym różnią się prompty do Seedance 2.0?

Struktura jest taka sama (podmiot, akcja, scena, kamera, styl, audio), ale poradnik do 2.0 prosi o kilka rzeczy, których 2.5 już nie potrzebuje:

  • Ujęcia zamiast sekund. Organizuj klip jako „Shot 1 / Shot 2 / Shot 3” i pozwól modelowi nadać tempo; poradnik do 2.0 nazywa precyzyjne sterowanie czasem „niestabilnym”.
  • Łagodny, ciągły ruch. Preferuje „wolne, łagodne, spójne, subtelne ruchy” zamiast sprintów, dużych skoków i gwałtownych przewrotów i prosi, by opisać, jak jedna czynność przechodzi w następną.
  • Emocje pokazane jako działania. Zamiast „bardzo smutna” napisz „opuszcza głowę, ramiona lekko jej drżą, oczy się czerwienią”.
  • Jedno zbliżenie twarzy i jedno zdjęcie całej sylwetki na postać, a nie arkusz z wieloma ujęciami, który 2.0 może odczytać jako kilka osób. Seedance 2.5 akceptuje obrazy z wieloma widokami.
  • Nazywaj podmiot za każdym razem tak samo, na przykład „the woman in the red coat@Image 1”, albo zdefiniuj imię raz i używaj go dalej.

Klipy Seedance 2.0 trwają 4–15 sekund (domyślnie 5), a model ma wersje Fast i Mini, które przyjmują to samo żądanie, tylko w 480p lub 720p. Porównanie wersji i przewodnik po 2.0, Fast i Mini pomogą wybrać model. ByteDance ostrzega też, że obie wersje mają „wyraźnie różne preferencje stylu estetycznego”, więc ten sam prompt nie da tego samego wyglądu.

Dlaczego Seedance nie słucha mojego promptu?

Większość niepowodzeń sprowadza się do kilku przyczyn wymienionych w oficjalnym FAQ:

  • Za dużo w za krótkim czasie. Rozłóż wydarzenia albo zwiększ duration.
  • Sprzeczności. Dwa różne opisy tej samej postaci albo ruch kamery, który walczy z akcją.
  • Postacie zamienione między referencjami. Dołączaj pliki referencyjne w kolejności, w jakiej postacie pojawiają się po raz pierwszy, i przenumeruj prompt, by się zgadzał.
  • Świecące oczy. Mocne słowa, takie jak „fanatical” czy „extremely shocked”, mogą sprawić, że źrenice zaczną świecić. Użyj spokojniejszych sformułowań i dodaj „normal human eyes; no glowing eyes”.
  • Błędy w tekście na ekranie. Przeliteruj słowo litera po literze albo podaj dokładny tekst jako obraz referencyjny.
  • Jedno żądanie robi za dużo. Rozdziel referencje i edycję na osobne zadania.
  • Zablokowana twarz. Twarze prawdziwych ludzi w referencjach są odrzucane; zobacz błąd dotyczący prawdziwej osoby.

Szkicuj w 480p z krótkim duration, a wersję, którą zatrzymasz, wyrenderuj w wyższej rozdzielczości. Nieudane zadania nie są rozliczane; ile kosztuje gotowy klip, sprawdzisz we wpisie Seedance API cena.

Najczęściej zadawane pytania

Czy prompty do Seedance trzeba pisać w JSON?

Żaden format nie jest wymagany. Poradnik ByteDance mówi, że prompty „można pisać całkowicie w języku naturalnym”, a wszystkie jego szablony to zwykłe zdania z opcjonalnymi etykietami, takimi jak „Shot 1” czy „0-3s”. Struktura pomaga; składnia JSON nie jest potrzebna.

Jak zrobić scenę walki w Seedance 2.5?

Opisz walkę ogólnie, a szczegóły zostaw dla jednego lub dwóch kluczowych ruchów; poradnik zaleca sformułowania w rodzaju „obie strony toczą walkę wręcz” zamiast wymieniania każdego ciosu. Rozłóż kolejne momenty na osi czasu, trzymaj się jednego ruchu kamery na ujęcie i opisz dźwięk efektami w < >.

Jak długie może być wideo z Seedance 2.5?

Do 30 sekund na żądanie, ustawiane przez duration (4–30 albo -1, aby model sam wybrał). Seedance 2.0 sięga do 15 sekund.

Czy istnieje oficjalny optymalizator promptów do Seedance?

Tak. ByteDance publikuje skill do promptów Seedance 2.5, sd25-pe, którego asystenci programowania mogą użyć, by przepisać twój prompt przed wysłaniem. Polecenie instalacji znajdziesz w oficjalnym poradniku.

Czy mogę użyć własnego zdjęcia jako referencji?

Nie. Seedance odrzuca obrazy i filmy referencyjne zawierające prawdziwe ludzkie twarze. Przewodnik po błędzie dotyczącym prawdziwej osoby wyjaśnia, na co ByteDance pozwala zamiast tego.

Wypróbuj swój prompt

Wklej prompt do playgroundu Seedance 2.5 lub playgroundu Seedance 2.0 albo wyślij go z kodu, korzystając z dokumentacji API Seedance 2.5. Doładowujesz konto raz, bez subskrypcji, kredyty nigdy nie wygasają, a zadanie zakończone niepowodzeniem nic nie kosztuje.

Powiązane poradniki