Claude Opus 5.5 jest już dostępny w SeedRouter
LogoSeedRouter

Szukaj modeli po nazwie, np. „nano banana”

Szukaj modeli po nazwie, np. „nano banana”

Kling 3.0 prompty: ruchy kamery, sceny wieloujęciowe, dialogi i spójne postacie

Jak pisać prompty do Kling 3.0: pięć części mocnego promptu wideo, język kamery, który działa, sceny wieloujęciowe, dialogi z dźwiękiem i spójne postacie.

Czytaj jako Markdown

Dobry prompt do Kling 3.0 nazywa prostym językiem pięć rzeczy: obiekt, to, co widocznie robi, gdzie się znajduje, jak kamera kadruje i się porusza, oraz światło i nastrój. Własny poradnik Kling o promptach ujmuje to tak samo: mocne prompty „zaczynają się od jasnego, ludzkiego opisu: obiekt, akcja, otoczenie, język kamery, oświetlenie i nastrój”.[2] Wszystko inne w tym poradniku, czyli sceny wieloujęciowe, dialogi i spójne postacie, opiera się na tej strukturze.

Co powinien zawierać prompt do Kling 3.0?

Poradnik Kling o promptach wymienia części jasnego promptu i to, za co każda odpowiada:[2]

CzęśćCo ustalaPrzykład
ObiektGłówna postać, produkt lub miejsceKobieta w koszuli w paski; flakon perfum na aksamitnym postumencie
AkcjaWidoczny ruchIdzie w stronę kamery, kołysze sokiem w szklance
ScenaMiejsce i szczegóły otoczeniaTaras na świeżym powietrzu, stara ulica w Madrycie
KameraKadrowanie, kąt i ruchZbliżenie, żabia perspektywa, powolny najazd, ujęcie z jazdy
Światło i nastrójAtmosferaZłota godzina, zimna niebieska noc, miękka mgiełka

Opisuj obiekt konkretnie. Ten sam poradnik radzi zastąpić ogólnikowe słowo, takie jak „magia”, opisem „wirujące niebieskie cząsteczki energii z eterycznym blaskiem”, żeby model miał co narysować.[2] Opisuj ruch, który widz może zobaczyć, na przykład dym unoszący się w górę albo biegacza pochylonego do przodu, a nie uczucia czy intencje.

Prompt z naszych własnych testów, ze wszystkimi pięcioma częściami w jednym zdaniu:

Uliczny skrzypek gra nocą pod kamiennym łukiem, gdy pada drobny deszcz, powolny najazd kamery z drugiej strony placu, ciepłe światło latarni na mokrym bruku, melodia skrzypiec odbija się echem przy cichym deszczu. Bez tekstu, bez logo.

Kling 3.0, 1080p, 5 sekund, z dźwiękiem.

Jakie polecenia kamery wykonuje Kling 3.0?

Nazywaj pracę kamery tak, jak zrobiłby to reżyser. Poradnik Kling zaleca proste terminy kadrowania i ruchu oraz podaje takie zastosowania:[2]

PolecenieJak to napisaćDo czego się nadaje
ZbliżenieZbliżenie na twarz mówiącegoDialog, emocje, detale produktu
Szerokie ujęcieSzerokie ujęcie pokazujące taras i obie postacieOtoczenie i skala
NajazdKamera powoli najeżdża na obiektPodkreślenie, napięcie, odsłonięcie
Panorama lub odchylenieKamera panoramuje po pokoju albo odchyla się w górę ku szyldowiPokazanie przestrzeni lub wysokości
Ujęcie z jazdyKamera podąża obok biegaczaAkcja i ciągłość

Dodaj tempo, gdy ma znaczenie: „powoli” dla spokoju lub napięcia, „płynnie” dla czytelnej akcji, „szybko” dla energii.[2] Terminy kadrowania, takie jak detal, bliski plan, plan pełny i szeroki plan ogólny, mówią modelowi, jak daleko od obiektu znajduje się widz.[2]

Jak napisać scenę wieloujęciową?

Kling 3.0 potrafi podzielić jeden klip na kilka ujęć. Kling opisuje dwa sposoby: pozwolić modelowi samemu zaplanować cięcia na podstawie jednego promptu albo samodzielnie zdefiniować każde ujęcie i jego długość, co Kling nazywa Custom Multi-Shot i czego model, według Kling, będzie „ściśle przestrzegać”.[1] We własnych przykładach Kling zapisuje każde ujęcie jako jedną linię z kadrowaniem i akcją: „Ujęcie 1, szerokie ujęcie od tyłu z żabiej perspektywy, kamera jedzie za motocyklistą… Ujęcie 2, zbliżenie z boku z żabiej perspektywy, detal koła motocykla…”[1]

Przez API wersja z własnymi ujęciami to multi_shots: true z listą multi_prompt, po jednym wpisie na ujęcie z własnym promptem i czasem trwania. W naszym teście poprosiliśmy o dwa ujęcia po 3 sekundy:

{
  "model": "kling-3-0",
  "mode": "pro",
  "sound": true,
  "multi_shots": true,
  "multi_prompt": [
    {"prompt": "Wide shot of a small open kitchen, a chef tosses vegetables in a wok, flames rising, warm light. No text, no logos.", "duration": 3},
    {"prompt": "Close-up of the wok, vegetables flipping through the flames, oil sizzling, steam drifting. No text, no logos.", "duration": 3}
  ]
}

Kling 3.0, 1080p, dwa ujęcia po 3 sekundy, z dźwiękiem.

Daj każdemu ujęciu własne kadrowanie i opisuj obiekt w każdym z nich tak samo, żeby był odbierany jako ta sama osoba lub rzecz. Długości ujęć muszą łącznie dawać 3–15 sekund.

Jak pisać prompty z dialogami i dźwiękiem?

Wpisz kwestię do promptu i przypisz ją postaci, która ją wypowiada. Poradnik Kling pokazuje schemat „Postać (ton): kwestia”, na przykład „Mama (cicho, zaskoczonym tonem): Wow, w ogóle nie spodziewałam się takiego zwrotu akcji”, i podaje, że Kling 3.0 przypisuje każdą kwestię właściwemu rozmówcy nawet przy trzech lub więcej postaciach w kadrze.[1]

  • Języki. Dialogi działają po chińsku, angielsku, japońsku, koreańsku i hiszpańsku, a postacie mogą zmieniać język w obrębie jednego klipu. Według Kling kwestia w każdym innym języku jest tłumaczona na angielski.[1]
  • Akcenty i dialekty. Oznacz je przy kwestii, na przykład „mówi po angielsku z indyjskim akcentem”; Kling wymienia amerykański, brytyjski i indyjski akcent angielski oraz kilka dialektów chińskich, w tym kantoński i syczuański.[1]
  • Tło dźwiękowe. Nazwij też dźwięki w tle: przykład Kling zaczyna się od „cichego szumu klimatyzatora w salonie w tle”.[1]

Dźwięk jest generowany tylko wtedy, gdy o niego poprosisz: ustaw w żądaniu sound na true.

Jak zachować spójność postaci lub produktu?

Użyj elementu. W Kling 3.0 element to obiekt zbudowany z 2–4 obrazów referencyjnych; według Kling po powiązaniu obiekt pozostaje „wyraźny i stabilny, bez przesuwania się czy znikania” przy zoomach, panoramach i odchyleniach kamery.[1] W API trafia on do kling_elements z name, krótkim description i adresami URL obrazów, a prompt wspomina go z nazwy:

{
  "prompt": "@hero walks out of the elevator, takes off her sunglasses and nods to a colleague, steady tracking shot",
  "kling_elements": [
    {
      "name": "hero",
      "description": "a professional woman in a camel coat with a black commuter bag",
      "element_input_urls": ["https://example.com/hero-front.png", "https://example.com/hero-side.png"]
    }
  ]
}

Jako pierwszy obraz użyj widoku z przodu i dodaj widoki z boku lub z trzech czwartych; opis powinien nazywać to, co nie może się zmienić, na przykład ubranie albo logo na produkcie.

Jak kontrolować timing w 15-sekundowym klipie?

Oznaczaj kluczowe momenty czasem. Własny 15-sekundowy przykład Kling rozpisuje akcję według zegara: „W 4. sekundzie kamera przyspiesza do przodu razem z nią… W 8. sekundzie kamera stopniowo przybliża się do planu średniego… W 12. sekundzie muzyka i ruch osiągają kulminację… W ostatnich 3 sekundach…”[1] Jeśli chcesz jednego ciągłego ujęcia, napisz to wprost, jak w innym przykładzie Kling: „jedno nieprzerwane ujęcie bez montażowych przejść”.[1] Długość klipu to dowolna liczba całkowita od 3 do 15 sekund, więc dopasuj czas trwania do liczby rozpisanych momentów.

Czego lepiej nie pisać?

  • Samych ogólnikowych słów o jakości. „Filmowo” czy „arcydzieło” bez ruchu kamery albo światła dają modelowi niewiele do działania.[2]
  • Niechcianych napisów i znaków. Kling 3.0 dobrze renderuje napisy, w tym szyldy i logo, o które go poprosisz.[1] Jeśli nie chcesz żadnych, zakończ prompt słowami „bez tekstu, bez logo”, jak robimy we wszystkich naszych promptach testowych.
  • Kilku cięć w jednym zdaniu. Jeśli scena potrzebuje konkretnych cięć, użyj trybu wieloujęciowego z jednym wpisem na ujęcie, zamiast łączyć w jednym prompcie „potem kamera przechodzi do…”.

Pytania o prompty do Kling 3.0

Jak długi może być prompt do Kling 3.0?

Do 2500 znaków w SeedRouter i do 500 znaków na ujęcie w żądaniu wieloujęciowym. Większość mocnych promptów ma od jednego do czterech zdań.

Czy Kling 3.0 obsługuje negatywny prompt?

Żądanie Kling 3.0 w SeedRouter nie ma osobnego pola na negatywny prompt. To, czego chcesz uniknąć, wpisz w sam prompt, na przykład „bez tekstu, bez logo”. Bieżące API Kling również włącza to do promptu: jego dokumentacja mówi, że „prompt może zawierać opisy pozytywne i negatywne”.[3]

Jakie prompty z ruchem kamery dobrze działają w Kling 3.0?

Powolny najazd, ujęcie z jazdy, panorama, odchylenie i odsłonięcie z żabiej perspektywy to ruchy, których używa własny poradnik Kling, zapisane prostymi zdaniami, takimi jak „kamera powoli najeżdża na obiekt”.[2]

Gdzie mogę przetestować prompt?

Playground Kling 3.0 wykonuje to samo żądanie, które przyjmuje API, a poradnik Kling 3.0 API pokazuje, jak wysłać je z kodu.

Źródła

  1. Kling AI. Kling VIDEO 3.0 Model User Guide. 6 lutego 2026 r. Dostęp 6 października 2026 r., kling.ai.
  2. Kling AI. Kling AI Prompt Guide: The Secret to Cinematic Video Prompts. 7 sierpnia 2026 r. Dostęp 6 października 2026 r., kling.ai.
  3. Kling AI. Kling 3.0: Text to Video (dokumentacja API). Dostęp 6 października 2026 r., kling.ai.

Powiązane poradniki