Kling 3.0 prompty: ruchy kamery, sceny wieloujęciowe, dialogi i spójne postacie
Jak pisać prompty do Kling 3.0: pięć części mocnego promptu wideo, język kamery, który działa, sceny wieloujęciowe, dialogi z dźwiękiem i spójne postacie.
Czytaj jako MarkdownDobry prompt do Kling 3.0 nazywa prostym językiem pięć rzeczy: obiekt, to, co widocznie robi, gdzie się znajduje, jak kamera kadruje i się porusza, oraz światło i nastrój. Własny poradnik Kling o promptach ujmuje to tak samo: mocne prompty „zaczynają się od jasnego, ludzkiego opisu: obiekt, akcja, otoczenie, język kamery, oświetlenie i nastrój”.[2] Wszystko inne w tym poradniku, czyli sceny wieloujęciowe, dialogi i spójne postacie, opiera się na tej strukturze.
Co powinien zawierać prompt do Kling 3.0?
Poradnik Kling o promptach wymienia części jasnego promptu i to, za co każda odpowiada:[2]
| Część | Co ustala | Przykład |
|---|---|---|
| Obiekt | Główna postać, produkt lub miejsce | Kobieta w koszuli w paski; flakon perfum na aksamitnym postumencie |
| Akcja | Widoczny ruch | Idzie w stronę kamery, kołysze sokiem w szklance |
| Scena | Miejsce i szczegóły otoczenia | Taras na świeżym powietrzu, stara ulica w Madrycie |
| Kamera | Kadrowanie, kąt i ruch | Zbliżenie, żabia perspektywa, powolny najazd, ujęcie z jazdy |
| Światło i nastrój | Atmosfera | Złota godzina, zimna niebieska noc, miękka mgiełka |
Opisuj obiekt konkretnie. Ten sam poradnik radzi zastąpić ogólnikowe słowo, takie jak „magia”, opisem „wirujące niebieskie cząsteczki energii z eterycznym blaskiem”, żeby model miał co narysować.[2] Opisuj ruch, który widz może zobaczyć, na przykład dym unoszący się w górę albo biegacza pochylonego do przodu, a nie uczucia czy intencje.
Prompt z naszych własnych testów, ze wszystkimi pięcioma częściami w jednym zdaniu:
Uliczny skrzypek gra nocą pod kamiennym łukiem, gdy pada drobny deszcz, powolny najazd kamery z drugiej strony placu, ciepłe światło latarni na mokrym bruku, melodia skrzypiec odbija się echem przy cichym deszczu. Bez tekstu, bez logo.
Kling 3.0, 1080p, 5 sekund, z dźwiękiem.
Jakie polecenia kamery wykonuje Kling 3.0?
Nazywaj pracę kamery tak, jak zrobiłby to reżyser. Poradnik Kling zaleca proste terminy kadrowania i ruchu oraz podaje takie zastosowania:[2]
| Polecenie | Jak to napisać | Do czego się nadaje |
|---|---|---|
| Zbliżenie | Zbliżenie na twarz mówiącego | Dialog, emocje, detale produktu |
| Szerokie ujęcie | Szerokie ujęcie pokazujące taras i obie postacie | Otoczenie i skala |
| Najazd | Kamera powoli najeżdża na obiekt | Podkreślenie, napięcie, odsłonięcie |
| Panorama lub odchylenie | Kamera panoramuje po pokoju albo odchyla się w górę ku szyldowi | Pokazanie przestrzeni lub wysokości |
| Ujęcie z jazdy | Kamera podąża obok biegacza | Akcja i ciągłość |
Dodaj tempo, gdy ma znaczenie: „powoli” dla spokoju lub napięcia, „płynnie” dla czytelnej akcji, „szybko” dla energii.[2] Terminy kadrowania, takie jak detal, bliski plan, plan pełny i szeroki plan ogólny, mówią modelowi, jak daleko od obiektu znajduje się widz.[2]
Jak napisać scenę wieloujęciową?
Kling 3.0 potrafi podzielić jeden klip na kilka ujęć. Kling opisuje dwa sposoby: pozwolić modelowi samemu zaplanować cięcia na podstawie jednego promptu albo samodzielnie zdefiniować każde ujęcie i jego długość, co Kling nazywa Custom Multi-Shot i czego model, według Kling, będzie „ściśle przestrzegać”.[1] We własnych przykładach Kling zapisuje każde ujęcie jako jedną linię z kadrowaniem i akcją: „Ujęcie 1, szerokie ujęcie od tyłu z żabiej perspektywy, kamera jedzie za motocyklistą… Ujęcie 2, zbliżenie z boku z żabiej perspektywy, detal koła motocykla…”[1]
Przez API wersja z własnymi ujęciami to multi_shots: true z listą multi_prompt, po jednym wpisie na ujęcie z własnym promptem i czasem trwania. W naszym teście poprosiliśmy o dwa ujęcia po 3 sekundy:
{
"model": "kling-3-0",
"mode": "pro",
"sound": true,
"multi_shots": true,
"multi_prompt": [
{"prompt": "Wide shot of a small open kitchen, a chef tosses vegetables in a wok, flames rising, warm light. No text, no logos.", "duration": 3},
{"prompt": "Close-up of the wok, vegetables flipping through the flames, oil sizzling, steam drifting. No text, no logos.", "duration": 3}
]
}Kling 3.0, 1080p, dwa ujęcia po 3 sekundy, z dźwiękiem.
Daj każdemu ujęciu własne kadrowanie i opisuj obiekt w każdym z nich tak samo, żeby był odbierany jako ta sama osoba lub rzecz. Długości ujęć muszą łącznie dawać 3–15 sekund.
Jak pisać prompty z dialogami i dźwiękiem?
Wpisz kwestię do promptu i przypisz ją postaci, która ją wypowiada. Poradnik Kling pokazuje schemat „Postać (ton): kwestia”, na przykład „Mama (cicho, zaskoczonym tonem): Wow, w ogóle nie spodziewałam się takiego zwrotu akcji”, i podaje, że Kling 3.0 przypisuje każdą kwestię właściwemu rozmówcy nawet przy trzech lub więcej postaciach w kadrze.[1]
- Języki. Dialogi działają po chińsku, angielsku, japońsku, koreańsku i hiszpańsku, a postacie mogą zmieniać język w obrębie jednego klipu. Według Kling kwestia w każdym innym języku jest tłumaczona na angielski.[1]
- Akcenty i dialekty. Oznacz je przy kwestii, na przykład „mówi po angielsku z indyjskim akcentem”; Kling wymienia amerykański, brytyjski i indyjski akcent angielski oraz kilka dialektów chińskich, w tym kantoński i syczuański.[1]
- Tło dźwiękowe. Nazwij też dźwięki w tle: przykład Kling zaczyna się od „cichego szumu klimatyzatora w salonie w tle”.[1]
Dźwięk jest generowany tylko wtedy, gdy o niego poprosisz: ustaw w żądaniu sound na true.
Jak zachować spójność postaci lub produktu?
Użyj elementu. W Kling 3.0 element to obiekt zbudowany z 2–4 obrazów referencyjnych; według Kling po powiązaniu obiekt pozostaje „wyraźny i stabilny, bez przesuwania się czy znikania” przy zoomach, panoramach i odchyleniach kamery.[1] W API trafia on do kling_elements z name, krótkim description i adresami URL obrazów, a prompt wspomina go z nazwy:
{
"prompt": "@hero walks out of the elevator, takes off her sunglasses and nods to a colleague, steady tracking shot",
"kling_elements": [
{
"name": "hero",
"description": "a professional woman in a camel coat with a black commuter bag",
"element_input_urls": ["https://example.com/hero-front.png", "https://example.com/hero-side.png"]
}
]
}Jako pierwszy obraz użyj widoku z przodu i dodaj widoki z boku lub z trzech czwartych; opis powinien nazywać to, co nie może się zmienić, na przykład ubranie albo logo na produkcie.
Jak kontrolować timing w 15-sekundowym klipie?
Oznaczaj kluczowe momenty czasem. Własny 15-sekundowy przykład Kling rozpisuje akcję według zegara: „W 4. sekundzie kamera przyspiesza do przodu razem z nią… W 8. sekundzie kamera stopniowo przybliża się do planu średniego… W 12. sekundzie muzyka i ruch osiągają kulminację… W ostatnich 3 sekundach…”[1] Jeśli chcesz jednego ciągłego ujęcia, napisz to wprost, jak w innym przykładzie Kling: „jedno nieprzerwane ujęcie bez montażowych przejść”.[1] Długość klipu to dowolna liczba całkowita od 3 do 15 sekund, więc dopasuj czas trwania do liczby rozpisanych momentów.
Czego lepiej nie pisać?
- Samych ogólnikowych słów o jakości. „Filmowo” czy „arcydzieło” bez ruchu kamery albo światła dają modelowi niewiele do działania.[2]
- Niechcianych napisów i znaków. Kling 3.0 dobrze renderuje napisy, w tym szyldy i logo, o które go poprosisz.[1] Jeśli nie chcesz żadnych, zakończ prompt słowami „bez tekstu, bez logo”, jak robimy we wszystkich naszych promptach testowych.
- Kilku cięć w jednym zdaniu. Jeśli scena potrzebuje konkretnych cięć, użyj trybu wieloujęciowego z jednym wpisem na ujęcie, zamiast łączyć w jednym prompcie „potem kamera przechodzi do…”.
Pytania o prompty do Kling 3.0
Jak długi może być prompt do Kling 3.0?
Do 2500 znaków w SeedRouter i do 500 znaków na ujęcie w żądaniu wieloujęciowym. Większość mocnych promptów ma od jednego do czterech zdań.
Czy Kling 3.0 obsługuje negatywny prompt?
Żądanie Kling 3.0 w SeedRouter nie ma osobnego pola na negatywny prompt. To, czego chcesz uniknąć, wpisz w sam prompt, na przykład „bez tekstu, bez logo”. Bieżące API Kling również włącza to do promptu: jego dokumentacja mówi, że „prompt może zawierać opisy pozytywne i negatywne”.[3]
Jakie prompty z ruchem kamery dobrze działają w Kling 3.0?
Powolny najazd, ujęcie z jazdy, panorama, odchylenie i odsłonięcie z żabiej perspektywy to ruchy, których używa własny poradnik Kling, zapisane prostymi zdaniami, takimi jak „kamera powoli najeżdża na obiekt”.[2]
Gdzie mogę przetestować prompt?
Playground Kling 3.0 wykonuje to samo żądanie, które przyjmuje API, a poradnik Kling 3.0 API pokazuje, jak wysłać je z kodu.
Źródła
- Kling AI. Kling VIDEO 3.0 Model User Guide. 6 lutego 2026 r. Dostęp 6 października 2026 r., kling.ai.
- Kling AI. Kling AI Prompt Guide: The Secret to Cinematic Video Prompts. 7 sierpnia 2026 r. Dostęp 6 października 2026 r., kling.ai.
- Kling AI. Kling 3.0: Text to Video (dokumentacja API). Dostęp 6 października 2026 r., kling.ai.



