Claude Opus 5.5 が SeedRouter で利用できます
LogoSeedRouter

モデル名で検索(例:nano banana)

モデル名で検索(例:nano banana)

Kling 3.0 プロンプトガイド:カメラワーク、マルチショットのシーン、セリフ、一貫したキャラクター

Kling 3.0 のプロンプトの書き方。良い動画プロンプトの 5 つの要素、効くカメラ用語、マルチショットのシーン、音声付きのセリフ、キャラクターを一貫させる方法を解説。

Markdown で読む

良い Kling 3.0 のプロンプトは、5 つのことを平易な言葉で伝えます。被写体、その被写体が目に見えてすること、どこにいるか、カメラがどうフレーミングし動くか、そして光と雰囲気です。 Kling 自身のプロンプトガイドも同じことを述べており、強いプロンプトは「被写体、動作、設定、カメラ言語、照明、雰囲気といった、明快な人間の文章から始まる」としています。[2] このガイドのほかの内容、つまりマルチショットのシーン、セリフ、一貫したキャラクターは、すべてこの構造の上に成り立っています。

Kling 3.0 のプロンプトには何を入れる?

Kling のプロンプトガイドは、明快なプロンプトを構成する要素と、それぞれの役割を挙げています:[2]

要素決めること例
被写体主要なキャラクター、商品、場所ストライプのシャツを着た女性、ベルベットの台座に置かれた香水瓶
動作目に見える動きカメラに向かって歩いてくる、グラスの中でジュースを回す
シーン場所と周囲のディテール屋外のテラス、マドリードの古い通り
カメラフレーミング、アングル、動きクローズアップ、ローアングル、ゆっくりとしたプッシュイン、トラッキングショット
光と雰囲気空気感ゴールデンアワー、冷たく青い夜、柔らかなもや

被写体は具体的に書きましょう。同じガイドは、「魔法」のようなあいまいな言葉を「幻想的な光を放つ、渦巻く青いエネルギーの粒子」に置き換えることを勧めており、そうすればモデルが描くものを持てるからです。[2] 感情や意図ではなく、上に漂う煙や前傾するランナーのように、見る人に見える動きを書いてください。

私たちのテストで使ったプロンプトで、5 つの要素がすべて 1 文に入っています:

夜、小雨が降るなか、石のアーチの下でストリートのバイオリニストが演奏している。広場の向こうからゆっくりとプッシュイン、濡れた石畳に暖かなランプの光、バイオリンの旋律が静かな雨音とともに響く。文字なし、ロゴなし。

Kling 3.0、1080p、5 秒、音声あり。

Kling 3.0 はどんなカメラ指示に従う?

監督のようにカメラを指定してください。Kling のガイドは、平易なフレーミングと動きの用語を勧めており、次のような使い方を示しています:[2]

指示書き方向いている用途
クローズアップ話し手の顔のクローズアップセリフ、感情、商品のディテール
ワイドショットテラスと 2 人のキャラクターが映るワイドショット舞台とスケール感
プッシュインカメラがゆっくりと被写体に寄っていく強調、緊張感、見せ場
パンまたはティルトカメラが部屋を横切るようにパンする、または看板までティルトアップする空間や高さを見せる
トラッキングショットカメラがランナーの横についていくアクションと連続性

必要ならペースも加えます。落ち着きや緊張感には「ゆっくり」、動きを見やすくするには「安定した」、勢いを出すには「素早い」です。[2] 超クローズアップ、ミディアムクローズアップ、全身、エスタブリッシングショットといったフレーミング用語は、見る人が被写体からどれだけ離れているかをモデルに伝えます。[2]

マルチショットのシーンはどう書く?

Kling 3.0 は 1 本のクリップを複数のショットに分けられます。Kling は 2 つの方法を説明しています。1 つのプロンプトからモデルにカット割りを任せる方法と、各ショットとその長さを自分で定義する方法です。後者を Kling はカスタムマルチショット(Custom Multi-Shot)と呼び、モデルが「厳密に従う」としています。[1] Kling 自身の例では、各ショットをフレーミングと動作の 1 行で書いています:「ショット 1、ローアングルの後方ワイドショット、ライダーの後ろを追う……ショット 2、ローアングルの側面クローズアップ、バイクの車輪のディテールショット……」[1]

API でのカスタム版は multi_shots: true と multi_prompt のリストで、ショットごとに 1 項目、それぞれに独自のプロンプトと長さを指定します。私たちのテストでは 3 秒のショットを 2 つ指定しました:

{
  "model": "kling-3-0",
  "mode": "pro",
  "sound": true,
  "multi_shots": true,
  "multi_prompt": [
    {"prompt": "Wide shot of a small open kitchen, a chef tosses vegetables in a wok, flames rising, warm light. No text, no logos.", "duration": 3},
    {"prompt": "Close-up of the wok, vegetables flipping through the flames, oil sizzling, steam drifting. No text, no logos.", "duration": 3}
  ]
}

Kling 3.0、1080p、3 秒のショット 2 つ、音声あり。

ショットごとに独自のフレーミングを書き、被写体は各ショットで同じように記述してください。そうすれば同じ人物や物として読み取られます。ショットの長さの合計は 3〜15 秒でなければなりません。

セリフと音声のプロンプトはどう書く?

セリフをプロンプトに書き、それを話すキャラクターに結びつけます。Kling のガイドは「キャラクター(口調):セリフ」という形を示しており、たとえば「母(小声で、驚いた口調で):わあ、こんな展開になるなんて思わなかった」のように書きます。画面に 3 人以上のキャラクターがいても、Kling 3.0 は各セリフを正しい話し手に合わせるとしています。[1]

  • 言語。 セリフは中国語、英語、日本語、韓国語、スペイン語に対応しており、1 本のクリップの中でキャラクターが言語を切り替えることもできます。Kling によると、それ以外の言語のセリフは英語に翻訳されます。[1]
  • アクセントと方言。 セリフの横に付けます。たとえば「インド訛りの英語で話す」です。Kling はアメリカ、イギリス、インドの英語のアクセントと、広東語や四川語を含むいくつかの中国語の方言を挙げています。[1]
  • 環境音。 背景の音も書きましょう。Kling の例は「背景でリビングのエアコンがかすかにうなっている」で始まります。[1]

音声は指定したときだけ生成されます。リクエストで sound を true にしてください。

キャラクターや商品を一貫させるには?

エレメントを使います。Kling 3.0 のエレメントは 2〜4 枚の参照画像から作られる被写体で、一度結びつけると、ズーム、パン、ティルトの間も被写体は「ずれたり消えたりせず、鮮明で安定している」と Kling は説明しています。[1] API では name、短い description、画像 URL とともに kling_elements に入れ、プロンプトでは名前で言及します:

{
  "prompt": "@hero walks out of the elevator, takes off her sunglasses and nods to a colleague, steady tracking shot",
  "kling_elements": [
    {
      "name": "hero",
      "description": "a professional woman in a camel coat with a black commuter bag",
      "element_input_urls": ["https://example.com/hero-front.png", "https://example.com/hero-side.png"]
    }
  ]
}

1 枚目には正面からの画像を使い、横向きや斜め 45 度の画像を加えてください。説明には、服装や商品のロゴなど、変わってはいけないものを書きます。

15 秒のクリップでタイミングをどう制御する?

ビートを時刻で示します。Kling 自身の 15 秒の例は、時計に合わせて動作を進めています:「4 秒目、カメラが彼女とともに前へ加速する……8 秒目、カメラが徐々にミディアムショットまで寄る……12 秒目、音楽と動きがクライマックスに達する……最後の 3 秒……」[1] 1 つの連続したショットにしたい場合は、Kling の別の例のようにはっきり書きます:「編集によるトランジションのない、途切れないワンショット」。[1] クリップの長さは 3〜15 秒の任意の整数なので、書いたビートの数に長さを合わせてください。

何を書かないほうがいい?

  • それだけの漠然とした品質の言葉。 カメラの動きや光なしに「シネマティック」や「傑作」と書いても、モデルが手がかりにできることはほとんどありません。[2]
  • 不要な文字やマーク。 Kling 3.0 は文字をうまく描画し、頼まれた看板やロゴも描きます。[1] まったく要らない場合は、私たちのテストプロンプトすべてと同じように、プロンプトの最後に「no text, no logos」と付けてください。
  • 1 文に複数のカット。 シーンに特定のカットが必要なら、1 つのプロンプトで「そしてカメラは…にカット」とつなげるのではなく、ショットごとに 1 項目のマルチショットを使ってください。

Kling 3.0 のプロンプトに関するよくある質問

Kling 3.0 のプロンプトはどれくらいの長さまで書ける?

SeedRouter では最大 2,500 文字、マルチショットのリクエストではショットごとに最大 500 文字です。強いプロンプトの多くは 1〜4 文です。

Kling 3.0 はネガティブプロンプトに対応している?

SeedRouter の Kling 3.0 のリクエストには、独立したネガティブプロンプトのフィールドはありません。避けたいことはプロンプト自体に書いてください。たとえば「no text, no logos」です。Kling の現行 API もこれをプロンプトに含める方式で、ドキュメントには「プロンプトにはポジティブな記述とネガティブな記述の両方を含められる」とあります。[3]

Kling 3.0 に効くカメラワークのプロンプトは?

ゆっくりとしたプッシュイン、トラッキングショット、パン、ティルト、ローアングルからの見せ方が、Kling 自身のガイドで使われているカメラワークです。「カメラがゆっくりと被写体に寄っていく」のような平易な文で書きます。[2]

プロンプトはどこで試せる?

Kling 3.0 の Playground は API と同じリクエストを実行し、Kling 3.0 API ガイドではコードから送る方法を紹介しています。

参考文献

  1. Kling AI. Kling VIDEO 3.0 Model User Guide。2026 年 2 月 6 日。2026 年 10 月 6 日に kling.ai から取得。
  2. Kling AI. Kling AI Prompt Guide: The Secret to Cinematic Video Prompts。2026 年 8 月 7 日。2026 年 10 月 6 日に kling.ai から取得。
  3. Kling AI. Kling 3.0: Text to Video(API リファレンス)。2026 年 10 月 6 日に kling.ai から取得。

関連ガイド