Claude Opus 5.5 já está disponível no SeedRouter

Guia de prompts do Seedance 2.5: estrutura, câmera, tempo, áudio e referências

Como escrever prompts no Seedance 2.5: a fórmula base, linguagem de câmera, timestamps, sintaxe de diálogo e som, referências, edições e o que muda no 2.0.

Ler em Markdown

Um bom prompt do Seedance 2.5 diz quem faz o quê, onde, como a câmera filma e o que ouvimos, nessa ordem: primeiro o sujeito e a ação, depois a cena, o estilo visual, a câmera e o áudio. Divida clipes mais longos em intervalos de tempo como "0-3s" ou em planos numerados, chame cada arquivo de referência pelo número ("Image 1", "Video 1") e defina duração, proporção e resolução como parâmetros da requisição, não no texto. As regras abaixo vêm dos guias oficiais de prompts da ByteDance para o Seedance 2.5 e o 2.0, verificados em 29 de setembro de 2026. Todos os prompts de exemplo foram escritos para este post.

Como escrever um prompt para o Seedance 2.5?

Comece pela fórmula base da ByteDance: "Sujeito + Ação ou Evento + Cena e Ambiente (Opcional) + Estilo Visual (Opcional) + Movimento de Câmera/Corte (Opcional) + Áudio (Opcional)". Só a primeira parte é obrigatória. O guia chama o sujeito e a ação de "a base do vídeo" e permite que você deixe de fora as partes de que não precisa.

Na prática, isso vira quatro frases curtas:

<Subject> performs <main action or event> in <scene and environment>.
The visuals feature <visual style>.
Use <shot size, camera angle, camera movement, or cuts>.
Audio includes <dialogue, ambience, sound effects, or music>.

Uma versão preenchida:

A street baker pulls a tray of round loaves from a brick oven at night and sets it on a flour-dusted counter.
Warm orange light from the oven, visible steam, shallow depth of field, realistic film look.
Start with a close-up of the oven door opening, then pull back slowly to a medium shot of the counter.
Audio: crackling wood, the scrape of the metal tray, quiet street noise outside.

Três hábitos fazem diferença:

  • Descreva o que você quer, não o que você não quer. O guia oficial pede "descrições positivas sempre que possível" e aponta legendas e áudio como os lugares onde instruções negativas são suportadas (veja abaixo).
  • Deixe os parâmetros fora do prompt. Duração do clipe, proporção, resolução e a geração ou não de som são campos da requisição (duration, ratio, resolution, generate_audio); o guia diz que os parâmetros "não precisam ser incluídos no prompt".
  • Termine com o que precisa ficar constante, como o ângulo da câmera, o cenário e o clima, para que isso se mantenha no clipe inteiro.

Como controlar a câmera e os planos?

Escreva os termos de câmera diretamente. A ByteDance lista tamanhos de plano (plano geral extremo, plano geral, plano médio, plano médio fechado, close-up), movimentos (aproximar, afastar, pan, travelling, seguir, órbita, tilt para cima, câmera na mão tremida) e ângulos (contra-plongée, vista de cima, primeira pessoa), além de técnicas com nome, como plano-sequência/take longo, dolly zoom, FPV, bullet time e speed ramp.

Para qualquer coisa menos conhecida, acrescente uma explicação em linguagem simples depois do termo. O exemplo do próprio guia é "Rack focus: o foco muda suavemente; as árvores que antes estavam nítidas em primeiro plano ficam desfocadas, enquanto o personagem ao fundo fica nítido aos poucos."

Para um corte ou transição, informe o momento e o método, por exemplo "Na marca de 5 segundos, um whip pan rápido para a esquerda leva à próxima cena." O guia do Seedance 2.0 traz uma regra que ainda ajuda no 2.5: use um movimento de câmera por plano, porque pedir para "aproximar, afastar, fazer pan e mover ao mesmo tempo" deixa a imagem menos estável.

Uma cena com várias câmeras é só uma sequência de planos numerados, cada um com seu próprio enquadramento:

Shot 1: Wide shot, locked-off camera, eye level. Two chess players sit across a table in an empty library.
Shot 2: Over-the-shoulder shot from behind the older player. The younger player moves a knight and looks up.
Shot 3: Close-up of the older player's hand hovering over the board, then tapping the table once.
Quiet room tone, the soft click of chess pieces, no music.

O Seedance segue timestamps?

O Seedance 2.5 segue, em segundos inteiros. O Seedance 2.0 não. A comparação da ByteDance é direta: "O Seedance 2.0 não responde a timestamps e responde apenas a números de plano, enquanto o Seedance 2.5 suporta timestamps em segundos inteiros."

Três formas funcionam no 2.5:

  • Intervalos: "0-3s … 3-7s … 7-15s", sem lacunas entre eles.
  • Pontos: "At the 2-second mark, a gust of wind lifts the tablecloth." (Na marca de 2 segundos, uma rajada de vento levanta a toalha de mesa.)
  • Tempo relativo: "She waits by the door. After 3 seconds, the light in the hallway goes out." (Ela espera junto à porta. Depois de 3 segundos, a luz do corredor se apaga.)

Ajuste o conteúdo ao tempo que você dá a ele. Se acontece pouca coisa em um intervalo, o modelo improvisa; se acontece coisa demais, o guia avisa que o resultado "pode conter cortes excessivos ou omitir partes da trama". Não use timestamps para movimentos rápidos e repetidos, como balançar a cabeça três vezes por segundo.

Para um clipe de até o limite de 30 segundos do Seedance 2.5, escreva-o em etapas, cada uma com um estado final claro:

A lighthouse keeper's evening routine, realistic, cool blue dusk turning to night, no music.
0-6s: Wide shot of a lighthouse on a rocky coast at dusk. The keeper climbs the outside stairs with a lantern.
6-14s: Inside the lamp room, medium shot. He wipes the large lens with a cloth, then checks a brass gauge.
14-22s: Close-up of his hand turning a wheel. The main lamp starts to rotate and throws a beam across the room.
22-30s: Aerial shot pulling back from the tower. The beam sweeps over dark water. Waves and wind only.

Como escrever diálogo, som e legendas?

O Seedance 2.5 gera áudio junto com o vídeo por padrão (generate_audio é true). Tudo pode ser descrito em frases comuns, mas o guia oficial define colchetes e parênteses para quando você precisa separar os tipos de som:

ConteúdoSintaxeExemplo
Música( )(soft piano plays in the background)
Efeito sonoro< ><a bell rings in the distance>
Diálogo{ }{Welcome back.}
Legendas【 】【Chapter One】

Para um diálogo em um idioma ou sotaque específico, nomeie-o antes da fala. A fórmula do guia é Dialogue Language + Regional Variety or Accent + Delivery Style + Speaker + {Dialogue}, por exemplo: Dialogue language: American English. The girl says in natural, conversational American English: {I thought you weren't coming.} A ByteDance diz que o Seedance 2.5 gera fala nativamente em mais de 10 idiomas; o guia não os lista, então teste o seu. Não misture idiomas dentro de uma mesma fala, algo contra o qual o guia do 2.0 alerta, exceto em nomes próprios.

Quando vários personagens falam, escreva a entonação uma vez por fala, no formato "Fala do personagem (emoção): conteúdo". O guia constatou que repetir palavras depois de uma fala, ou anexar notas separadas de tom e ação a palavras individuais, é uma das coisas que fazem o modelo adicionar legendas.

Instruções negativas funcionam aqui: "No subtitles", "No BGM; only ambient and action sounds" ou "No audio." (sem legendas; sem música de fundo, só sons ambientes e de ação; sem áudio). As legendas ainda podem escapar, com menos frequência do que no 2.0 segundo a ByteDance, e um vídeo de referência que tenha legendas pode se sobrepor a "no subtitles". Para dar a um personagem uma voz ou música já existente, anexe-a como referência de áudio e vincule-a a esse personagem, como no exemplo do guia: "A Image 1 retrata o protagonista John e usa o timbre de voz do Audio 1."

Como referenciar imagens, vídeos e áudio em um prompt?

Numere cada arquivo pela ordem em que você o anexa e vincule-o no texto. Os exemplos da ByteDance são assim: "As Images 1-2 são o Personagem 1 e correspondem ao Audio 1; as Images 3-4 são o Personagem 2 e correspondem ao Audio 2." Não conte com um nome escrito dentro da imagem; o guia diz que rotular uma imagem como "John" e depois escrever "John está na escola" "pode facilmente causar confusão ou duplicação de personagens".

Diga para que serve cada arquivo e o que deve ser ignorado:

Image 1 defines the courier's face, hairstyle and yellow raincoat. Do not use the image background.
Image 2 defines the narrow alley, wet cobblestones and neon reflections. Do not use any people in it.
Video 1 defines the running pace and the handheld follow camera only.
The courier from Image 1 runs through the alley from Image 2 at night, jumps a puddle, and stops at a green door.

Se um vídeo de referência já mostra o movimento exato, diga "follow the actions and camera movement in Video 1" (siga as ações e o movimento de câmera do Video 1) em vez de descrever cada passo de novo; repetir a descrição pode entrar em conflito com o vídeo. Quando várias imagens mostram um mesmo objeto de ângulos diferentes, diga isso ("All four images show the same desk lamp; only one lamp appears"), senão o modelo pode tratá-las como objetos separados.

Quantos usar: o Seedance 2.5 aceita até 30 imagens, 10 vídeos e 10 clipes de áudio (vídeos e áudio com no máximo 30 segundos no total, cada tipo). A ByteDance recomenda de 1 a 8 sujeitos nas imagens de sujeito e de 1 a 5 sujeitos, com 5 a 10 segundos cada, nas referências de vídeo ou áudio; mais é permitido, mas menos estável. O Seedance 2.0 aceita até 9 imagens, 3 vídeos e 3 clipes de áudio, e o guia dele recomenda de 4 a 5 arquivos no total. Para o formato da requisição de cada tipo de referência, veja como adicionar imagens, vídeos e áudio. Imagens e vídeos de referência com rostos de pessoas reais são recusados; este post explica o erro e o que é permitido.

Como escrever o prompt para editar ou estender um vídeo?

Na SeedRouter, editar e estender são recursos do Seedance 2.5: envie um vídeo de referência e defina omni_reference_task_type como edit ou extend. O prompt então precisa fazer duas coisas.

Para edições, nomeie o escopo e descreva a mudança de A para B. Inclua uma palavra de ação como adicionar, remover, substituir ou mudar para, e use um intervalo de tempo para edições parciais. O exemplo do guia: "Mude a ação do homem de beber café para passar pano no chão entre 4 e 6 segundos no Video 1, e deixe o resto do conteúdo inalterado." Uma troca de objeto segue o mesmo padrão:

Edit Video 1: replace the paper coffee cup on the desk with the green ceramic mug from Image 1. Keep the person, the camera and the audio unchanged.

Para extensões, diga a direção e comece pelo quadro da borda. Use "extend forward", "extend backward" ou "continue" e depois descreva o que acontece em seguida:

Continue Video 1: the cyclist reaches the top of the hill, stops, and takes off her helmet. The camera stays on the same side angle. Wind and distant birds.

Uma edição ou extensão mantém a proporção do vídeo de origem, então deixe ratio como adaptive; uma edição também mantém a duração, então duration precisa ser -1. A ByteDance recomenda MOV tanto na entrada quanto na saída (output_format: "mov") para a melhor continuidade de cor e áudio. Se uma requisição que combina referências e edições der resultados instáveis, a solução do guia é dividi-la em uma tarefa de referência e depois uma tarefa de edição. Os corpos exatos das requisições estão em como editar ou estender um clipe.

Como usar storyboards e keyframes?

Eles têm funções diferentes. Um storyboard com vários painéis, vários quadros em uma única imagem, é uma referência solta de enredo: o modelo "não se alinha estritamente" a ele. Keyframes, imagens separadas anexadas em ordem, são seguidos de perto.

  • Storyboard: use traço simples ou bonecos de palito sem texto, com 15 painéis ou menos. Aponte primeiro a imagem do storyboard, escreva um resumo da história em uma linha e depois descreva cada plano para completar o que o desenho não mostra (ação, câmera, estilo).
  • Keyframes: anexe cada quadro como uma imagem de referência própria e abra o prompt com "Use Images 1 to 6 in order as keyframes."
  • Primeiro e último quadro: defina os papéis das imagens como first_frame e last_frame. Isso trava a saída na proporção da primeira imagem, então use duas imagens com a mesma proporção. Defini-las como reference_image e escrever "Image 1 is the first frame" não trava a proporção, mas a saída pode não corresponder exatamente às imagens.

O que muda nos prompts do Seedance 2.0?

A estrutura é a mesma (sujeito, ação, cena, câmera, estilo, áudio), mas o guia do 2.0 pede algumas coisas de que o 2.5 não precisa mais:

  • Planos, não segundos. Organize o clipe como "Shot 1 / Shot 2 / Shot 3" e deixe o modelo definir o ritmo; o guia do 2.0 chama o tempo preciso de "instável".
  • Movimento suave e contínuo. Ele prefere "movimentos sutis lentos, suaves e coerentes" a corridas, grandes saltos e rolamentos violentos, e pede que você descreva como uma ação flui para a seguinte.
  • Emoções mostradas como ações. Em vez de "muito triste", escreva "abaixa a cabeça, ombros tremendo levemente, olhos ficando vermelhos".
  • Um close do rosto e uma imagem de corpo inteiro por personagem, não uma folha com vários ângulos, que o 2.0 pode interpretar como várias pessoas. O Seedance 2.5 aceita imagens com várias vistas.
  • Refira-se a um sujeito sempre da mesma forma, por exemplo "the woman in the red coat@Image 1", ou defina um nome uma vez e reutilize-o.

Os clipes do Seedance 2.0 duram de 4 a 15 segundos (5 por padrão), e ele tem as versões Fast e Mini, que aceitam a mesma requisição, apenas em 480p ou 720p. O guia Seedance 2.5 vs 2.0 e o guia Seedance 2.0 vs Fast vs Mini explicam qual modelo escolher. A ByteDance também avisa que as duas versões têm "preferências de estilo estético significativamente diferentes", então o mesmo prompt não vai dar o mesmo visual.

Por que o Seedance não segue meu prompt?

A maioria das falhas vem de um punhado de causas citadas no FAQ oficial:

  • Muita coisa em pouco tempo. Distribua os eventos ou aumente a duration.
  • Contradições. Duas descrições diferentes do mesmo personagem, ou um movimento de câmera que briga com a ação.
  • Personagens trocados entre referências. Anexe os arquivos de referência na ordem em que os personagens aparecem pela primeira vez e renumere o prompt de acordo.
  • Olhos brilhando. Palavras fortes como "fanatical" ou "extremely shocked" podem fazer as pupilas brilharem. Use palavras mais calmas e acrescente "normal human eyes; no glowing eyes".
  • Texto na tela com erro de grafia. Soletre a palavra letra por letra ou forneça o texto exato como imagem de referência.
  • Uma requisição fazendo coisa demais. Separe referências e edições em tarefas distintas.
  • Um rosto bloqueado. Rostos de pessoas reais em referências são recusados; veja o erro de pessoa real.

Faça rascunhos em 480p com uma duration curta e depois renderize a versão que você vai manter em uma resolução mais alta. Tarefas que falham não são cobradas; para saber quanto custa um clipe pronto, veja o preço da API Seedance.

Perguntas frequentes

Devo escrever prompts do Seedance em JSON?

Nenhum formato é obrigatório. O guia da ByteDance diz que os prompts "podem ser escritos inteiramente em linguagem natural", e todos os modelos dele são frases comuns com rótulos opcionais como "Shot 1" ou "0-3s". Estrutura ajuda; sintaxe JSON não é necessária.

Como fazer uma cena de luta no Seedance 2.5?

Descreva a luta em termos gerais e guarde os detalhes para um ou dois golpes principais; o guia recomenda frases como "os dois lados se enfrentando em combate corpo a corpo" em vez de listar cada soco. Coloque os momentos em uma linha do tempo, mantenha um movimento de câmera por plano e descreva o som com efeitos < >.

Qual a duração máxima de um vídeo no Seedance 2.5?

Até 30 segundos por requisição, definidos com duration (4-30, ou -1 para deixar o modelo escolher). O Seedance 2.0 vai até 15 segundos.

Existe um otimizador de prompts oficial do Seedance?

Sim. A ByteDance publica uma skill de prompts do Seedance 2.5, sd25-pe, que assistentes de código podem usar para reescrever o seu prompt antes de você enviá-lo. O comando de instalação está no guia oficial.

Posso usar uma foto minha como referência?

Não. O Seedance recusa imagens e vídeos de referência que contenham rostos humanos reais. O guia do erro de pessoa real mostra o que a ByteDance permite no lugar.

Teste seu prompt

Cole um prompt no playground do Seedance 2.5 ou no playground do Seedance 2.0, ou envie-o pelo código com a referência da API do Seedance 2.5. Você recarrega uma vez, sem assinatura, os créditos nunca expiram, e uma tarefa que falha não custa nada.

Guias relacionados