Guia de prompts do Seedance 2.5: estrutura, câmera, tempo, áudio e referências
Como escrever prompts no Seedance 2.5: a fórmula base, linguagem de câmera, timestamps, sintaxe de diálogo e som, referências, edições e o que muda no 2.0.
Ler em MarkdownUm bom prompt do Seedance 2.5 diz quem faz o quê, onde, como a câmera filma e o que ouvimos, nessa ordem: primeiro o sujeito e a ação, depois a cena, o estilo visual, a câmera e o áudio. Divida clipes mais longos em intervalos de tempo como "0-3s" ou em planos numerados, chame cada arquivo de referência pelo número ("Image 1", "Video 1") e defina duração, proporção e resolução como parâmetros da requisição, não no texto. As regras abaixo vêm dos guias oficiais de prompts da ByteDance para o Seedance 2.5 e o 2.0, verificados em 29 de setembro de 2026. Todos os prompts de exemplo foram escritos para este post.
Como escrever um prompt para o Seedance 2.5?
Comece pela fórmula base da ByteDance: "Sujeito + Ação ou Evento + Cena e Ambiente (Opcional) + Estilo Visual (Opcional) + Movimento de Câmera/Corte (Opcional) + Áudio (Opcional)". Só a primeira parte é obrigatória. O guia chama o sujeito e a ação de "a base do vídeo" e permite que você deixe de fora as partes de que não precisa.
Na prática, isso vira quatro frases curtas:
<Subject> performs <main action or event> in <scene and environment>.
The visuals feature <visual style>.
Use <shot size, camera angle, camera movement, or cuts>.
Audio includes <dialogue, ambience, sound effects, or music>.Uma versão preenchida:
A street baker pulls a tray of round loaves from a brick oven at night and sets it on a flour-dusted counter.
Warm orange light from the oven, visible steam, shallow depth of field, realistic film look.
Start with a close-up of the oven door opening, then pull back slowly to a medium shot of the counter.
Audio: crackling wood, the scrape of the metal tray, quiet street noise outside.Três hábitos fazem diferença:
- Descreva o que você quer, não o que você não quer. O guia oficial pede "descrições positivas sempre que possível" e aponta legendas e áudio como os lugares onde instruções negativas são suportadas (veja abaixo).
- Deixe os parâmetros fora do prompt. Duração do clipe, proporção, resolução e a geração ou não de som são campos da requisição (
duration,ratio,resolution,generate_audio); o guia diz que os parâmetros "não precisam ser incluídos no prompt". - Termine com o que precisa ficar constante, como o ângulo da câmera, o cenário e o clima, para que isso se mantenha no clipe inteiro.
Como controlar a câmera e os planos?
Escreva os termos de câmera diretamente. A ByteDance lista tamanhos de plano (plano geral extremo, plano geral, plano médio, plano médio fechado, close-up), movimentos (aproximar, afastar, pan, travelling, seguir, órbita, tilt para cima, câmera na mão tremida) e ângulos (contra-plongée, vista de cima, primeira pessoa), além de técnicas com nome, como plano-sequência/take longo, dolly zoom, FPV, bullet time e speed ramp.
Para qualquer coisa menos conhecida, acrescente uma explicação em linguagem simples depois do termo. O exemplo do próprio guia é "Rack focus: o foco muda suavemente; as árvores que antes estavam nítidas em primeiro plano ficam desfocadas, enquanto o personagem ao fundo fica nítido aos poucos."
Para um corte ou transição, informe o momento e o método, por exemplo "Na marca de 5 segundos, um whip pan rápido para a esquerda leva à próxima cena." O guia do Seedance 2.0 traz uma regra que ainda ajuda no 2.5: use um movimento de câmera por plano, porque pedir para "aproximar, afastar, fazer pan e mover ao mesmo tempo" deixa a imagem menos estável.
Uma cena com várias câmeras é só uma sequência de planos numerados, cada um com seu próprio enquadramento:
Shot 1: Wide shot, locked-off camera, eye level. Two chess players sit across a table in an empty library.
Shot 2: Over-the-shoulder shot from behind the older player. The younger player moves a knight and looks up.
Shot 3: Close-up of the older player's hand hovering over the board, then tapping the table once.
Quiet room tone, the soft click of chess pieces, no music.O Seedance segue timestamps?
O Seedance 2.5 segue, em segundos inteiros. O Seedance 2.0 não. A comparação da ByteDance é direta: "O Seedance 2.0 não responde a timestamps e responde apenas a números de plano, enquanto o Seedance 2.5 suporta timestamps em segundos inteiros."
Três formas funcionam no 2.5:
- Intervalos: "0-3s … 3-7s … 7-15s", sem lacunas entre eles.
- Pontos: "At the 2-second mark, a gust of wind lifts the tablecloth." (Na marca de 2 segundos, uma rajada de vento levanta a toalha de mesa.)
- Tempo relativo: "She waits by the door. After 3 seconds, the light in the hallway goes out." (Ela espera junto à porta. Depois de 3 segundos, a luz do corredor se apaga.)
Ajuste o conteúdo ao tempo que você dá a ele. Se acontece pouca coisa em um intervalo, o modelo improvisa; se acontece coisa demais, o guia avisa que o resultado "pode conter cortes excessivos ou omitir partes da trama". Não use timestamps para movimentos rápidos e repetidos, como balançar a cabeça três vezes por segundo.
Para um clipe de até o limite de 30 segundos do Seedance 2.5, escreva-o em etapas, cada uma com um estado final claro:
A lighthouse keeper's evening routine, realistic, cool blue dusk turning to night, no music.
0-6s: Wide shot of a lighthouse on a rocky coast at dusk. The keeper climbs the outside stairs with a lantern.
6-14s: Inside the lamp room, medium shot. He wipes the large lens with a cloth, then checks a brass gauge.
14-22s: Close-up of his hand turning a wheel. The main lamp starts to rotate and throws a beam across the room.
22-30s: Aerial shot pulling back from the tower. The beam sweeps over dark water. Waves and wind only.Como escrever diálogo, som e legendas?
O Seedance 2.5 gera áudio junto com o vídeo por padrão (generate_audio é true). Tudo pode ser descrito em frases comuns, mas o guia oficial define colchetes e parênteses para quando você precisa separar os tipos de som:
| Conteúdo | Sintaxe | Exemplo |
|---|---|---|
| Música | ( ) | (soft piano plays in the background) |
| Efeito sonoro | < > | <a bell rings in the distance> |
| Diálogo | { } | {Welcome back.} |
| Legendas | 【 】 | 【Chapter One】 |
Para um diálogo em um idioma ou sotaque específico, nomeie-o antes da fala. A fórmula do guia é Dialogue Language + Regional Variety or Accent + Delivery Style + Speaker + {Dialogue}, por exemplo: Dialogue language: American English. The girl says in natural, conversational American English: {I thought you weren't coming.} A ByteDance diz que o Seedance 2.5 gera fala nativamente em mais de 10 idiomas; o guia não os lista, então teste o seu. Não misture idiomas dentro de uma mesma fala, algo contra o qual o guia do 2.0 alerta, exceto em nomes próprios.
Quando vários personagens falam, escreva a entonação uma vez por fala, no formato "Fala do personagem (emoção): conteúdo". O guia constatou que repetir palavras depois de uma fala, ou anexar notas separadas de tom e ação a palavras individuais, é uma das coisas que fazem o modelo adicionar legendas.
Instruções negativas funcionam aqui: "No subtitles", "No BGM; only ambient and action sounds" ou "No audio." (sem legendas; sem música de fundo, só sons ambientes e de ação; sem áudio). As legendas ainda podem escapar, com menos frequência do que no 2.0 segundo a ByteDance, e um vídeo de referência que tenha legendas pode se sobrepor a "no subtitles". Para dar a um personagem uma voz ou música já existente, anexe-a como referência de áudio e vincule-a a esse personagem, como no exemplo do guia: "A Image 1 retrata o protagonista John e usa o timbre de voz do Audio 1."
Como referenciar imagens, vídeos e áudio em um prompt?
Numere cada arquivo pela ordem em que você o anexa e vincule-o no texto. Os exemplos da ByteDance são assim: "As Images 1-2 são o Personagem 1 e correspondem ao Audio 1; as Images 3-4 são o Personagem 2 e correspondem ao Audio 2." Não conte com um nome escrito dentro da imagem; o guia diz que rotular uma imagem como "John" e depois escrever "John está na escola" "pode facilmente causar confusão ou duplicação de personagens".
Diga para que serve cada arquivo e o que deve ser ignorado:
Image 1 defines the courier's face, hairstyle and yellow raincoat. Do not use the image background.
Image 2 defines the narrow alley, wet cobblestones and neon reflections. Do not use any people in it.
Video 1 defines the running pace and the handheld follow camera only.
The courier from Image 1 runs through the alley from Image 2 at night, jumps a puddle, and stops at a green door.Se um vídeo de referência já mostra o movimento exato, diga "follow the actions and camera movement in Video 1" (siga as ações e o movimento de câmera do Video 1) em vez de descrever cada passo de novo; repetir a descrição pode entrar em conflito com o vídeo. Quando várias imagens mostram um mesmo objeto de ângulos diferentes, diga isso ("All four images show the same desk lamp; only one lamp appears"), senão o modelo pode tratá-las como objetos separados.
Quantos usar: o Seedance 2.5 aceita até 30 imagens, 10 vídeos e 10 clipes de áudio (vídeos e áudio com no máximo 30 segundos no total, cada tipo). A ByteDance recomenda de 1 a 8 sujeitos nas imagens de sujeito e de 1 a 5 sujeitos, com 5 a 10 segundos cada, nas referências de vídeo ou áudio; mais é permitido, mas menos estável. O Seedance 2.0 aceita até 9 imagens, 3 vídeos e 3 clipes de áudio, e o guia dele recomenda de 4 a 5 arquivos no total. Para o formato da requisição de cada tipo de referência, veja como adicionar imagens, vídeos e áudio. Imagens e vídeos de referência com rostos de pessoas reais são recusados; este post explica o erro e o que é permitido.
Como escrever o prompt para editar ou estender um vídeo?
Na SeedRouter, editar e estender são recursos do Seedance 2.5: envie um vídeo de referência e defina omni_reference_task_type como edit ou extend. O prompt então precisa fazer duas coisas.
Para edições, nomeie o escopo e descreva a mudança de A para B. Inclua uma palavra de ação como adicionar, remover, substituir ou mudar para, e use um intervalo de tempo para edições parciais. O exemplo do guia: "Mude a ação do homem de beber café para passar pano no chão entre 4 e 6 segundos no Video 1, e deixe o resto do conteúdo inalterado." Uma troca de objeto segue o mesmo padrão:
Edit Video 1: replace the paper coffee cup on the desk with the green ceramic mug from Image 1. Keep the person, the camera and the audio unchanged.Para extensões, diga a direção e comece pelo quadro da borda. Use "extend forward", "extend backward" ou "continue" e depois descreva o que acontece em seguida:
Continue Video 1: the cyclist reaches the top of the hill, stops, and takes off her helmet. The camera stays on the same side angle. Wind and distant birds.Uma edição ou extensão mantém a proporção do vídeo de origem, então deixe ratio como adaptive; uma edição também mantém a duração, então duration precisa ser -1. A ByteDance recomenda MOV tanto na entrada quanto na saída (output_format: "mov") para a melhor continuidade de cor e áudio. Se uma requisição que combina referências e edições der resultados instáveis, a solução do guia é dividi-la em uma tarefa de referência e depois uma tarefa de edição. Os corpos exatos das requisições estão em como editar ou estender um clipe.
Como usar storyboards e keyframes?
Eles têm funções diferentes. Um storyboard com vários painéis, vários quadros em uma única imagem, é uma referência solta de enredo: o modelo "não se alinha estritamente" a ele. Keyframes, imagens separadas anexadas em ordem, são seguidos de perto.
- Storyboard: use traço simples ou bonecos de palito sem texto, com 15 painéis ou menos. Aponte primeiro a imagem do storyboard, escreva um resumo da história em uma linha e depois descreva cada plano para completar o que o desenho não mostra (ação, câmera, estilo).
- Keyframes: anexe cada quadro como uma imagem de referência própria e abra o prompt com "Use Images 1 to 6 in order as keyframes."
- Primeiro e último quadro: defina os papéis das imagens como
first_frameelast_frame. Isso trava a saída na proporção da primeira imagem, então use duas imagens com a mesma proporção. Defini-las comoreference_imagee escrever "Image 1 is the first frame" não trava a proporção, mas a saída pode não corresponder exatamente às imagens.
O que muda nos prompts do Seedance 2.0?
A estrutura é a mesma (sujeito, ação, cena, câmera, estilo, áudio), mas o guia do 2.0 pede algumas coisas de que o 2.5 não precisa mais:
- Planos, não segundos. Organize o clipe como "Shot 1 / Shot 2 / Shot 3" e deixe o modelo definir o ritmo; o guia do 2.0 chama o tempo preciso de "instável".
- Movimento suave e contínuo. Ele prefere "movimentos sutis lentos, suaves e coerentes" a corridas, grandes saltos e rolamentos violentos, e pede que você descreva como uma ação flui para a seguinte.
- Emoções mostradas como ações. Em vez de "muito triste", escreva "abaixa a cabeça, ombros tremendo levemente, olhos ficando vermelhos".
- Um close do rosto e uma imagem de corpo inteiro por personagem, não uma folha com vários ângulos, que o 2.0 pode interpretar como várias pessoas. O Seedance 2.5 aceita imagens com várias vistas.
- Refira-se a um sujeito sempre da mesma forma, por exemplo "the woman in the red coat@Image 1", ou defina um nome uma vez e reutilize-o.
Os clipes do Seedance 2.0 duram de 4 a 15 segundos (5 por padrão), e ele tem as versões Fast e Mini, que aceitam a mesma requisição, apenas em 480p ou 720p. O guia Seedance 2.5 vs 2.0 e o guia Seedance 2.0 vs Fast vs Mini explicam qual modelo escolher. A ByteDance também avisa que as duas versões têm "preferências de estilo estético significativamente diferentes", então o mesmo prompt não vai dar o mesmo visual.
Por que o Seedance não segue meu prompt?
A maioria das falhas vem de um punhado de causas citadas no FAQ oficial:
- Muita coisa em pouco tempo. Distribua os eventos ou aumente a
duration. - Contradições. Duas descrições diferentes do mesmo personagem, ou um movimento de câmera que briga com a ação.
- Personagens trocados entre referências. Anexe os arquivos de referência na ordem em que os personagens aparecem pela primeira vez e renumere o prompt de acordo.
- Olhos brilhando. Palavras fortes como "fanatical" ou "extremely shocked" podem fazer as pupilas brilharem. Use palavras mais calmas e acrescente "normal human eyes; no glowing eyes".
- Texto na tela com erro de grafia. Soletre a palavra letra por letra ou forneça o texto exato como imagem de referência.
- Uma requisição fazendo coisa demais. Separe referências e edições em tarefas distintas.
- Um rosto bloqueado. Rostos de pessoas reais em referências são recusados; veja o erro de pessoa real.
Faça rascunhos em 480p com uma duration curta e depois renderize a versão que você vai manter em uma resolução mais alta. Tarefas que falham não são cobradas; para saber quanto custa um clipe pronto, veja o preço da API Seedance.
Perguntas frequentes
Devo escrever prompts do Seedance em JSON?
Nenhum formato é obrigatório. O guia da ByteDance diz que os prompts "podem ser escritos inteiramente em linguagem natural", e todos os modelos dele são frases comuns com rótulos opcionais como "Shot 1" ou "0-3s". Estrutura ajuda; sintaxe JSON não é necessária.
Como fazer uma cena de luta no Seedance 2.5?
Descreva a luta em termos gerais e guarde os detalhes para um ou dois golpes principais; o guia recomenda frases como "os dois lados se enfrentando em combate corpo a corpo" em vez de listar cada soco. Coloque os momentos em uma linha do tempo, mantenha um movimento de câmera por plano e descreva o som com efeitos < >.
Qual a duração máxima de um vídeo no Seedance 2.5?
Até 30 segundos por requisição, definidos com duration (4-30, ou -1 para deixar o modelo escolher). O Seedance 2.0 vai até 15 segundos.
Existe um otimizador de prompts oficial do Seedance?
Sim. A ByteDance publica uma skill de prompts do Seedance 2.5, sd25-pe, que assistentes de código podem usar para reescrever o seu prompt antes de você enviá-lo. O comando de instalação está no guia oficial.
Posso usar uma foto minha como referência?
Não. O Seedance recusa imagens e vídeos de referência que contenham rostos humanos reais. O guia do erro de pessoa real mostra o que a ByteDance permite no lugar.
Teste seu prompt
Cole um prompt no playground do Seedance 2.5 ou no playground do Seedance 2.0, ou envie-o pelo código com a referência da API do Seedance 2.5. Você recarrega uma vez, sem assinatura, os créditos nunca expiram, e uma tarefa que falha não custa nada.



