Prompt systems for ads
The route frames commercial video creation around usable prompts, platform formats, and production outcomes.
Commercial Guide
Read practical guides for ads, product demos, creator monetization, and copy-ready video prompt workflows.
The route focuses on practical ad, product, and monetization workflows.
Prompt blocks and media steps are organized for repeatable output.
Public guide routes help Seedance capture business-intent searches.
A ByteDance lançou o novo modelo de criação de vídeo **Seedance 2.5**. Para quem trabalha com vídeo, desta vez a mudança vai além da qualidade de imagem: um único vídeo pode conter uma cena inteira, é possível comandar dezenas de materiais de referência ao mesmo tempo e, ao alterar um vídeo, dá para localizar o segundo exato.
Suporta geração a partir de texto puro, bem como criação com referência simultânea a imagens, vídeos e áudio, e ainda permite editar vídeos já existentes.
A ByteDance publicou um guia oficial de prompts: da geração a partir de uma única frase, à forma de coordenar 50 materiais de referência, à divisão em segmentos de um filme de 30 segundos e à edição que altera apenas um ponto, cada tipo de tarefa vem acompanhada de um modelo que pode ser copiado e usado diretamente.
---
O prompt pode ser combinado com flexibilidade de acordo com a fórmula abaixo:
**FÓRMULA: sujeito + ação ou evento + cena e ambiente (opcional) + estilo visual (opcional) + movimento de câmera ou corte (opcional) + som (opcional)**
| Componente | Descrição |
|------|------|
| **Sujeito + ação ou evento** | Explica "quem ou o quê" está fazendo "o quê". É a base do conteúdo do vídeo. A ação prioriza resumir o processo principal, escrevendo detalhes específicos apenas para as ações-chave, evitando descrever repetidamente a mesma ação. |
| **Cena e ambiente** | Explica local, tempo, clima, relações espaciais e o estado do cenário. |
| **Estilo visual** | Explica luz, cor, materiais, textura da imagem ou o clima geral. |
| **Movimento de câmera ou corte** | Explica o plano, a posição da câmera, o movimento da lente, o objeto em foco e a ligação entre as tomadas. |
| **Som** | Explica diálogo, timbre de voz, som ambiente, efeitos sonoros e música. |
<sujeito> <ação ou evento principal> em <cena e ambiente>. A imagem apresenta <estilo visual>. A câmera usa <plano, posição da câmera, movimento de câmera ou corte>. O som inclui <diálogo, som ambiente, efeito sonoro ou música>.Um oleiro completa uma taça de cerâmica azul-clara no ateliê de madrugada, retira-a do torno e a coloca no centro da estante de madeira. A luz suave da manhã entra pela janela, a argila úmida apresenta um brilho delicado e a bancada permanece organizada. A câmera primeiro registra em plano médio o movimento de modelar, depois aproxima-se lentamente da textura da superfície da taça e, por fim, corta para a frente da estante. Mantêm-se o som grave e baixo do torno a girar, o atrito da argila e um leve som ambiente interno.
**Atenção**: as partes desnecessárias podem ser omitidas. Os parâmetros de geração não precisam ser escritos no prompt; os parâmetros ajustáveis são definidos na página de geração ou na interface.
---
É possível combinar até **50 materiais de referência**.
| Tipo de material | Intervalo de entrada | Intervalo recomendado |
|----------|----------|----------|
| **Imagem** | Máximo 30 imagens, cada uma com no máximo 4K | As imagens do sujeito devem idealmente conter de 1 a 8 sujeitos |
| **Vídeo** | Máximo 10 segmentos, com duração total de todos os vídeos de no máximo 30 segundos | Os vídeos do sujeito devem idealmente conter de 1 a 5 sujeitos, com 5 a 10 segundos por segmento |
| **Áudio** | Máximo 10 segmentos, com duração total de todo o áudio de no máximo 30 segundos | Manter falas, timbres, sons ambiente ou músicas diretamente relacionados à tarefa |
| **Edição de vídeo** | É possível usar vídeo e imagens de referência juntos para a edição | O vídeo original deve idealmente ter menos de 20 segundos, e as imagens de referência, de 1 a 5 |
**Atenção**: ainda é possível tentar além do intervalo recomendado, mas quanto mais materiais, mais fácil é que a estabilidade diminua.
Se a imagem do sujeito tiver mais de 5 sujeitos e ainda assim exigir múltiplas perspectivas, recomenda-se dividir as diferentes perspectivas em várias imagens; várias imagens independentes de perspectivas costumam ser mais estáveis do que reunir várias perspectivas em uma única imagem.
Após enviar os materiais de referência, é preciso explicar o que cada material fornece especificamente. Quando pessoas, fundos ou composições do material podem ser facilmente incorporados por engano ao vídeo final, escreva também o que não deve ser utilizado.
**O mapeamento dos materiais deve ser escrito no prompt**. Não confie apenas nas anotações em texto das imagens e não deixe o modelo decidir por conta própria a qual pessoa, adereço ou cena cada um dos vários materiais corresponde.
@imagem1 é usada para <aparência, roupa, estrutura ou material> de <sujeito>.
@vídeo1 é usado para <ação, movimento de câmera ou ritmo>.
@áudio1 é usado para <timbre, fala, som ambiente ou música> de <personagem ou tipo de voz>.
<sujeito> completa <ação ou evento principal> em <cena>. A imagem apresenta <estilo visual>, e a câmera usa <expressão de câmera>.@imagem1 é usada para os traços faciais, o cabelo e o avental verde-escuro de <oleiro>, e não se utiliza o fundo da imagem. @imagem2 é usada para a bancada de madeira, a posição da janela e a luz da manhã de <ateliê de cerâmica>, e não se utiliza a pessoa da imagem. @vídeo1 é usado para o ritmo dos movimentos de modelar com as mãos, de levantar a taça e de colocá-la, e não se utilizam a identidade da pessoa, a roupa e a cena do vídeo. <oleiro> completa uma taça de cerâmica azul-clara no <ateliê de cerâmica> de madrugada, retira-a do torno e a coloca no centro da estante de madeira. A câmera primeiro registra em plano médio o movimento de modelar e depois aproxima-se lentamente da textura da superfície da taça; mantêm-se o som do torno a girar, o atrito da argila e o som ambiente interno.
@imagem1 define a aparência frontal da mesma luminária dobrável de mesa. @imagem2 define a estrutura lateral esquerda da mesma luminária dobrável de mesa. @imagem3 define a estrutura lateral direita da mesma luminária dobrável de mesa. @imagem4 define a estrutura traseira da mesma luminária dobrável de mesa. As quatro imagens definem juntas a mesma luminária dobrável de mesa, e no vídeo final há sempre apenas uma luminária dobrável de mesa.
**Dica**: quando o vídeo de referência já fornece com precisão ação, movimento de câmera e sequência, o prompt só precisa explicar quais conteúdos devem ser herdados, sem repetir cada ação; descrever repetidamente pode entrar em conflito com o próprio material.
---
O prompt pode usar diretamente linguagem natural. Quando for necessário distinguir melhor entre música, efeito sonoro, fala e legendas, podem ser usados os seguintes caracteres especiais:
| Categoria | Símbolo | Exemplo |
|------|------|------|
| **Música** | `· ( )` | `·(música de piano calma tocando ao fundo em ritmo suave)` |
| **Efeito sonoro** | `< >` | `<sino soando ao longe>` |
| **Fala** | `{ }` | `{olá, bem-vindo de volta}` |
| **Legenda** | `[ ]` | `[Capítulo Um: Partida]` |
Quando for necessário controlar legendas ou sons, pode-se escrever diretamente as categorias de som a manter e as a não utilizar. O conteúdo visual continua dando prioridade à descrição positiva; apenas a função dos materiais, o escopo de edição e os conteúdos facilmente incorporados por engano precisam de restrições explícitas.
**Exemplos:**
Quando a fala não é em chinês, recomenda-se indicar claramente o idioma antes da fala:
A menina diz baixinho em japonês: {mou daijoubu desu}
**Fórmula recomendada**:
idioma da fala + variante regional ou sotaque + modo de expressão + pessoa que fala + {conteúdo da fala}**Exemplos**:
Idioma da fala: inglês americano. A menina diz em inglês americano natural e coloquial: {I thought you weren't coming.}
Idioma da fala: inglês americano autêntico de Los Angeles. O rapaz diz no coloquial natural de Los Angeles: {No way, you actually made it.}
---
É possível combinar imagens, vídeos e áudio. Quando há muitos materiais, o foco do prompt não é escrever todos os materiais na mesma frase, mas sim definir claramente as correspondências entre pessoas, adereços, cenas, ações e sons.
Recomenda-se organizar na seguinte ordem:
**ORDEM: função de cada material → mapeamento dos sujeitos → agrupamento por tipo → definição dos sujeitos → convocação por cena**
Pessoas, produtos e adereços diferentes precisam ser vinculados a materiais separadamente:
`<pessoa A> corresponde a @imagem1, adotando apenas aparência, cabelo e roupa.<pessoa B> corresponde a @imagem2, adotando apenas aparência, cabelo e roupa.<adereço A> corresponde a @imagem3, adotando apenas estrutura, material e cor.<cena A> toma como referência @imagem4, adotando apenas disposição espacial, arquitetura e luz, e não as pessoas da imagem.`
**Não escreva "@imagem1 a @imagem4 definem respectivamente quatro personagens"** — essa forma não deixa claro qual imagem corresponde a qual personagem.
[Pessoas]<restaurador> corresponde a @imagem1, adotando apenas aparência, cabelo e roupa.<arquivista> corresponde a @imagem2, adotando apenas aparência, cabelo e roupa.<montador de exposição> corresponde a @imagem3, adotando apenas aparência, cabelo e roupa.<guia de exposição> corresponde a @imagem4, adotando apenas aparência, cabelo e roupa. Aparência, roupa, ações, posições e falas das quatro pessoas não são intercambiadas entre si.
[Adereços]<caixa de amostras> corresponde a @imagem5, pertence apenas a <restaurador>.<prancheta de registro> corresponde a @imagem6, pertence apenas a <arquivista>.
[Cenas]<sala de restauro> toma como referência @imagem7, adotando apenas espaço, material e luz.<salão de exposição> toma como referência @imagem8, adotando apenas espaço, material e luz.
[Ações e sons]@vídeo1 é usado para a ação de <restaurador> abrir a caixa de amostras, não se adotando as pessoas e a cena do vídeo. @áudio1 é usado para o timbre de voz e as falas especificadas de <guia de exposição>.Quando a mesma pessoa precisa usar vários materiais em cenas diferentes, pode-se acrescentar a definição do sujeito:
[Definição do sujeito: restaurador]Aparência e roupa: @imagem1. Adereço fixo: <caixa de amostras> de @imagem5. Locais de aparição: <sala de restauro> e <salão de exposição>. Referência de ações: a ação de abrir a caixa de @vídeo1 e a ação de colocar as amostras de @vídeo2. Não adotar: as roupas das outras pessoas, não segurar <prancheta de registro> nem equipamento de explicação.**Cena um | Inspeção na sala de restauro** — usar: <restaurador>, <caixa de amostras>, <sala de restauro> e a ação de abrir a caixa de @vídeo1. Evento: <restaurador> abre a caixa de amostras em frente à bancada e inspeciona as amostras em seu interior. Ao final: <restaurador> para no lado interno da bancada, e a caixa de amostras permanece sempre ao lado direito do próprio <restaurador>, ou seja, no lado esquerdo do quadro.
**Cena dois | Registro no salão de exposição** — usar: <arquivista>, <prancheta de registro> e <salão de exposição>. Evento: <arquivista> confere os números na prancheta de registro ao lado da vitrine. Ao final: a prancheta de registro continua sendo segurada com as duas mãos por <arquivista>, e outras pessoas não entram na área da vitrine.
**Objetivo**: o objetivo da criação com múltiplos materiais é fazer o modelo escolher o material correto na cena atual, sem exigir que todos os materiais apareçam ao mesmo tempo no quadro.
---
Quando há muitos eventos, recomenda-se dividir a história em etapas contínuas. Cada etapa deve ter apenas uma principal mudança de estado, e deve-se escrever claramente o estado que pode ser visto diretamente no quadro ao final da etapa.
[Objetivo de geração]Gerar um <tipo de vídeo>. O sujeito central é <sujeito>, e o evento principal é <resumo da história>.
[Etapa um]No início: <estado inicial das pessoas, adereços e cena>. Evento principal: <uma ação ou evento principal>. Ao final: <posição das pessoas, pertencimento dos adereços ou estado do quadro>.
[Etapa dois]Dando continuidade à etapa anterior: <estado a ser mantido>. Evento principal: <uma ação ou evento principal>. Ao final: <estado observável>.
[Etapa três]Evento principal: <evento de encerramento>. Ao final: <estado final do quadro>.
[Manter consistência]Manter estáveis <identidade, quantidade, roupa, pertencimento dos adereços, direção espacial e relações sonoras> das pessoas.Gerar um vídeo explicativo do fluxo de embalagem de pedidos de floricultura. <florista> e <funcionário de loja> concluem juntos a organização, a embalagem e a entrega do buquê.
**Etapa um**
- No início: <florista> está atrás da bancada, com hastes soltas de flores, tesoura e papel de embalagem sobre a mesa.
- Evento principal: <florista> organiza as hastes e ajusta o comprimento.
- Ao final: o buquê está segurado na mão esquerda de <florista>, e a tesoura volta ao lado direito da bancada.
**Etapa dois**
- Dando continuidade à etapa anterior: as duas pessoas mantêm a mesma identidade e roupa, e o buquê continua sendo segurado por <florista>.
- Evento principal: <funcionário de loja> abre o papel de embalagem, e <florista> coloca o buquê e amarra a fita verde.
- Ao final: o buquê embalado fica deitado no centro da bancada, com o laço de fita voltado para a câmera.
**Etapa três**
- Evento principal: <funcionário de loja> pega o buquê e o coloca na estante de retirada.
- Ao final: o buquê fica apenas no centro da estante de retirada, e as duas pessoas ficam atrás da bancada conferindo o produto final.
**Manter consistência**: manter estáveis a identidade e a roupa de <florista> e <funcionário de loja>, a direção da bancada, a posição da tesoura e o pertencimento do buquê.
Para narrativas comuns, priorize o uso de "etapas". Só use expressões de tempo em unidades de 1 segundo quando for necessário controlar entregas-chave, entradas e saídas, transições ou batidas claras.
**Exemplos**:
0-5 segundos: mostrar um expositor de madeira vazio; uma mão coloca um prato de cerâmica branca; ao final, a mão já saiu e no centro do expositor só há o prato de cerâmica branca.
5-10 segundos: retirar o prato de cerâmica branca e colocar um copo de vidro transparente; ao final, no centro do expositor só há o copo de vidro transparente.
10-15 segundos: retirar o copo de vidro transparente e colocar uma garrafa de cerâmica verde; ao final, no centro do expositor só há a garrafa de cerâmica verde.
**Atenção**: os intervalos de tempo devem ser contínuos e sem sobreposição. Eles representam o orçamento de tempo do evento, e não pontos precisos de edição; as ações podem se adiantar ou atrasar perto dos limites. Conteúdo de menos em um intervalo aumenta a margem de criação do modelo; conteúdo de mais pode causar cortes excessivos ou omissões na trama.
**Não use timestamps para controlar frequências como "três ações por segundo".**
---
Edição de vídeo, geração de vídeo a partir do primeiro frame ou do primeiro e último frame, e extensão de vídeo bloqueiam automaticamente parte dos parâmetros de geração conforme os materiais de entrada. As regras específicas são:
| Tipo de tarefa | Proporção do quadro | Duração |
|----------|----------|------|
| **Edição de vídeo** | Mantém automaticamente a proporção do vídeo de entrada, **sem possibilidade de configuração adicional** | Mantém automaticamente a duração do vídeo de entrada, **sem possibilidade de configuração adicional**; pode haver uma diferença máxima de cerca de 0,3 segundos |
| **Geração de vídeo a partir do primeiro frame ou do primeiro e último frame** | Usa automaticamente a **proporção da imagem do primeiro frame**; o primeiro e o último frame devem usar a mesma proporção | Com possibilidade de configuração |
| **Extensão de vídeo** | Mantém automaticamente a proporção do vídeo de entrada, **sem possibilidade de configuração adicional** | Com possibilidade de configuração |
Os parâmetros bloqueados automaticamente nessas tarefas não podem ser especificados adicionalmente na página de geração ou na interface; os demais parâmetros seguem as opções disponíveis no momento.
---
Ao editar um vídeo existente, primeiro defina o vídeo original como o único master, e depois explique o objeto da edição, o escopo de atuação, os materiais-alvo e os conteúdos a manter.
[Objetivo da edição]Editar @vídeo1, realizando <adição, remoção, substituição ou ajuste> em <objeto do quadro, área ou categoria sonora> em <todo o vídeo ou um intervalo de tempo claro>.
[Função do vídeo original]@vídeo1 é o único master de edição, responsável por <pessoas, cenas, ações, composição, tomadas, relações de oclusão, sons e sequência de eventos>.
[Função do material-alvo]@imagem1 ou @áudio1 é usado para <os atributos especificados do objeto ou som-alvo>.
[Escopo da edição]Processar apenas <objeto, área, intervalo de tempo ou categoria sonora>.
[Conteúdos a manter]Manter em @vídeo1 o <quadro, as ações, os sons e as relações de tempo que não devem mudar>.[Objetivo da edição]Editar @vídeo1, ajustando apenas, entre 4-7 segundos, a luz azul-fria da parede à direita do quadro para uma luz laranja-quente.
[Função do vídeo original]@vídeo1 é o único master de edição, responsável pelas pessoas, pela disposição do ambiente, pelas ações, pela composição, pelo movimento de câmera, pelos sons e pela sequência de eventos.
[Escopo da edição]Ajustar apenas a cor da luz da parede direita e de sua área iluminada; o tom de pele das pessoas muda naturalmente com a luz ambiente.
[Conteúdos a manter]Identidade, roupa, expressão, posição, ações, estrutura do ambiente, movimento de câmera, diálogos e som ambiente das pessoas mantêm @vídeo1.
**Modelo**:
[Objetivo da edição]Editar @vídeo1, apenas modificando <objeto original> para <objeto-alvo>.
[Função do vídeo original]@vídeo1 é o único master de edição, responsável pela cena original, pela posição da câmera, pelo movimento de câmera, pela trajetória das ações, pelas relações de oclusão e pela sequência de eventos.
[Função do material-alvo]@imagem1 é usada para <aparência, estrutura ou material> de <objeto-alvo>, não se adotando <fundo, pessoas ou composição irrelevantes>.
[Objeto e escopo da edição]Modificar apenas <objeto e área claros>. A quantidade do objeto-alvo em todo o vídeo é <quantidade>. Não modificar <os conteúdos a manter>.
[Herança na linha do tempo]<objeto-alvo> herda de <objeto original> os momentos, as durações, os percursos e as variações de velocidade de cada aparição, movimento, oclusão e saída. Exceto pelos objetos ou áreas modificados explicitamente acima, as outras pessoas, adereços, conteúdos de cena, movimentos de câmera, cortes e a sequência de eventos de @vídeo1 permanecem como estão.**Exemplo**:
[Objetivo da edição]Editar @vídeo1, apenas substituindo a luminária dobrável de mesa amarela do vídeo pela luminária dobrável de mesa branca de @imagem1.
[Função do vídeo original]@vídeo1 é o único master de edição, responsável pela escrivaninha, pelos livros, pelas ações das mãos, pela posição da câmera, pelo movimento de câmera, pelas relações de oclusão e pela sequência de eventos.
[Função do material-alvo]@imagem1 é usada apenas para a aparência, a estrutura e o material da luminária dobrável de mesa branca, não se adotando o fundo, a composição ou outros objetos da imagem.
[Objeto e escopo da edição]Em todo o vídeo há sempre apenas uma luminária dobrável de mesa branca. Substituir apenas a luminária dobrável de mesa amarela original, sem modificar livros, escrivaninha, mãos e fundo.
[Herança na linha do tempo]A luminária dobrável de mesa branca herda da luminária dobrável de mesa amarela original os momentos, os percursos e as variações de velocidade de cada aparição, giro do braço da luminária, oclusão pela mão e saída do quadro. Exceto pelos objetos ou áreas modificados explicitamente acima, as outras pessoas, adereços, conteúdos de cena, movimentos de câmera, cortes e a sequência de eventos de @vídeo1 permanecem como estão.
**Modelo**:
[Objetivo da edição]Editar @vídeo1, apenas substituindo <área de fundo original> pelo <ambiente-alvo> de @imagem1.
[Função do vídeo original]@vídeo1 é o único master de edição, responsável pelas pessoas, pelos objetos em primeiro plano, pelas ações, pela composição, pelo movimento de câmera e pela sequência de eventos.
[Função do material-alvo]@imagem1 é usada apenas para a disposição espacial, o material, a profundidade de campo, a cor ambiente e a direção da luz de <ambiente-alvo>, não se adotando as pessoas ou os objetos em primeiro plano da imagem.
[Objeto e escopo da edição]Modificar apenas <a área de fundo fora do contorno do sujeito>. Não modificar <identidade, traços faciais, cabelo, roupa, expressão, posição, tamanho e ações do sujeito>.
[Herança na linha do tempo]As ações das pessoas e as relações de oclusão mantêm @vídeo1. Exceto pelos objetos ou áreas modificados explicitamente acima, as outras pessoas, adereços, conteúdos de cena, movimentos de câmera, cortes e a sequência de eventos de @vídeo1 permanecem como estão.**Exemplo**:
@vídeo1 é o único master de edição, responsável pelas pessoas, pelas ações, pela composição, pelas tomadas e pela sequência de eventos. @imagem1 fornece apenas a disposição espacial, a profundidade de campo, a cor ambiente e a direção da luz de um jardim de inverno de vidro diurno, não se adotando as pessoas da imagem. Substituir apenas o fundo cinza-claro fora do contorno das pessoas de @vídeo1 pelo jardim de inverno de vidro diurno de @imagem1. Identidade, traços faciais, cabelo, roupa, expressão, posição, tamanho e o movimento de levantar a mão das pessoas mantêm @vídeo1. Exceto pelos objetos ou áreas modificados explicitamente acima, as outras pessoas, adereços, conteúdos de cena, movimentos de câmera, cortes e a sequência de eventos de @vídeo1 permanecem como estão.
Diálogo, idioma, timbre de voz, música de fundo e efeitos sonoros podem ser processados separadamente. O prompt precisa escrever claramente quem fala ou a categoria sonora, a mudança-alvo e se os outros sons são mantidos.
**Exemplos**:
Editar @vídeo1, removendo apenas a música de fundo original e mantendo os diálogos das pessoas, os movimentos da boca, o som ambiente e os efeitos sonoros das ações; o conteúdo visual, as tomadas e o ritmo de edição mantêm @vídeo1.
Editar @vídeo1, ajustando o idioma das falas de <guia de exposição> para um inglês americano natural, mantendo inalterados o conteúdo das falas e os momentos em que são ditas; as vozes das outras pessoas, a música de fundo, o som ambiente e o visual mantêm @vídeo1.
---
A extensão de vídeo é a criação além das bordas do vídeo original. A proporção de saída mantém automaticamente a proporção do vídeo de entrada, e a duração da extensão é definida pelo usuário.
| Direção | Requisito de borda |
|------|----------|
| **Extensão para trás** | O primeiro quadro do segmento estendido deve dar continuidade ao último frame do vídeo original |
| **Extensão para frente** | O último quadro do segmento estendido deve se conectar ao primeiro frame do vídeo original |
Além da imagem de borda, também é preciso manter a continuidade de pessoas, adereços, fundo, tendência de movimento e som.
Primeiro descreva o estado contínuo do último frame do vídeo original e, depois, o conteúdo que ocorre após o último frame.
**Modelo básico**:
@vídeo1 é o vídeo original a ser estendido para trás. Estender @vídeo1 para trás. O primeiro quadro do segmento estendido dá continuidade diretamente ao último frame de @vídeo1: manter contínuos <postura e orientação do sujeito>, <posição do adereço>, <fundo e relações espaciais>, <posição da câmera e composição>, <luz>, <estado do som> e <tendência de movimento>. Em seguida, <descrever as novas ações, eventos, tomadas ou sons a estender>. Durante a extensão, manter contínuos <identidade e roupa das pessoas>, <adereços-chave>, <disposição do fundo>, <eixo de filmagem> e <ambiente sonoro original>. O mesmo sujeito permanece sempre o mesmo objeto contínuo, sem se repetir ou se dividir; a aparência das pessoas ou a quantidade de partes dos objetos permanece estável.**Exemplo**:
@vídeo1 é o vídeo original a ser estendido para trás. Estender @vídeo1 para trás. O primeiro quadro do segmento estendido dá continuidade diretamente ao último frame de @vídeo1: manter contínuos o mesmo plano médio fixo, a posição e a orientação do avião de papel laranja, o fundo junto à janela da sala de aula, a luz da tarde e a tendência de voo para o lado direito do quadro. Em seguida, fazer o avião de papel laranja continuar deslizando para o lado direito do quadro e sair do quadro, com a cortina branca de renda junto à janela balançando levemente. A câmera e o fundo da sala de aula mantêm o estado do último frame do vídeo original.
Primeiro explique um a um pelo que os outros materiais são responsáveis e, depois, defina claramente que o vídeo original é responsável pela extensão da borda.
**Modelo**:
@imagem1 define os traços faciais de <pessoa A>. @imagem2 define a roupa de <pessoa A>. @imagem3 define a estrutura e o material de <adereço-chave>. @vídeo1 é o vídeo original a ser estendido para trás. Estender @vídeo1 para trás. O primeiro quadro do segmento estendido dá continuidade diretamente ao último frame de @vídeo1: manter contínuos <imagem de borda e estado do som>. Em seguida, <nova ação ou evento em que a pessoa A usa o adereço-chave>. Durante a extensão, manter contínuos <identidade e roupa das pessoas>, <adereços-chave>, <disposição do fundo>, <eixo de filmagem> e <ambiente sonoro original>. O mesmo sujeito permanece sempre o mesmo objeto contínuo, sem se repetir ou se dividir; a aparência das pessoas ou a quantidade de partes dos objetos permanece estável.**Exemplo**:
@imagem1 define os traços faciais de <jardineiro>. @imagem2 define o avental de trabalho verde-claro de <jardineiro>. @imagem3 define a estrutura e o material de <cesto de flores de vime>. @vídeo1 é o vídeo original a ser estendido para trás. Estender @vídeo1 para trás. O primeiro quadro do segmento estendido dá continuidade diretamente ao último frame de @vídeo1: manter contínuos a bancada da estufa, a posição de <jardineiro> e a posição de <cesto de flores de vime>. Em seguida, <jardineiro> levanta <cesto de flores de vime> com as duas mãos e o coloca na prateleira do meio de madeira atrás dele. Durante a extensão, manter contínuos o rosto, o avental, a disposição da estufa e a direção da câmera de <jardineiro>.
Primeiro descreva o conteúdo que ocorre antes do início do vídeo original e, depois, escreva o primeiro frame do vídeo original como o estado final claro do segmento estendido.
**Modelo básico**:
@vídeo1 é o vídeo original a ser estendido para frente. Estender @vídeo1 para frente. Antes do início do vídeo original, <descrever ações, eventos, tomadas ou sons anteriores>. O último quadro do segmento estendido se conecta naturalmente ao primeiro frame de @vídeo1: <postura e orientação do sujeito>, <posição do adereço>, <fundo e relações espaciais>; manter <posição da câmera e composição>, <luz>, <estado do som> e <tendência de movimento> idênticos ao primeiro frame de @vídeo1. Durante a extensão, manter contínuos <identidade e roupa das pessoas>, <adereços-chave>, <disposição do fundo>, <eixo de filmagem> e <ambiente sonoro original>. O mesmo sujeito permanece sempre o mesmo objeto contínuo, sem se repetir ou se dividir; a aparência das pessoas ou a quantidade de partes dos objetos permanece estável.**Exemplo**:
@vídeo1 é o vídeo original a ser estendido para frente. Estender @vídeo1 para frente. Antes do início do vídeo original, apresentar um plano vazio da mesma estufa de vidro: o nevoeiro da manhã se dissipa lentamente rente ao chão, a cortina de proteção do topo se eleva gradualmente e, por ora, não há pessoas no quadro. O último quadro do segmento estendido se conecta naturalmente ao primeiro frame de @vídeo1: manter o corredor central da estufa, os canteiros dos dois lados, a estrutura de vidro, a luz suave da manhã e a composição em plano geral fixo idênticos ao primeiro frame de @vídeo1; ao final, a cortina de proteção já está totalmente elevada, não há pessoas no corredor e as folhas ainda balançam levemente.
Declare a função de cada material um a um e explique quais materiais são usados no segmento de extensão para frente e quais são usados apenas após o início do vídeo original.
**Modelo**:
@imagem1 define os traços faciais de <pessoa A>. @imagem2 define a roupa de <pessoa A>. @imagem3 define a estrutura e o material de <adereço-chave>. @vídeo1 é o vídeo original a ser estendido para frente. Estender @vídeo1 para frente. Antes do início do vídeo original, <pessoa A realiza uma ação ou evento anterior>. O último quadro do segmento estendido se conecta naturalmente ao primeiro frame de @vídeo1: <postura e orientação de pessoa A>, <posição e estado do adereço-chave>, <posição das outras pessoas>; manter <fundo e relações espaciais>, <posição da câmera e composição>, <luz>, <estado do som> e <tendência de movimento> idênticos ao primeiro frame de @vídeo1. Durante a extensão, manter contínuos <identidade e roupa das pessoas>, <adereços-chave>, <disposição do fundo>, <eixo de filmagem> e <ambiente sonoro original>. O mesmo sujeito permanece sempre o mesmo objeto contínuo, sem se repetir ou se dividir; a aparência das pessoas ou a quantidade de partes dos objetos permanece estável. <Os materiais que aparecem apenas após o início do vídeo original> não aparecem antes no segmento de extensão para frente.**Exemplo**:
@imagem1 define os traços faciais de <curador de exposição>. @imagem2 define o casaco de trabalho azul-escuro de <curador de exposição>. @imagem3 define a estrutura e o material de <caixa de exibição de madeira>. @imagem4 define o macacão de trabalho cinza de dois <assistentes de montagem>. @imagem5 define o espaço e a luz de <sala de preparação da exposição>. @vídeo1 é o vídeo original a ser estendido para frente. Estender @vídeo1 para frente. Antes do início do vídeo original, <curador de exposição> caminha até a bancada, pega a <caixa de exibição de madeira> fechada e abre a tampa. O último quadro do segmento estendido se conecta naturalmente ao primeiro frame de @vídeo1: <curador de exposição> fica no centro do quadro, segurando com as duas mãos a <caixa de exibição de madeira> aberta; os dois <assistentes de montagem> ficam, respectivamente, à esquerda e à direita, atrás dele. Manter o plano médio frontal em formato vertical, a posição da bancada, o fundo da sala de preparação e a luz da manhã vinda da esquerda idênticos ao primeiro frame de @vídeo1.
**Atenção**: a imagem de borda deve buscar uma conexão visual natural e não deve ser entendida como pixel a pixel idêntica.
O volume do resultado da extensão pode variar levemente em relação ao vídeo original; ao continuar estendendo com vídeos gerados pelo mesmo modelo de geração, o visual e o som costumam se conectar mais facilmente. Na aceitação, é preciso verificar ao mesmo tempo o visual e o som antes e depois da borda, além do segmento estendido completo.
---
No modo de referência multimodal, é possível escrever diretamente na primeira frase do prompt @imagem1 como primeiro frame e @imagem2 como último frame, sem precisar alternar para o modo separado de primeiro e último frame. O sistema bloqueia a proporção de saída com base na proporção do primeiro frame, e a duração é definida na página de geração ou na interface; o primeiro e o último frame devem usar a mesma proporção, e, se as proporções forem diferentes, o último frame pode sofrer estiramento.
**Modelo básico**:
@imagem1 serve como primeiro frame, definindo a composição, a posição do sujeito, a postura, o estado do adereço, a cena e a direção da câmera no início do vídeo.
@imagem2 serve como último frame, definindo a composição, a posição do sujeito, a postura, o estado do adereço, a cena e a direção da câmera no fim do vídeo.
@imagem3 é usada para <aparência, roupa, estrutura ou material> de <sujeito A>, sem alterar a composição do primeiro frame definida por @imagem1 e sem alterar a composição do último frame definida por @imagem2.
@imagem4 é usada para <os atributos especificados> de <sujeito B, adereço ou cena>, sem alterar a composição do primeiro frame definida por @imagem1 e sem alterar a composição do último frame definida por @imagem2.
<Descrever uma ação ou evento contínuo>. O quadro começa naturalmente no primeiro frame definido por @imagem1 e, após uma ação contínua, chega ao último frame definido por @imagem2. Entre o primeiro e o último frame, manter contínuos <identidade das pessoas, estrutura e pertencimento dos adereços, disposição da cena e direção da câmera>.**Exemplo**:
@imagem1 serve como primeiro frame, definindo a composição da oficina de perfumes no início do vídeo, a posição das pessoas, a postura, o estado dos adereços sobre a mesa e a direção da câmera. @imagem2 serve como último frame, definindo a composição da oficina de perfumes no fim do vídeo, a posição das pessoas, a postura, o estado dos adereços sobre a mesa e a direção da câmera. @imagem3 é usada para o rosto, o cabelo e o avental verde-escuro de <perfumista>, sem alterar a composição do primeiro frame definida por @imagem1 e sem alterar a composição do último frame definida por @imagem2. @imagem4 é usada para o formato, o material e a posição do rótulo de <frasco de perfume de vidro>, sem alterar a composição do primeiro frame definida por @imagem1 e sem alterar a composição do último frame definida por @imagem2. <perfumista> começa na postura do primeiro frame, pega o conta-gotas e o <frasco de perfume de vidro>, goteja a essência âmbar no frasco, agita suavemente para misturar, fecha com a rolha, coloca o produto final no centro da mesa e, por fim, chega naturalmente ao último frame definido por @imagem2. Entre o primeiro e o último frame, manter contínuos a identidade e a roupa de <perfumista>, a quantidade e a estrutura dos frascos de perfume, a disposição da mesa de madeira, a luz lateral quente e a direção da câmera.
**Atenção**: cada imagem-âncora precisa ser explicada separadamente, sem combiná-las em "imagem 1 e imagem 2 como primeiro e último frame". O primeiro e o último frame devem usar a mesma proporção. As outras imagens de referência fornecem apenas os atributos especificados e não substituem a composição do primeiro e do último frame.
Quando várias imagens independentes definem respectivamente as diferentes etapas do processo, a primeira frase do prompt deve escrever "usar @imagem1 a @imagemN em ordem como keyframes" e, depois, explicar um a um o estado-chave correspondente a cada imagem.
**Modelo básico**:
Usar @imagem1 a @imagemN em ordem como keyframes.
@imagem1 serve como primeiro frame, definindo <composição, posição do sujeito, postura, estado do adereço e direção da câmera no início>.
@imagem2 define o segundo keyframe: <o estado visível ao final da primeira etapa>.
@imagem3 define o terceiro keyframe: <o estado visível ao final da segunda etapa>.
@imagemN serve como último frame, definindo <composição, posição do sujeito, postura, estado do adereço e direção da câmera no fim>.
O quadro passa em sequência pelos estados definidos por @imagem1, @imagem2, @imagem3 a @imagemN, com transições naturais por ações contínuas entre as etapas. Durante todo o processo, manter contínuos <identidade do sujeito, estrutura e pertencimento dos adereços, disposição da cena, luz e eixo de filmagem>.**Exemplo**:
Usar @imagem1 a @imagem4 em ordem como keyframes. @imagem1 serve como primeiro frame, definindo o avião de papel laranja parado no lado esquerdo da mesa de madeira da sala de aula, com o nariz voltado para o lado direito do quadro, em plano médio fixo. @imagem2 define o segundo keyframe: o mesmo avião de papel laranja é erguido da mesa por uma mão, mantendo a direção do nariz inalterada. @imagem3 define o terceiro keyframe: o mesmo avião de papel laranja passa raspando pela janela, com a cortina balançando levemente para a direita. @imagem4 serve como último frame, definindo o mesmo avião de papel laranja pousando na prateleira do meio da estante à direita, com o nariz ainda voltado para o lado direito do quadro. O quadro passa em sequência pelos estados definidos por @imagem1, @imagem2, @imagem3 e @imagem4, mantendo entre as etapas a continuidade da direção e da velocidade do voo. Durante todo o processo, manter contínuos o material laranja, o tamanho e os vincos do avião de papel, a disposição da sala de aula, a luz lateral da tarde e o eixo da câmera.
O storyboard em grade serve para fornecer a história geral, a ordem das tomadas e a composição aproximada, não sendo adequado para exigir a replicação rigorosa dos detalhes de cada quadro. Recomenda-se limitar a 15 quadros, usando esboços de linha simples ou diagramas limpos e reduzindo as anotações de texto.
**Modelo básico**:
@imagem1 fornece a ordem das tomadas e a composição aproximada de < >, lida na ordem <da esquerda para a direita, de cima para baixo>; não adotar <estilo de esboço de linha, anotações de texto ou pessoas de preenchimento> da imagem.
@imagem2 define <aparência e roupa> de <sujeito A>.
@imagem3 define <estrutura, material ou luz> de <adereço-chave ou cena>.
Tomada 1: <plano, ação do sujeito, estado da cena>.
Tomada 2: <plano, ação do sujeito, movimento de câmera ou forma de transição>.
……
Tomada N: <ação de encerramento e estado do quadro final>.
O quadro final adota <estilo visual>, e o som inclui <diálogo, som ambiente, efeito sonoro de ação ou música>.**Exemplo**:
@imagem1 fornece a ordem das tomadas e a composição aproximada de um storyboard em quatro quadros sobre a produção de cerâmica, lida na ordem da esquerda para a direita e de cima para baixo; não se adotam o estilo de esboço de linha nem as anotações de texto da imagem. @imagem2 define o rosto, o cabelo curto e o avental cinza-escuro de <oleiro>. @imagem3 define a proporção do corpo, a cor do esmalte e a alça em arco de <taça de esmalte azul>.
Tomada 1: em plano geral, apresentar um ateliê de cerâmica tranquilo, com <oleiro> sentado diante do torno.
Tomada 2: em plano médio, de lado, <oleiro> apoia com as duas mãos o corpo de argila úmida em rotação, e a forma da taça vai se delineando.
Tomada 3: em close, os dedos ajustam a junção entre a boca da taça e a alça, com a barbotina escorrendo lentamente ao longo das pontas dos dedos.
Tomada 4: em plano médio-fechado, apresentar a <taça de esmalte azul> queimada e concluída sendo colocada na estante de madeira, com <oleiro> recolhendo as mãos.
O quadro final adota a textura realista de documentário, mantendo o som do torno a girar, o atrito da argila úmida e o som ambiente do ateliê.
A referência de modelo branco se divide em modelo branco de granulação grosseira e modelo branco de granulação fina.
| Tipo | Situação adequada | Requisitos do material | Foco do prompt |
|------|----------|----------|------------|
| **Modelo branco de granulação grosseira** | Pré-visualizar ações, linhas de movimento, posições, movimentos de câmera ou cortes com geometrias simples | Relações geométricas claras, sequência de ações completa; é possível sobrepor imagens de pessoas, adereços e cenas | Mapear os sujeitos do modelo branco um a um e explicar quais informações de sequência e de espaço serão herdadas |
| **Modelo branco de granulação fina** | Já existe modelagem completa, e é necessário trocar pessoas, materiais, cores, cenas ou estilos | Estrutura do modelo completa e imagem limpa, evitando linhas de trajetória, eixos de coordenadas e cones de câmera | Manter estrutura, ações e tomadas, e definir claramente os atributos a re-renderizar |
O modelo branco de granulação grosseira é adequado para travar a trajetória das ações, a direção do movimento, a posição das pessoas, as entradas e saídas, o percurso da câmera, os pontos de corte, as mudanças de luz e sombra e o ritmo sonoro.
**Informações do modelo branco → o que precisa ser explicado**:
| Tipo de informação | Conteúdo a explicar |
|----------|----------|
| **Linha de movimento** | Trajetória das ações, direção do movimento, posição das pessoas e ordem de entrada e saída |
| **Movimento de câmera** | Posição da câmera, percurso da lente, direção do movimento e variações de velocidade |
| **Iluminação** | Direção da luz, mudanças de claro e escuro e o momento em que ocorrem |
| **Cortes** | Os pontos de corte e o sujeito e a composição antes e depois do corte |
| **Som** | Se diálogo, música, som ambiente ou efeitos sonoros de ação são herdados |
**Modelo básico**:
@vídeo1 é uma referência de modelo branco de granulação grosseira, fornecendo apenas <trajetória das ações, posição das pessoas, posição da câmera, movimento de câmera, cortes, mudanças de luz e sombra, ritmo sonoro ou relações espaciais>, sem adotar a aparência do modelo branco, os materiais e a cena.
<modelo branco de sujeito A> de @vídeo1 corresponde a <sujeito A>.
<modelo branco de sujeito B ou adereço geométrico> de @vídeo1 corresponde a <sujeito B ou adereço-chave>.
@imagem1 define <aparência, roupa ou estrutura> de <sujeito A>.
@imagem2 define <os atributos especificados> de <sujeito B, adereço-chave ou cena>.
<sujeito> completa <ação ou evento principal> em <cena>. Manter <trajetória das ações, posição, movimento de câmera, cortes, luz e sombra ou ritmo sonoro> de @vídeo1. O quadro final adota <pessoas, cena, materiais e estilo visual>, e o som inclui <diálogo, som ambiente ou efeito sonoro de ação>.**Exemplo**:
@vídeo1 é uma referência de modelo branco de granulação grosseira, fornecendo apenas o percurso de caminhada das pessoas, a direção do movimento do carro de exposição móvel, a posição fixa da câmera, uma aproximação da lente e dois cortes, sem adotar a aparência dos volumes geométricos cinza nem a cena vazia. O cilindro alto de @vídeo1 corresponde a <guia de exposição>. O paralelepípedo de @vídeo1 corresponde a <carro de exposição móvel>. @imagem1 define o rosto, o uniforme azul e o crachá de <guia de exposição>. @imagem2 define a estrutura de metal branco e a cobertura transparente de <carro de exposição móvel>. @imagem3 define a parede curva, o piso cinza e as luminárias lineares do teto do salão de exposição de tecnologia. <guia de exposição> empurra <carro de exposição móvel> avançando ao longo da parede curva, para em frente à vitrine central e abre a cobertura transparente. Manter o percurso de caminhada, a posição do sujeito, a direção da aproximação da lente e os pontos de corte de @vídeo1. O quadro adota o estilo brilhante e realista de documentário de salão de exposição, mantendo os sons dos passos, das rodas e o ambiente do salão.
O modelo branco de granulação fina já possui estrutura completa de pessoas, adereços ou cena, sendo adequado para trocar materiais, cores, a imagem dos personagens, a cena e o estilo visual geral. A imagem do modelo branco deve ser o mais limpa possível, sem manter marcas de produção, como linhas de trajetória, eixos de coordenadas, controles ou cones de câmera.
**Modelo básico**:
@vídeo1 é uma referência de modelo branco de granulação fina, mantendo <estrutura do sujeito, ações, disposição espacial, posição da câmera, movimento de câmera e cortes>, sem adotar o material de modelo cru original nem o fundo vazio.
@imagem1 define <imagem do personagem, material, cor ou detalhes de superfície> de <sujeito>.
@imagem2 define <espaço, material, luz ou estilo visual> de <cena>.
Re-renderizar <sujeito> de @vídeo1 como <sujeito final> e a cena como <cena final>. Manter <estrutura, ações, tomadas e relações espaciais> de @vídeo1; o quadro apresenta <materiais, cores e estilo>, e o som inclui <som ambiente, efeito sonoro ou música>.**Exemplo**:
@vídeo1 é uma referência de modelo branco de granulação fina, mantendo a estrutura completa da instalação anelar, a relação de rotação das três camadas de anéis, a posição da vitrine, o movimento circular da câmera e os cortes, sem adotar o material de modelo cru original nem o fundo vazio. @imagem1 define o material de latão escovado do anel externo da instalação. @imagem2 define o material de vidro azul semitransparente das lâminas internas. @imagem3 define as paredes curvas brancas, o piso cinza-escuro e a luz suave do teto do salão de arte contemporânea. Re-renderizar a instalação anelar de @vídeo1 como uma escultura dinâmica composta de latão e vidro azul, e a cena como salão de arte contemporânea. Manter a estrutura, o ritmo de rotação, o movimento circular da câmera e os cortes de @vídeo1, preservando o som grave e baixo da instalação a girar e o ambiente interno silencioso.
---
O vídeo completo em um clique é adequado para organizar várias imagens, ou imagens e vídeos de referência de estilo, em um vídeo completo com ritmo e embalagem visual unificados. O prompt precisa explicar a função de cada material, a ordem das imagens, a dinâmica do quadro, o ritmo de edição, a embalagem visual e o som; não basta escrever "transforme esses materiais em um vídeo".
**ORDEM: função dos materiais → ordem das imagens → amplitude da dinâmica → estilo de edição → embalagem visual → som**
[Função dos materiais]@imagem1 é usada para <pessoa, produto, cena ou quadro de abertura>. @imagem2 é usada para <pessoa, produto, cena ou quadro de processo>. @imagem3 é usada para <pessoa, produto, cena ou quadro de encerramento>. @vídeo1 é usado apenas para <ritmo de edição, transições, embalagem de legendas ou estilo musical>, sem adotar a identidade das pessoas e a cena (opcional).
[Forma de organização]As imagens aparecem conforme <ordem de upload, ordem especificada ou organização livre por tema>.<Explicar as relações entre pessoas, produtos, locais e eventos que devem ser mantidas>.
[Dinâmica do quadro]Cada imagem adota <efeito Live sutil, parallax, aproximação e afastamento, movimento lateral ou ação local>. Manter estáveis <aparência do sujeito, estrutura do produto, texto ou relações de fundo>.
[Estilo do vídeo final]Adotar <ritmo de edição, forma de transição, embalagem de legendas ou gráficos, estilo de cor>.
[Som]Incluir <diálogo, som ambiente, efeito sonoro ou música>.**Função dos materiais**
- @imagem1 é usada para a entrada do mercado noturno e o ambiente de abertura.
- @imagem2 é usada para o quadro de <viajante> caminhando pela rua.
- @imagem3 é usada para a barraca de lanternas e os detalhes do artesanato.
- @imagem4 é usada para os três amigos jantando à mesa.
- @imagem5 é usada para a paisagem noturna e o reflexo à beira do rio.
- @imagem6 é usada para o quadro de encerramento dos três tirando uma foto juntos na ponte.
- @vídeo1 é usado apenas para o ritmo de edição ágil, os adesivos desenhados à mão e a forma de transição, sem adotar a identidade das pessoas e o local.
**Forma de organização**
O quadro aparece na ordem de @imagem1 a @imagem6, formando o processo completo de "chegar ao mercado noturno, passear pela rua, jantar, caminhar e tirar foto". Manter estáveis a aparência e a roupa dos três amigos, sem misturá-los entre si.
**Dinâmica do quadro**
As imagens de ambiente adotam aproximação lenta e parallax sutil; as imagens das pessoas apenas acrescentam piscar natural, virar a cabeça, levantar o copo e roupas balançando ao vento. Manter estáveis a estrutura das barracas, a posição da mesa e a grade da ponte.
**Estilo do vídeo final**
Adotar o ritmo ágil de curta de viagem, conectando as cenas com oclusões naturais e cores próximas, e os adesivos desenhados à mão aparecem apenas nas bordas do quadro.
**Som**
Manter as vozes do mercado noturno, o som leve dos utensílios e o vento à beira do rio, acompanhando uma música instrumental ágil, porém discreta.
**Atenção**: quando a ordem das imagens for importante, deve-se escrever a ordem de aparição imagem por imagem; quando se permite que o modelo organize livremente, também é preciso escrever claramente "pode-se organizar livremente por tema". Quando há várias pessoas ou vários produtos, ainda é necessário nomear um a um e vincular aos materiais.
---
A transição contínua de vídeo é a geração de conteúdo de transição contínuo entre dois vídeos. O prompt precisa primeiro explicar qual é o vídeo antes da transição e qual é o vídeo depois, e depois escrever claramente a ação de gatilho, o movimento de câmera, como o quadro muda, o estado final alcançado e a conexão do som.
**ORDEM: vídeo antes da transição → vídeo depois da transição → ação de gatilho → movimento de câmera → deformação do quadro → estado alcançado → som**
| Tipo de transição | Foco de escrita |
|----------|----------|
| **Mergulho ou retorno** | Explicar a direção da câmera, as variações de velocidade e quando entrar na próxima cena |
| **Rotação da pessoa** | Explicar a postura da pessoa, a direção da rotação e como a roupa ou o fundo muda de forma contínua |
| **Oclusão pelo primeiro plano** | Explicar quando o elemento de oclusão cobre toda a tela e a composição que aparece após a oclusão |
| **Deformação de objeto** | Explicar a forma, o material e o processo de deformação correspondentes entre os objetos antes e depois |
| **Aproximação, afastamento ou mudança de foco** | Explicar o movimento de câmera, o objeto em foco e a relação contínua entre os espaços antes e depois |
@vídeo1 é o segmento antes da transição, adotando seu <sujeito final, ação, composição, direção de câmera e som>.
@vídeo2 é o segmento depois da transição, adotando seu <sujeito inicial, composição, direção de câmera e som>.
Manter estáveis <identidade das pessoas, estrutura do produto, cena e ações principais> nos segmentos originais de @vídeo1 e @vídeo2.
Na parte final de @vídeo1, <sujeito ou elemento em primeiro plano> aciona a transição por meio de <ação>. A câmera <muda de direção e velocidade>, e <formas, materiais, luz ou espaço> do quadro mudam gradualmente para <os elementos correspondentes> do início de @vídeo2. Ao fim da transição, chega-se naturalmente à composição inicial de @vídeo2, mantendo contínuos <posição do sujeito, direção da câmera e tendência de movimento>.
O som transita suavemente de <som da parte inicial> para <som da parte final>.@vídeo1 é o segmento antes da transição, adotando a rua chuvosa à noite, o guarda-chuva vermelho, a câmera aproximando-se lentamente para a frente e o som da chuva. @vídeo2 é o segmento depois da transição, adotando a claraboia circular do salão de exposição, a câmera elevando-se e a reverberação ambiente silenciosa. Manter estáveis as pessoas, a rua, a estrutura do salão e as ações principais dos dois vídeos originais. Na parte final de @vídeo1, o guarda-chuva vermelho aproxima-se da câmera e cobre gradualmente todo o quadro, acionando a transição. A câmera continua avançando, a borda circular do guarda-chuva transforma-se gradualmente no anel metálico da claraboia do salão, e a superfície vermelha do guarda-chuva transita gradualmente para a luz branca do dia que penetra pela claraboia. Ao fim da transição, chega-se naturalmente à composição em contra-plongée do início de @vídeo2, com a câmera passando suavemente do avanço para frente à elevação para cima. O som da chuva diminui gradualmente e transita suavemente para o eco dos passos no salão.
**Atenção**: o objetivo da transição contínua é conectar naturalmente o visual e o som. O prompt pode exigir manter os conteúdos principais dos dois vídeos originais, mas a transição gerativa não deve ser entendida como uma emenda de edição que mantém pixel a pixel inalterado.
---
Escrever apenas palavras de emoção, como "tensão", "aconchego", "opressão", permite que o modelo entenda a direção geral, mas deixa mais margem para o modo específico de atuação. Se houver a intenção de controlar com estabilidade a atuação das pessoas, recomenda-se escrever manifestações diretamente visíveis ou audíveis, como olhar, sobrancelhas, canto da boca, respiração, linha do olhar e movimentos das mãos.
Não é necessário listar todos os detalhes faciais. Em uma única virada emocional, costuma-se escolher de 2 a 4 manifestações mais claras; somente quando a emoção contém várias viradas é que se descreve em etapas, conforme os eventos de gatilho.
A emoção geral muda de <emoção inicial> para <emoção final>. Após ocorrer <evento de gatilho>, <sujeito> primeiro apresenta <reação imediata observável>. Em seguida, <olhar, sobrancelhas, canto da boca, respiração, linha do olhar ou movimentos das mãos> mudam gradualmente <de que forma>. Por fim, <sujeito> expressa <emoção-alvo> por meio de <manifestação externa contida ou explícita>.Ao ouvir ou ver <o primeiro evento de gatilho>, <a primeira reação observável do sujeito>. Quando <o segundo evento de gatilho> aparece, <as mudanças na expressão, na linha do olhar ou na respiração do sujeito>. Após confirmar <informação-chave>, <a emoção que o sujeito tenta conter ou esconder> surge gradualmente por meio de <manifestação observável>. Por fim, <a ação, a expressão ou o modo de falar final do sujeito>.Atrás do palco, chegam os aplausos do fim da apresentação. Os dedos da jovem atriz que seguram o programa de mão param de repente, o olhar vira-se lentamente para a direção do pano de fundo e os ombros continuam tensos. Após confirmar o agradecimento final, ela primeiro solta um leve suspiro, os ombros relaxam aos poucos, um sorriso contido aparece no canto da boca, os olhos vão se enchendo de lágrimas aos poucos, mas ela nunca se vira para sair.
---
A linguagem básica de tomadas e os movimentos de câmera populares podem ser escritos diretamente no prompt. Quando o termo for pouco conhecido, puder ter múltiplas interpretações ou exigir controle preciso da mudança do quadro, deve-se explicar também sobre quem o termo atua, como o quadro muda e o resultado que se espera ver.
| Categoria | Termos |
|------|------|
| **Planos** | Plano geral amplo, plano geral, plano médio, plano próximo, close-up |
| **Movimento de câmera** | Aproximar, afastar, panorâmica, deslocamento, seguimento, giro em torno, mergulho, recuo, panorâmica para cima, câmera na mão com tremor |
| **Posição da câmera e perspectiva** | Ângulo baixo, vista de cima, primeira pessoa |
| Movimento de câmera | Escrita recomendada |
|----------|----------|
| **Plano-sequência** | Explicar o sujeito, o espaço e a sequência de eventos pelos quais a câmera passa de forma contínua |
| **Zoom de Hitchcock** | Explicar o tamanho que o sujeito mantém e o efeito do fundo espacial sendo aproximado ou afastado |
| **Perspectiva aérea** | Explicar a altura do olhar de cima, a direção do movimento e o alcance do ambiente a ser mostrado |
| **FPV** | Explicar o percurso de voo ou de passagem em primeira pessoa, a velocidade e as curvas |
| **Bullet time** | Explicar a ação que é congelada ou desacelerada e a direção do giro da câmera |
| **Câmera na mão** | Explicar o objeto seguido e o grau de tremor, evitando que haja apenas "sensação de câmera na mão" sem alvo para a câmera |
| **Retrocesso e mudança de velocidade** | Explicar em que ponto a ação acelera, desacelera ou retrocede, e o estado final em que permanece |
Para termos demasiadamente de nicho, cujo significado na indústria não seja unificado ou que o modelo possa não conhecer, deve-se manter o nome do termo e, ao mesmo tempo, traduzi-lo em mudanças de quadro diretamente observáveis.
**FÓRMULA: termo profissional + sujeito sobre o qual atua + mudança do quadro + relação primeiro plano/fundo + direção ou velocidade**
**Exemplo**:
Mudança de foco (rack focus): o foco desliza suavemente das folhas em primeiro plano para a pessoa ao fundo. As folhas ficam gradualmente desfocadas, e o rosto da pessoa ao fundo passa de embaçado a nítido.
---
---
---
Os exemplos deste guia servem apenas para ilustrar a escrita dos prompts. Os resultados de geração reais podem ser afetados pelos materiais de entrada, pela complexidade da tarefa e pelos parâmetros de geração.
The commercial guide route contains the Sunday blog experience under a clearer public URL for users looking for practical AI video business workflows.
Dynamic guide articles load in the client app, while static HTML gives crawlers a stable index page.
The route frames commercial video creation around usable prompts, platform formats, and production outcomes.
Creators can study how reference images, product shots, and delivery formats fit together before generating.
Static HTML makes the guide hub readable even when the full article list is loaded client-side.
It covers ad prompts, product demos, monetization workflows, creator offers, and repeatable media pipelines that can be reused in Seedance.
Guide pages often target search-driven traffic, so route summaries and business-use context should be visible directly in source HTML.