Guias
Como escrever prompt de vídeo com IA: guia com 8 exemplos

Um bom prompt de vídeo com IA descreve cinco coisas, nesta ordem: sujeito, ação, cenário, luz e câmera. Você pode escrever em português, como falaria com alguém que vai filmar a cena. Quanto mais claro for cada elemento, menos o modelo precisa adivinhar, e mais perto do que você imaginou o vídeo fica.
A estrutura em cinco partes
- Sujeito: quem ou o que aparece. "Uma rendeira", "um cachorro caramelo", "uma garrafa de vidro".
- Ação: o que acontece. "Trabalha com bilros", "corre pela praia", "gira devagar".
- Cenário: onde e quando. "Varanda de casa de praia, fim de tarde", "rua molhada à noite".
- Luz: a atmosfera. "Luz dourada", "neon verde", "contraluz", "luz suave de janela".
- Câmera: como vemos a cena. "Travelling lateral lento", "câmera baixa", "close". (Veja o vocabulário completo em movimentos de câmera em prompts de vídeo.)
Você não precisa usar as cinco sempre, mas quando algo sai diferente do esperado, quase sempre é uma delas que faltou.
8 exemplos em português
Cada exemplo mostra um estilo diferente. Use como ponto de partida e troque sujeito e cenário pelos seus.
1. Paisagem com câmera acompanhando
Um astronauta caminha devagar pelas dunas dos Lençóis Maranhenses ao entardecer,
entre lagoas azul-turquesa. Câmera baixa acompanhando de lado, lente anamórfica.
2. Cena documental
Um pescador idoso de pele queimada de sol rema uma canoa de madeira num rio
amazônico ao amanhecer. Névoa sobre a água, luz dourada, travelling lateral lento.
3. Cultura e festa
Passista com fantasia de penas dança sob luz neon verde, fumaça no ar.
A câmera gira ao redor dela em movimento circular.
4. Produto
Uma garrafa de vidro com água sobre uma bancada de mármore branco.
Gotas escorrem pela superfície. Câmera em close gira devagar, luz suave de estúdio.
5. Animal
Um cachorro caramelo corre pela areia molhada de uma praia ao pôr do sol,
espirrando água. Câmera baixa, acompanhando de frente, luz alaranjada.
6. Cidade à noite
Rua estreita de uma cidade litorânea à noite, chuva fina, letreiros luminosos
refletidos no asfalto. Uma pessoa de capa amarela atravessa a rua. Plano aberto, câmera fixa.
7. Cozinha
Mãos preparam massa de pão sobre uma bancada de madeira, farinha no ar.
Luz quente de janela lateral. Close, câmera se aproxima devagar.
8. Natureza vista do alto
Vista aérea de uma cachoeira cercada por mata densa, neblina subindo.
Drone avançando devagar em direção à queda, luz do meio da manhã.
Como ler esses exemplos
- Todos têm uma ação principal. Nenhum pede cinco coisas ao mesmo tempo.
- A luz está sempre dita, porque ela muda o clima do vídeo inteiro.
- A câmera tem um movimento (ou diz que é fixa), o que dá intenção ao enquadramento.
- Nenhum depende de texto escrito na tela, que os modelos ainda fazem mal.
Erros comuns
- Cena lotada. Pedir "uma multidão corre, um carro explode e um avião passa" divide a atenção do modelo. Prefira uma ação clara por vídeo.
- Palavras vagas. "Bonito", "incrível" e "cinematográfico" sozinhos dizem pouco. Diga o que é bonito: a luz, a cor, a composição.
- Esquecer a câmera. Sem instrução, o modelo escolhe por você. Se quer um movimento, peça.
- Misturar estilos que brigam. "Desenho infantil e ultrarrealista" confunde. Escolha uma direção.
- Depender de texto na tela. Letreiros, legendas e logotipos escritos costumam sair com erro. Acrescente depois, na edição.
- Pedir pessoas reais. Não peça celebridades, políticos ou conhecidos. Os Termos proíbem deepfake de pessoa real sem consentimento.
- Mudar tudo a cada tentativa. Troque uma coisa por vez para entender o efeito de cada palavra.
Um método para melhorar
- Escreva o pedido com as cinco partes.
- Gere em um modelo econômico, com duração curta, para gastar menos. O guia quanto custa gerar vídeo com IA mostra como.
- Ajuste uma parte (por exemplo, a luz) e gere de novo.
- Quando estiver bom, gere a versão final no modelo que preferir. A página Comparar modelos mostra o mesmo pedido em oito deles.
Prompt longo ou curto?
Não existe número mágico. Um pedido de duas ou três frases, com as cinco partes, costuma ser suficiente. Textos muito longos aumentam as chances de o modelo ignorar partes. Se o seu pedido tem várias cenas, divida em vários vídeos e junte depois.
Exemplo de evolução de um prompt
Veja como um pedido melhora, uma parte de cada vez.
Primeira versão, fraca:
Um cachorro na praia.
Segunda versão, com ação e cenário:
Um cachorro caramelo corre pela areia molhada de uma praia ao pôr do sol.
Terceira versão, com luz e câmera:
Um cachorro caramelo corre pela areia molhada de uma praia ao pôr do sol,
espirrando água. Luz alaranjada, câmera baixa acompanhando de frente.
A diferença entre a primeira e a terceira está só em informação: nada de truque nem de palavra mágica. O modelo faz melhor quando tem menos coisas para inventar.
Português funciona?
Funciona. Se tiver curiosidade sobre o assunto, leia também prompt em português funciona.
Perguntas frequentes
Posso escrever o prompt em português?
Sim. O GenBrasil foi feito para você escrever em português, como fala. O que importa é a clareza da descrição, não o idioma.
Preciso dizer o movimento de câmera?
Não é obrigatório, mas ajuda muito. Sem instrução, o modelo escolhe a câmera por conta própria. Dizer "câmera fixa" também é uma instrução válida.
O mesmo prompt sempre gera o mesmo vídeo?
Não. O resultado varia de uma geração para outra, mesmo com o pedido idêntico. Por isso vale gerar mais de uma vez e escolher a melhor versão.


