Prompt para geração de vídeo com IA
Gere clipes de vídeo cinematográficos com IA usando um prompt detalhado e pronto para Veo, Runway, Kling, Pika e Luma.
Prompt pronto para copiar
Crie um prompt de texto-para-vídeo para [ferramenta: Veo/Runway/Kling/Pika/Luma]. Sujeito e ação: [quem ou o quê, e exatamente o que faz]. Cenário e hora do dia: [local, clima, manhã/hora dourada/noite]. Enquadramento e movimento de câmera: [aberto/médio/close; estático, dolly-in lento, órbita, travelling, câmera na mão]. Iluminação e cor: [luz suave do dia, néon, tungstênio quente; paleta de cores ou clima]. Estilo e renderização: [live-action cinematográfico, filme 35mm, animação 3D, anime, hiper-realista]. Proporção: [16:9 / 9:16 / 1:1]. Duração: [segundos]. Escreva como um único parágrafo fluido e específico. Coloque o sujeito e a ação no início, depois acrescente cenário, câmera, iluminação e estilo. Evite adjetivos vagos; nomeie detalhes visuais concretos.
Quer uma versão sob medida?
Responda a algumas perguntas rápidas e o Gerador de prompts de vídeo com IA criará um prompt personalizado com seus dados exatos.
🎬 Abrir o Gerador de prompts de vídeo com IAPor que a linguagem visual específica supera os prompts vagos
Os modelos de texto-para-vídeo só são tão bons quanto o quadro que você pinta para eles. Um prompt como "uma cena urbana legal" dá ao modelo quase nada em que se ancorar, então ele preenche as lacunas com o que é estatisticamente médio — uma rua sem graça, iluminação plana, uma câmera sem rumo. O resultado parece genérico porque as instruções foram genéricas. O modelo acima corrige isso ao fazer você se comprometer com escolhas concretas. Em vez de "uma pessoa caminhando", você escreve "uma mulher de capa de chuva vermelha atravessando com passos rápidos uma faixa de pedestres molhada". Em vez de "boa iluminação", você nomeia "luz quente de poste refletindo nas poças ao entardecer". Cada substantivo e verbo específico estreita o espaço de saídas possíveis em direção à tomada que você realmente tem em mente. A melhoria mais confiável que você pode fazer em qualquer prompt de vídeo é substituir adjetivos abstratos por detalhes visuais observáveis para os quais um diretor de fotografia poderia apontar a câmera.
As pistas de câmera e movimento são o que dá sensação de filmado
A diferença entre um clipe que parece uma foto em movimento e um que parece filmagem real está quase sempre na câmera. Os modelos de vídeo com IA respondem fortemente à linguagem de enquadramento e movimento, então o modelo pede que você indique os dois. O enquadramento define a escala: um plano aberto estabelece um local, um plano médio mostra a linguagem corporal, um close entrega emoção ou detalhe de produto. O movimento dá vida à tomada: um dolly-in lento cria intimidade, uma órbita revela dimensão, um travelling acompanha a ação e a câmera na mão acrescenta energia documental. Nomear tudo isso explicitamente — "aproximação lenta no rosto do sujeito" em vez de deixar sem especificar — diz ao modelo como o quadro deve evoluir ao longo do clipe. Mantenha o movimento simples e único para durações curtas; pedir um dolly, uma órbita e um movimento de grua em um único clipe de três segundos normalmente produz um resultado confuso e distorcido.
Iluminação, clima e cor carregam a emoção
A iluminação é a maneira mais rápida de definir o tom e é o detalhe que a maioria das pessoas deixa de fora. O mesmo sujeito lê-se de forma completamente diferente sob luz suave de dia nublado, sol duro do meio-dia, luz interior quente de tungstênio ou néon frio. O modelo pede que você nomeie a fonte e a qualidade da luz, mais a hora do dia, porque "hora dourada", "hora azul" e "sol a pino" cada uma implica toda uma paleta e um comportamento de sombra que o modelo já entende. A direção de cor reforça o clima: uma paleta âmbar e quente parece nostálgica, teal-e-laranja parece cinematográfica e moderna, cinzas dessaturados parecem sombrios. Indique o clima que você quer em termos visuais — "sombrio e cinematográfico com sombras profundas" — em vez de abstrações emocionais que o modelo não consegue renderizar diretamente. Quando iluminação, paleta e hora do dia concordam entre si, o clipe se lê como uma tomada deliberada e coerente.
Itere uma variável por vez e conheça sua ferramenta
A geração de vídeo é inerentemente um ciclo, não um tiro único. Quando um clipe está quase certo, mas não perfeito, resista à vontade de reescrever o prompt inteiro. Mude uma variável — troque o movimento de câmera, ou a hora do dia, ou a sensação de lente — e gere de novo, para que você veja o que aquela única mudança fez. Essa abordagem disciplinada transforma um caça-níquel em um processo controlável e leva você à tomada pretendida muito mais rápido. Também ajuda lembrar que as ferramentas diferem. O Google Veo tende à física realista e ao áudio coerente; o Runway dá controle fino e forte estilização; o Kling lida bem com movimentos complexos e tomadas mais longas; o Pika é rápido e flexível para clipes estilizados; e o Luma se destaca em movimentos de câmera suaves e oníricos. Um prompt afinado para uma pode precisar de pequenos ajustes em outra, então trate a primeira geração como um rascunho e itere deliberadamente rumo ao resultado.
Por que este prompt funciona
As ferramentas de vídeo com IA transformam texto em movimento, então prompts vagos produzem clipes genéricos e sem rumo. Este modelo obriga você a especificar sujeito, câmera, iluminação, estilo, proporção e duração logo de início — as pistas exatas de que o modelo precisa para renderizar uma tomada que pareça intencional em vez de aleatória.
Como personalizar
- Coloque o sujeito e a ação no início, depois acrescente cenário, câmera e luz.
- Use um movimento de câmera claro por clipe curto para evitar distorções.
- Itere mudando uma única variável para ver o que cada mudança faz.
Exemplo de resultado
Apenas um exemploObjetivo: Um plano geral cinematográfico de um caminhante solitário ao nascer do sol (Veo, 16:9, 5 segundos).
Prompt:
Um caminhante solitário com uma jaqueta laranja gasta está sobre uma crista rochosa ao nascer do sol, com a névoa preenchendo o vale abaixo. Plano aberto cinematográfico com um dolly-in lento em direção à figura. Luz suave de hora dourada varre as rochas, paleta âmbar e quente contra sombras azuis e frias. Visual de filme 35mm, profundidade de campo rasa, granulação suave. Proporção 16:9, 5 segundos.
O que produz: Um clipe estável e cinematográfico que abre na paisagem e avança lentamente rumo ao caminhante enquanto a luz quente pega a crista. Como o sujeito, o movimento de câmera, a iluminação, a paleta e o estilo de filme são todos nomeados, o modelo renderiza um plano geral coerente em vez de uma cena de montanha genérica e sem rumo.
Observação: O único dolly-in lento mantém o movimento limpo ao longo de cinco segundos; acrescentar uma órbita ou uma grua por cima provavelmente distorceria a geometria.
Variações de prompt para testar
Clipe vertical para redes sociais
Crie um prompt de texto-para-vídeo 9:16 para [ferramenta] feito para um feed de redes sociais. Sujeito e ação: [o que acontece]. Mantenha-o impactante e a tela toda, com o sujeito centralizado para visualização vertical. Cenário e hora do dia: [onde, quando]. Câmera: em geral estática ou uma leve aproximação para que o sujeito continue legível no celular. Iluminação e cor: [claro e limpo, ou néon sombrio]. Estilo: [live-action/animação]. Proporção 9:16, [3-6] segundos. Escreva como um único parágrafo específico e coloque o momento mais chamativo no primeiro segundo.
Tomada de B-roll de produto
Escreva um prompt de texto-para-vídeo para [ferramenta] para um clipe de B-roll de produto limpo. Produto: [nome e características visuais principais]. Câmera: órbita lenta ou dolly-in macro que revela a forma e a textura do produto. Cenário: superfície minimalista com iluminação de estúdio suave e fundo raso. Iluminação e cor: luz principal suave com um leve destaque de contorno, [paleta]. Estilo: fotografia comercial hiper-realista em movimento. Proporção [16:9 ou 1:1], [4-6] segundos. Mantenha o movimento único e suave para que o produto permaneça nítido e sem distorções.
Estilo animado / anime
Escreva um prompt de texto-para-vídeo para [ferramenta] em estilo [anime 2D / animação 3D]. Sujeito e ação: [personagem e o que faz]. Cenário e hora do dia: [onde, quando]. Enquadramento e movimento de câmera: [plano geral, depois uma panorâmica lenta]. Iluminação e cor: [descreva a paleta e o clima, por exemplo tons quentes de pôr do sol com cel shading suave]. Estilo e renderização: [visual pintado à mão estilo Studio Ghibli / 3D moderno e limpo]. Proporção [16:9], [4-6] segundos. Enfatize um movimento de personagem expressivo e um estilo de arte consistente ao longo do clipe.
Erros comuns a evitar
- Escrever adjetivos vagos em vez de detalhes visuais. "Bela cena cinematográfica" não dá ao modelo nada para renderizar. Nomeie o sujeito, a ação e a luz em termos concretos e observáveis.
- Deixar a câmera de fora. Sem pistas de enquadramento e movimento, o clipe parece uma foto em movimento. Indique um tamanho de plano e um único movimento como
dolly-in lentoouórbita. - Empilhar movimentos de câmera demais em um clipe curto. Um dolly mais uma órbita mais uma grua em três segundos distorce a imagem. Use um movimento claro por tomada curta.
- Esquecer a proporção e a duração. Um prompt 16:9 fica errado cortado para um feed vertical. Sempre defina a proporção e a duração para combinar com onde o clipe será usado.
- Esperar que um prompt funcione identicamente entre ferramentas. Veo, Runway, Kling, Pika e Luma diferem. Trate a primeira saída como um rascunho e itere uma variável por vez.
Perguntas frequentes
Com qual ferramenta de vídeo com IA devo usar este prompt?
Funciona com qualquer modelo moderno de texto-para-vídeo. O Google Veo tende ao realista com áudio coerente, o Runway oferece controle fino e estilização, o Kling lida com movimentos complexos, o Pika é rápido e flexível, e o Luma dá movimentos de câmera suaves. Comece com o que você tiver acesso e ajuste pequenos detalhes para essa ferramenta.
Qual deve ser a duração de um clipe gerado por IA?
Clipes curtos de três a seis segundos são os mais confiáveis, porque o modelo precisa manter o movimento e a geometria estáveis em cada quadro. Para sequências mais longas, gere várias tomadas curtas e edite-as juntas em vez de pedir uma única tomada longa, que tem mais chance de derivar ou distorcer.
Por que meu vídeo aparece distorcido ou com aparência de metamorfose?
Normalmente o prompt pediu movimento demais de uma vez, ou o sujeito e o movimento de câmera brigaram entre si. Simplifique para um único movimento de câmera claro, mantenha a ação única e encurte a duração. Gerar de novo com um único movimento mais simples quase sempre estabiliza o resultado.
Preciso de uma imagem de referência?
Não necessariamente. Um prompt de texto detalhado pode produzir resultados fortes por conta própria. Dito isso, muitas ferramentas aceitam uma imagem inicial, e usar uma dá controle mais firme sobre o sujeito e o enquadramento. Se a consistência importa, gere ou escolha uma imagem primeiro e depois anime-a com um prompt de câmera e movimento.
Dica: substitua as partes entre [colchetes] pelas suas próprias informações antes de enviar. Quanto mais preciso você for — público, tom, objetivo, restrições — melhor será o resultado da IA.