Como usar Gerador de vídeo com IA multimodal
Crie vídeos com IA a partir de um prompt e de uma imagem ou vídeo de referência num fluxo multimodal.
- Referência visual Use <Picture 1>, <Video 1> e <Audio 1> no prompt. Clique numa etiqueta para a inserir. O vídeo fornece apenas imagem e movimento; envie o áudio separadamente.
- Descrição do vídeo Descreva a cena, o movimento e o visual pretendido...
- Inicie o processamento Execute a ferramenta e deixe-a processar o arquivo.
- Baixe o resultado Pronto! Seu vídeo gerado por IA está pronto para download.
Por que as pessoas usam esta ferramenta
- Os prompts e resultados não são armazenados.
- Anônimo e privado.
- Com modelos de IA premium.
- Fluxo de trabalho rápido e simples.
FAQ - Gerador de vídeo com IA multimodal
- O que é a geração multimodal de vídeo por IA e como funciona a ferramenta?
- A geração multimodal de vídeo por IA combina um prompt textual descritivo com referências visuais e acústicas (imagens, vídeos e áudio). Em vez de depender apenas de palavras ou de uma única imagem estática, o modelo de IA avalia múltiplas entradas de mídia em simultâneo para definir personagens, movimentos de câmara, composição de cena e ambiente com grande precisão num vídeo de alta definição.
- Como utilizar tags de referência como <Picture 1>, <Video 1> e <Audio 1> no prompt?
- Ao carregar arquivos de referência, eles são numerados sequencialmente. No prompt, pode digitar tags como <Picture 1>, <Video 1> ou <Audio 1> (ou inseri-las clicando no badge correspondente). Especifique à IA o papel de cada referência, por exemplo: "A personagem de <Picture 1> caminha pela cidade com o movimento de câmara de <Video 1>". Os vídeos guiam o movimento e enquadramento visual; os ficheiros de áudio orientam a atmosfera sonora.
- Quais formatos e tamanhos de ficheiro são suportados nos envios?
- Pode carregar até 3 imagens (JPG, PNG ou WebP até 10 MB cada), 1 vídeo de referência (MP4, WebM ou MOV de 2 a 10 segundos, até 30 MB) e até 2 faixas de áudio (MP3, WAV, M4A, FLAC ou OGG até 10 MB). O limite total acumulado de todos os ficheiros de referência é de 32 MB.
- Qual é a diferença em relação a texto-para-vídeo ou imagem-para-vídeo convencional?
- No texto-para-vídeo clássico, a IA tem de adivinhar todo o aspeto e movimento apenas com base em palavras. No imagem-para-vídeo, anima-se habitualmente uma única fotografia estática. A abordagem multimodal une as duas abordagens: define o visual de personagens com imagens, orienta a dinâmica de movimento através de um vídeo de exemplo e refina tudo com texto e áudio para controlo e consistência máximos.
- Como são determinados o formato de ecrã e a resolução do vídeo?
- A ferramenta ajusta automaticamente a proporção de ecrã com base na referência de imagem ou vídeo enviada para manter o enquadramento ideal. Em alternativa, pode escolher rácios padrão nas configurações, tais como ecrã panorâmico (16:9), vertical para Reels, TikTok e Shorts (9:16), quadrado (1:1) ou 4:3.
- Quantos créditos custa a geração e como funciona a cobrança?
- O preço é calculado no servidor: sem referência de vídeo, 90 créditos + 5 créditos por cada segundo adicional iniciado após 3 segundos, +10 com pelo menos uma imagem e +5 por cada referência de áudio independente. Com referência de vídeo, são 150 créditos +10 por cada segundo adicional iniciado após 3 segundos, +5 com pelo menos uma imagem e por cada referência de áudio. A duração é de 3–10 segundos. Exemplo: 10 segundos com referência de vídeo custam 220 créditos. O preço exato aparece no botão antes de iniciar; não são cobrados créditos se o pedido falhar ou for cancelado.
- Quanto tempo demora a geração e qual o formato do vídeo final?
- Como os modelos multimodais realizam cálculos avançados e sincronizam várias fontes de mídia, o processo costuma demorar cerca de 2 a 4 minutos. O ficheiro final é disponibilizado em formato MP4 de alta qualidade, pronto para reprodução imediata no navegador e transferência direta.
- Posso utilizar os vídeos de IA gerados para fins comerciais?
- Sim, todos os vídeos criados com créditos premium podem ser utilizados livremente em projetos comerciais, redes sociais, YouTube, campanhas publicitárias e materiais profissionais, de acordo com os nossos termos de serviço.
- Meus dados e mídias geradas são armazenados?
- Não. Para proteger sua privacidade, todas as mídias e prompts enviados são transmitidos temporariamente para processamento, excluídos imediatamente após a conclusão e não são armazenados em nossos servidores. Ninguém além de você as verá. Seu histórico de chat e todos os resultados gerados são armazenados exclusivamente de forma local em seu navegador em seu próprio dispositivo.
Ferramenta indisponível no momento
Esta ferramenta foi desativada temporariamente. Em breve estará de volta — até lá, aproveite as nossas outras ferramentas.