Glossário
Video generation
Também conhecido como: AI video, video synthesis
Criação por IA de clipes de vídeo a partir de prompts de texto, imagens de referência ou ambos. O resultado normalmente é um clipe curto (5-10 segundos) em resolução fixa.
Em detalhe
O que significa na prática
A geração de vídeo por IA é um campo mais jovem do que a geração de imagens por IA, com os primeiros modelos comercialmente viáveis (Runway Gen-2, Pika, Kling 1.0) surgindo em 2023-2024. A geração de 2025-2026 (Sora 2, Kling v2.6 Pro, Veo 3.1) atinge qualidade próxima de 1080p em durações de 5 a 10 segundos.
A duração continua sendo a principal limitação. A janela de 10 segundos do Sora 2 é o resultado de corte único mais longo disponível; a maioria dos outros modelos para em 5 segundos. Para durações maiores, você emenda clipes, o que adiciona cortes visíveis. A geração de vídeo também custa substancialmente mais por segundo de resultado do que a geração de imagens — o preço típico é de 10 a 80× maior por unidade de saída.
Relacionado
Image-to-video
Um modo de geração em que a entrada é uma imagem estática e a saída é um vídeo que anima essa imagem. Frequentemente combinado com um prompt de texto descrevendo o movimento desejado.
Text-to-image
Um modo de geração em que a entrada é texto (o prompt) e a saída é uma imagem. O modo de geração de imagens por IA mais comum.
Aspect ratio
A proporção entre largura e altura de uma imagem ou vídeo gerado. Proporções comuns: 1:1 (quadrado), 9:16 (vertical / TikTok / Reels), 16:9 (horizontal / YouTube), 4:5 (retrato do Instagram), 3:4 (vertical editorial).