Glossário
Video generation
Também conhecido como: AI video, video synthesis
Criação por IA de clipes de vídeo a partir de prompts de texto, imagens de referência, ou ambos. A saída é tipicamente um clipe curto (5-10 segundos) com resolução fixa.
Em detalhe
O que significa na prática
A geração de vídeo por IA é um campo mais jovem do que a geração de imagem por IA, tendo os primeiros modelos comercialmente viáveis (Runway Gen-2, Pika, Kling 1.0) surgido em 2023-2024. A geração de 2025-2026 (Sora 2, Kling v2.6 Pro, Veo 3.1) atinge qualidade próxima de 1080p em durações de 5-10 segundos.
A duração continua a ser a restrição dominante. A janela de 10 segundos do Sora 2 é a saída de corte único mais longa disponível; a maioria dos outros modelos limita-se a 5 segundos. Para durações maiores é preciso juntar clipes, o que acrescenta cortes visíveis. A geração de vídeo também custa substancialmente mais por segundo de saída do que a geração de imagem — o preço típico é 10-80× superior por unidade de saída.
Relacionado
Image-to-video
Um modo de geração em que a entrada é uma imagem estática e a saída é um vídeo que anima essa imagem. Frequentemente combinado com um prompt de texto que descreve o movimento pretendido.
Text-to-image
Um modo de geração em que a entrada é texto (o prompt) e a saída é uma imagem. O modo mais comum de geração de imagem por IA.
Aspect ratio
A proporção entre largura e altura de uma imagem ou vídeo gerado. Proporções comuns: 1:1 (quadrado), 9:16 (vertical / TikTok / Reels), 16:9 (horizontal / YouTube), 4:5 (Instagram retrato), 3:4 (vertical editorial).