Glossário
Text-to-image
Também conhecido como: T2I, txt2img
Um modo de geração em que a entrada é texto (o prompt) e a saída é uma imagem. O modo mais comum de geração de imagem por IA.
Em detalhe
O que significa na prática
O text-to-image é o modo por omissão na maioria dos modelos de imagem. O modelo recebe uma descrição escrita e produz uma imagem que lhe corresponde. O Nano Banana 2 suporta text-to-image no hilens, estando anunciado o HiDream-O1-image-1.5 para se seguir.
O text-to-image contrasta com o image-to-image (a entrada é uma imagem existente mais um prompt opcional e o modelo produz uma versão modificada) e com o image-to-video (a entrada é uma imagem e o modelo produz um vídeo). O mesmo modelo suporta frequentemente vários modos através de diferentes definições de parâmetros em vez de modelos distintos.
Relacionado
Prompt
A instrução de texto dada a um modelo de IA que descreve o que gerar. Para modelos de imagem e vídeo, os prompts combinam descrição do tema, direção de estilo, indicações de câmara ou composição e prompts negativos opcionais.
Image-to-video
Um modo de geração em que a entrada é uma imagem estática e a saída é um vídeo que anima essa imagem. Frequentemente combinado com um prompt de texto que descreve o movimento pretendido.
Reference image
Uma imagem carregada juntamente com o prompt para condicionar a geração. O modelo preserva propriedades visuais — composição, paleta de cores, semelhança do tema, enquadramento — da referência no resultado.