Glossário
Text-to-image
Também conhecido como: T2I, txt2img
Um modo de geração em que a entrada é texto (o prompt) e a saída é uma imagem. O modo de geração de imagens por IA mais comum.
Em detalhe
O que significa na prática
O text-to-image é o padrão da maioria dos modelos de imagem. O modelo recebe uma descrição escrita e produz uma imagem correspondente. O Nano Banana 2 oferece suporte a text-to-image na hilens, com o HiDream-O1-image-1.5 anunciado para vir em seguida.
O text-to-image contrasta com o image-to-image (a entrada é uma imagem existente mais um prompt opcional, e o modelo produz uma versão modificada) e com o image-to-video (a entrada é uma imagem, e o modelo produz um vídeo). O mesmo modelo muitas vezes oferece suporte a vários modos por meio de diferentes configurações de parâmetros, em vez de modelos distintos.
Relacionado
Prompt
A instrução em texto dada a um modelo de IA que descreve o que gerar. Para modelos de imagem e vídeo, os prompts misturam descrição do sujeito, direção de estilo, dicas de câmera ou composição e prompts negativos opcionais.
Image-to-video
Um modo de geração em que a entrada é uma imagem estática e a saída é um vídeo que anima essa imagem. Frequentemente combinado com um prompt de texto descrevendo o movimento desejado.
Reference image
Uma imagem enviada junto com o prompt para condicionar a geração. O modelo preserva propriedades visuais — composição, paleta de cores, semelhança do sujeito, enquadramento — da referência no resultado.