Glossário
In-image text
Também conhecido como: text rendering, in-frame text
Texto que aparece dentro da imagem gerada como parte da cena — placas, textos de embalagem, cartões de citação, rótulos de infográficos. Historicamente um ponto fraco dos modelos de difusão; em 2026, apenas os modelos mais fortes o renderizam de forma legível.
Em detalhe
O que significa na prática
Durante a maior parte da era 2022-2024 da geração de imagens por IA, o texto dentro da imagem era praticamente sem sentido — marcas em forma de texto que pareciam letras de um alfabeto paralelo, em vez de palavras legíveis. O Nano Banana 2 (2025) e os checkpoints mais recentes do FLUX resolveram isso para alfabetos latinos; o Nano Banana 2 se estende a alfabetos não latinos (chinês, japonês, árabe, cirílico) com fidelidade líder de categoria.
Para qualquer resultado que precise de texto legível — cartões de citação, mockups de embalagem, placas em planos de cena, rótulos de dados em infográficos, posts sociais com sobreposições de texto — o Nano Banana 2 é a única opção viável na faixa de consumo. Outros modelos produzem o visual, mas perdem a legibilidade do texto.
Relacionado
Identity preservation
A capacidade de um modelo de manter o rosto de uma pessoa ou a aparência de um personagem consistentes em várias gerações a partir da mesma referência. Essencial para colagens de múltiplos painéis e conteúdo centrado em personagens.
Output resolution
As dimensões em pixels de uma imagem ou vídeo gerado. Valores comuns: 1024×1024 (padrão da maioria dos modelos de imagem), 4K (retrato do Nano Banana 2), 1080p (maioria dos modelos de vídeo).
Prompt
A instrução em texto dada a um modelo de IA que descreve o que gerar. Para modelos de imagem e vídeo, os prompts misturam descrição do sujeito, direção de estilo, dicas de câmera ou composição e prompts negativos opcionais.