Glossário
In-image text
Também conhecido como: text rendering, in-frame text
Texto que aparece dentro da imagem gerada como parte da cena — sinalética, texto de embalagem, cartões de citação, etiquetas de infografia. Historicamente um ponto fraco dos modelos de difusão; em 2026, só os modelos mais fortes o renderizam de forma legível.
Em detalhe
O que significa na prática
Durante a maior parte da era de 2022-2024 da geração de imagem por IA, o texto dentro da imagem era aproximadamente abracadabra — marcas com forma de texto que pareciam letras de um alfabeto paralelo em vez de palavras legíveis. O Nano Banana 2 (2025) e os checkpoints mais recentes do FLUX resolveram isto para escritas latinas; o Nano Banana 2 estende-se a escritas não latinas (chinês, japonês, árabe, cirílico) com fidelidade de topo da sua classe.
Para qualquer resultado que precise de texto legível — cartões de citação, mockups de embalagem, sinalética em planos de estabelecimento, etiquetas de dados de infografia, publicações sociais com sobreposições de texto — o Nano Banana 2 é a única escolha viável no segmento de consumo. Outros modelos produzem o visual mas perdem legibilidade no texto.
Relacionado
Identity preservation
A capacidade de um modelo de manter o rosto de uma pessoa ou a aparência de uma personagem consistentes ao longo de várias gerações a partir da mesma referência. Crítico para colagens multi-painel e conteúdo centrado em personagens.
Output resolution
As dimensões em píxeis de uma imagem ou vídeo gerado. Valores comuns: 1024×1024 (por omissão na maioria dos modelos de imagem), 4K (Nano Banana 2 retrato), 1080p (maioria dos modelos de vídeo).
Prompt
A instrução de texto dada a um modelo de IA que descreve o que gerar. Para modelos de imagem e vídeo, os prompts combinam descrição do tema, direção de estilo, indicações de câmara ou composição e prompts negativos opcionais.