Glosario
Text-to-image
También conocido como: T2I, txt2img
Un modo de generación en el que la entrada es texto (el prompt) y la salida es una imagen. El modo de generación de imágenes con IA más común.
En profundidad
Qué significa en la práctica
El texto a imagen es la opción por defecto en la mayoría de modelos de imagen. El modelo toma una descripción escrita y produce una imagen que coincide con ella. Nano Banana 2 admite texto a imagen en hilens, y se ha anunciado que HiDream-O1-image-1.5 le seguirá.
El texto a imagen contrasta con imagen a imagen (la entrada es una imagen existente más un prompt opcional, y el modelo produce una versión modificada) y con imagen a vídeo (la entrada es una imagen y el modelo produce un vídeo). El mismo modelo suele admitir múltiples modos mediante distintos ajustes de parámetros en lugar de como modelos distintos.
Relacionado
Prompt
La instrucción de texto que se da a un modelo de IA y que describe qué generar. Para los modelos de imagen y vídeo, los prompts combinan descripción del sujeto, dirección de estilo, indicaciones de cámara o composición y prompts negativos opcionales.
Image-to-video
Un modo de generación en el que la entrada es una imagen fija y la salida es un vídeo que anima esa imagen. A menudo se acompaña de un prompt de texto que describe el movimiento deseado.
Reference image
Una imagen que se sube junto al prompt para condicionar la generación. El modelo conserva propiedades visuales —composición, paleta de color, parecido del sujeto, encuadre— de la referencia en la salida.