术语表
Text-to-image
又称:T2I, txt2img
一种生成模式,输入是文本(prompt),输出是图像。这是最常见的 AI 图像生成模式。
深入解读
在实践中意味着什么
文生图是大多数图像模型的默认模式。模型接收一段文字描述并产出与之匹配的图像。Nano Banana 2 在 hilens 上支持文生图,HiDream-O1-image-1.5 已宣布将随后推出。
文生图与图生图(输入是一张现有图像加可选 prompt,模型产出修改后的版本)和图生视频(输入是一张图像,模型产出一段视频)形成对比。同一个模型往往通过不同的参数设置支持多种模式,而非作为不同的模型存在。
相关内容