用語集
Reference image
別名:ref image, image-to-image input
生成を条件付けするためにプロンプトと一緒にアップロードする画像です。モデルは構図、カラーパレット、被写体の似姿、フレーミングといった視覚的特性を参照画像から出力に引き継ぎます。
詳しく
実際の意味
参照画像による条件付けは、画像モデルの2つの主要なコントロール面の1つです(もう1つはテキストプロンプト)。モデルによって参照画像のどの側面を重視するかは異なります。Kling v2.6 Pro は色と被写体の似姿の保持でクラス最高水準です。Nano Banana 2 は複数パネル出力にわたるアイデンティティの保持でクラス最高水準です。FLUX は構図とライティングを高い忠実度で保持します。
既存のロゴ、キャラクター、商品写真をアニメーション化するブランド向けの作業では、参照画像による条件付けこそが、出力を一般的な生成物ではなく「あなたのもの」として認識させる要因になります。トレードオフは、参照の重みが大きいほど創造的なばらつきが小さくなることです。
関連項目
Prompt
何を生成するかを記述して AI モデルに与えるテキストの指示です。画像・動画モデルでは、プロンプトに被写体の説明、スタイルの方向性、カメラや構図のヒント、そして任意のネガティブプロンプトを混在させます。
Identity preservation
同じ参照画像からの複数回の生成にわたって、人物の顔やキャラクターの外見を一貫して保つモデルの能力です。複数パネルのコラージュやキャラクター主導のコンテンツにとって極めて重要です。
Image-to-video
入力が静止画で、その画像をアニメーション化した動画を出力する生成モードです。多くの場合、求める動きを記述するテキストプロンプトと組み合わせて使われます。