人が食べ物を食べるシーンで『食べ物だけを別の食べ物に置き換える』プロンプト作成法の説明
人物が食べ物を食べるシーンをリファレンスとして使用する際、元の食べ物の代わりに新しい食べ物を自然に置き換えるには、プロンプトで人物のポーズ・行動・食事の仕方、そして新しい食べ物の構成・器・形状をすべて具体的に記述する必要があります。リファレンスと置き換える食べ物の関係が明確に説明されていないと、システムがどの要素を基準にすべきか判断しにくくなるため、両方の情報が正確に結びつくようにプロンプトで説明することが重要です。
1) 人物シーンをリファレンスとして使用する
まず、人物が特定の食べ物を食べているシーンをリファレンスとして入力します。
このときリファレンスはポーズ・手の位置・食べ方・構図を提供する基準となります。
2) プロンプトで人物の行動をもう一度詳細に記述する
QEULはリファレンス画像とプロンプトテキストを一緒に解釈するため、
プロンプトで人物がどのような行動をしているか再確認する必要があります。
例
ある男性が広い器に食べ物を前に置き、
ラテックス手袋をはめた手で食べ物をつかんで口に運ぶシーン。
男性は同じポーズで手で食べ物を食べる行動を維持します。
このように「行動は維持される」という点を明確に伝えることが重要です。
3) 既存の食べ物は取り除き、置き換える食べ物の情報を非常に具体的に記述する
多くの初心者が見落とす部分がこれです。
例えば、
リファレンスにはチキン・ブルダック炒め麺・ライスペーパーがあったとしても、
置き換えたい食べ物は弁当やパスタのように全く異なる食べ物である可能性があります。
このときプロンプトには次の要素を必ず詳細に記述する必要があります。
✔ 「新しい食べ物が何か」
例
炒飯・漬物・ポテトサラダで構成されたコンビニ弁当
カボチャクリームソースパスタ
✔ 「どの器に盛られているか」
例
黒い仕切りの弁当容器
四角い白いプラスチック皿
✔ 「人物がどのように食べているか」
例
弁当はテーブルの前に置かれており
パスタは白い器に盛られており
男性は手でパスタをつかんで食べている
この三つが詳細であればリファレンスの行動と新しい食べ物の構成が正確に結びつきます。
4) なぜこれほど詳細である必要があるのか?
AIにとって最も混乱する点は次の質問です。
「リファレンス内の元の食べ物」と「プロンプトで新たに指定した食べ物」のどちらが基準か?
プロンプトで明確に整理する必要があります。
人物のポーズ・行動はリファレンス基準そのまま維持されます。
しかし人物が食べる食べ物と前に置かれた食べ物は新しい食べ物に置き換えられます。
この二つの関係が明確に記載されていれば
QEULが「行動は維持、食べ物は置き換え」という構造を正確に理解します。
5) 例文
以下は実際に適用可能な形のプロンプト例です。
男性はリファレンスと同じポーズで、片手で食べ物をつかんで食べているシーンです。
元の食べ物はすべて除外し、彼の前にはコンビニ弁当とカボチャパスタが置かれています。
弁当は黒い仕切り容器の中に炒飯・おかず・ポテトサラダが整然と盛られており、
カボチャパスタは清潔な白い四角い皿に盛られています。
男性は手でカボチャパスタをつかんで食べています。
この程度に記述すればリファレンスの行動と置き換えた食べ物の情報が明確に結びつきます。
6) 要約
人物のポーズ・食べ方はリファレンスそのまま維持します。
元の食べ物はすべて置き換えるため、新しい食べ物の構成・器・配置・食べ方まで詳細に記述します。
「この人が今食べている食べ物は私が指定した新しい食べ物である」を必ず明示します。
こうすればQEULがリファレンス行動と新しい食べ物の構成を正確に組み合わせてくれます。
アシスタント使用例 )


例示画像 )

