画像から動画への360度回転パースペクティブトレーニング LoRA ワークフロー。複数画像からのテキストから画像(T2I)生成において、キャラクターの顔の特徴と服装を維持


2つのワークフロー手法:1つ目はテキストからの画像生成で、他のT2Iアプローチとは異なり、キャラクターの顔の特徴と服装の一貫性を保ちながら異なるポーズの4つの画像を生成します。これは、コンテキストに応じた画像から動画への素材作成に適しています。

もう1つの手法は、画像から360度回転パースペクティブ動画を生成し、その動画を複数パースペクティブの画像に変換するもので、LoRA のトレーニング素材に適しています。