残すものを決めて、動かす
この記事にはアフィリエイト広告が含まれます。
MiniMax H3、画像を入れても別物になる?I2V・Ref2VA・始終フレームの選び方

同じ画像を渡しているのに、背景まで引きずられたり、最初から構図が違ったりする。まず疑うのは、画像の役割です。『この一枚から動かす』のか、『この人物を別の場所へ出す』のかで、H3の入力方式は変わります。プロンプトを長くする前に、開始画像と参照画像を分けて考えましょう。
- 何も決まっていない
- T2Vから場面を試す
- この一枚を動かす
- I2V / first_frame
- 終わりも決めたい
- FL2VA / first+last
- 人物を別の場面へ
- Ref2VAを検討
結論:画像を使う理由から選ぶ
I2Vは最初の画面を渡す方法、Ref2VAは参考資料を渡す方法です。たとえるなら、I2Vは映画の一コマ目を指定し、Ref2VAは配役や美術の資料を渡して別の撮影を頼む違いです。どちらも人物の完全固定を保証するものではありませんが、目的と入力の役割を揃えると、何を直すべきかがはっきりします。
T2V:まず構図や場面そのものを探す
決まった絵がないなら、テキストから場面を試します。最初は『誰が・どこで・何をする・カメラはどう動く・何が聞こえる』を一つずつ書きます。T2Vでは文章から人物と背景を生成します。採用する画が定まるまでは、場面を一つずつ試します。人物が決まったら、その画像を次の入力として使う方法を検討します。
I2V:この一枚の続きが見たいとき
お気に入りの画像から、視線を上げる、カップへ手を伸ばすなどの一動作へ進めます。最初の画面にない服装や別の部屋を同時に要求すると、開始画像との矛盾が増えます。まず画像に写っている人物・衣装・位置を保ち、変えるのは動き一つに絞ります。画像は『雰囲気の参考』ではなく『開始状態』として扱うのが要点です。

FL2VA:最後に見せたい画面まで決まっているとき
Firstは出発地、Lastは目的地です。二枚の間で何がどう変わるかを説明します。片方が正面の人物、片方が全く違う人物や別の小物なら、つなぐ途中に不自然な変化が出やすくなります。まず同じ被写体・衣装・画角を基準に、ポーズや視線だけを変えた組で考えます。複雑なカット割りより、一つの連続した動きとして到達させるのが公式Baseガイドの基本です。
Ref2VA:残したいのは人物や衣装で、場面は変えたいとき
人物の資料を渡しつつ、別の背景や動作を依頼したい場合の候補です。たとえば窓辺の画像を参考に夜カフェの場面を作るなら、『顔立ちと衣装を参考にする』『窓・姿勢・背景は引き継がない』という役割分担を文章にします。参考資料にある物を全部持ち込むのではなく、何を採用するかを決めるのは監督の仕事です。再現したい範囲と、実際に再現できた範囲は出力を見て分けます。
開始と終端を指定しても、途中の品質は別に見る
二枚が合っていても、途中で顔や小物が変わることはあります。始点・中間・終点の静止画に加え、通常速度でも確認してください。手元の動作、人物の輪郭、背景の直線、音声の切れを順に見ます。入力画像の矛盾を減らす、動きを短くする、一つの指示を外す、の順で出力を確認します。
方式が決まったら、対応するテンプレートへ
ComfyUI公式にはT2V、I2V、R2Vなどのテンプレートがあります。FL2VA系とRef2VA系では対応モデルと入力が異なります。テンプレートを開いたら、モデル名と入力ノードが選んだ方式に合っているか確認します。接続はワークフロー記事、文章の書き方はプロンプト記事で確認できます。
よくある質問
同じ顔を使いたいならI2Vですか?
その画像そのものから始めるならI2V、人物を参考に別の場面を作るならRef2VAを検討します。顔の完全一致を保証する区分ではありません。
開始画像と参照画像は同じ意味ですか?
違います。開始画像は最初の状態、参照画像は生成時に参考にしてほしい情報です。目的に合う入力へ接続します。
二枚あれば完全なループになりますか?
同じ画像を始点と終点にしても、動きや明るさ、音の継ぎ目が一致する保証はありません。つなげた状態で確認します。
H3のローカル版なら2Kまで一度で作れますか?
公式モデルカードは公開H3-Baseと、別のH3-Regenerate-2Kを分けています。ホスト型の最大仕様をローカルBaseの保証に読み替えないでください。
