利用可能なワークフロー
テキストから動画へ
プロンプトだけでクリップを生成します。プロンプトが動作、セリフ、サウンドを担うため、1回のノード実行で完成したトーキングクリップが返されます。Comfy Cloud で実行
Comfy Cloud で開く
ワークフローをダウンロード
JSON をダウンロードするか、テンプレートライブラリで “HeyGen Video 1.0: Text to Video” を検索してください
画像から動画へ
1枚の画像をアニメートします。その画像がクリップの最初のフレームになり、出力はアスペクト比を維持するため、異なる形状が必要な場合は画像をクロップしてください。プロンプトが、何が起こるか、何が話されるかを決めます。Comfy Cloud で実行
Comfy Cloud で開く
ワークフローをダウンロード
JSON をダウンロードするか、テンプレートライブラリで “HeyGen Video 1.0: Image to Video” を検索してください
model_red_curls_ring.png
HeyGen Video 1.0 Image to Video ノードに渡す
LoadImage ノードに読み込んでくださいリファレンスから動画へ
人物、製品、場所をリファレンスとして接続することで、ショット全体を通して一貫させます。最大9枚の画像、3本のビデオ、3つのオーディオクリップ、合計12個です。プロンプトでは、それらを@Image1、@Video1、@Audio1 として参照します。番号は種類ごとに入力順に付けられます。
Comfy Cloud で実行
Comfy Cloud で開く
ワークフローをダウンロード
JSON をダウンロードするか、テンプレートライブラリで “HeyGen Video 1.0: Reference to Video” を検索してください
model_black_blazer_red_earrings.png
最初のリファレンス画像スロットに読み込む ·
@Image1cognac_leather_handbag.png
2番目のリファレンス画像スロットに読み込む ·
@Image2ノードのコントロール
Image to Video ノードは、画像、プロンプト、再生時間、解像度、シードを受け取ります。最初のフレームがクリップの形状を決めるため、アスペクト比のコントロールはありません。
プロンプトのヒント
- 発話するセリフはプロンプトに書く。台詞はショットの説明の一部として引用符で囲みます。そうすることで、モデルがそのセリフを話し、口の動きも一致します。両方のテンプレートには長いサンプルプロンプトが付属しており、その形を示しています。まずショットと被写体、次に引用符で囲んだセリフ、その後にサウンドとカメラの表現が続きます。
- サウンドは映像と一緒に記述する。ルームトーン、音楽、あるいは動作が発するノイズは、コントロールで設定するのではなくプロンプトに書き込みます。サンプルプロンプトはアンビエンスで終わります。たとえば、かすかなケトルの笛音を伴う静かなルームトーンや、物を置くときの柔らかなグラスの触れ合う音などです。
- 製品や出演者の一貫性を保つ。製品や人物を参照画像として接続し、プロンプト内でその名前を挙げてから、どのように同じ状態を保つ必要があるかを記述します。たとえば、
@Image2のバッグの正確な色、比率、金具を維持するなどです。 - 参照画像でショットを形作る。
aspect_ratioをautoに設定すると、フレーミングは最初の参照画像に従うため、最初に接続した参照画像がビデオの形状を決めます。 - 実行ごとのばらつきを想定する。シードは結果を固定しません。同じ設定でも異なるテイクが生成されることがあります。
はじめる
- ComfyUIを最新バージョンにアップデート
- テンプレートライブラリに移動し、
HeyGen Video 1.0を検索