> ## Documentation Index
> Fetch the complete documentation index at: https://dripart-chore-sync-comfy-api-v2-spec.mintlify.site/llms.txt
> Use this file to discover all available pages before exploring further.

# Wan22ImageToVideoLatent - ComfyUI Built-in Node Documentation

> Wan22ImageToVideoLatent は、画像からビデオの潜在表現を生成します。

Wan22ImageToVideoLatent は、画像からビデオの潜在表現を生成します。指定された幅、高さ、フレーム長、バッチサイズで空白のビデオ潜在空間を生成し、オプションで開始画像シーケンスを先頭フレームにエンコードできます。開始画像が指定されると、ノードはそれを潜在空間にエンコードし、生成中にどの領域をノイズ除去すべきかを示す対応するノイズマスクを作成します。

## 入力

| パラメータ    | 説明                                                        | データ型  | 必須 | 範囲                    |
| -------- | --------------------------------------------------------- | ----- | -- | --------------------- |
| `vae`    | 開始画像を潜在空間にエンコードするために使用されるVAEモデル                           | VAE   | 必須 | -                     |
| `幅`      | 出力ビデオのピクセル単位の幅（デフォルト: 1280、ステップ: 32）                      | INT   | 必須 | 32 to MAX\_RESOLUTION |
| `高さ`     | 出力ビデオのピクセル単位の高さ（デフォルト: 704、ステップ: 32）                      | INT   | 必須 | 32 to MAX\_RESOLUTION |
| `長さ`     | ビデオシーケンスのフレーム数（デフォルト: 49、ステップ: 4）                         | INT   | 必須 | 1 to MAX\_RESOLUTION  |
| `バッチサイズ` | 生成するビデオ潜在表現の数（デフォルト: 1）                                   | INT   | 必須 | 1〜4096                |
| `開始画像`   | ビデオ潜在表現の先頭フレームにエンコードするオプションの開始画像シーケンス（最初の`length`フレームを使用） | IMAGE | 任意 | -                     |

**注記：** `start_image` が指定された場合、画像シーケンスはターゲットの `width` と `height` にアップスケールされ、VAEでエンコードされて、潜在表現の先頭フレームに配置されます。それらのフレームのノイズマスクは0（保持）に設定され、残りのフレームのマスク値は1（ノイズ除去対象）になります。潜在表現は常に48チャンネルを持ち、空間次元は `height / 16` × `width / 16`、時間次元は `((length - 1) // 4) + 1` です。`width` と `height` は16で割り切れる必要があり（ステップ32により強制）、`length` は時間次元を4ステップで増加させます。

## 出力

| 出力名          | 説明                                                        | データ型   |
| ------------ | --------------------------------------------------------- | ------ |
| `samples`    | 生成されたビデオ潜在表現。バッチ内の各アイテムに対して繰り返されます                        | LATENT |
| `noise_mask` | どの領域をノイズ除去するか（値1）、およびどの領域がエンコードされた開始画像を保持するか（値0）を示すノイズマスク | LATENT |

両方のフィールドは、単一のLATENT出力内にまとめて返されます。

> このドキュメントは AI によって生成されました。エラーを見つけた場合や改善のご提案がある場合は、ぜひ貢献してください！ [GitHub で編集](https://github.com/Comfy-Org/embedded-docs/blob/main/comfyui_embedded_docs/docs/Wan22ImageToVideoLatent/ja.md)

***

**Source fingerprint (SHA-256):** `3d05980641eeef2e86df7a845aa8b2bd703882db98fe71adef2746ab34a9d717`
