> ## Documentation Index
> Fetch the complete documentation index at: https://dripart-docs-custom-nodes-sdk-v2-frontend.mintlify.site/llms.txt
> Use this file to discover all available pages before exploring further.

# WanSCAILToVideo - ComfyUI Built-in Node Documentation

> WanSCAILToVideo ノードは、SCAIL および SCAIL-2 ビデオモデルによるビデオ生成のための条件付けと空の潜在空間を準備します。

WanSCAILToVideo ノードは、SCAIL および SCAIL-2 ビデオモデルによるビデオ生成のための条件付けと空の潜在空間を準備します。参照画像、ポーズビデオ、CLIPビジョン出力、色分けされたIDマスク、前のフレームチャンクなどのオプション入力を処理し、それらをポジティブ条件付けとネガティブ条件付けに埋め込みます。このノードは、変更された条件付けと、指定されたビデオ寸法の空の潜在テンソルを出力し、サンプリングの準備を整えます。

## 入力

| パラメータ                  | 説明                                                                                                                                               | データ型                 | 必須  | 範囲                    |
| ---------------------- | ------------------------------------------------------------------------------------------------------------------------------------------------ | -------------------- | --- | --------------------- |
| `positive`             | ポジティブ条件付けの入力です。                                                                                                                                  | CONDITIONING         | はい  | -                     |
| `negative`             | ネガティブ条件付けの入力です。                                                                                                                                  | CONDITIONING         | はい  | -                     |
| `vae`                  | 画像とビデオフレームのエンコードに使用されるVAEモデルです。                                                                                                                  | VAE                  | はい  | -                     |
| `幅`                    | 出力ビデオの幅（ピクセル単位、デフォルト: 512）。値は32刻みです。                                                                                                             | INT                  | はい  | 32 to MAX\_RESOLUTION |
| `高さ`                   | 出力ビデオの高さ（ピクセル単位、デフォルト: 896）。値は32刻みです。                                                                                                            | INT                  | はい  | 32 to MAX\_RESOLUTION |
| `長さ`                   | ビデオのフレーム数（デフォルト: 81）。値は4刻みです。                                                                                                                    | INT                  | はい  | 1 to MAX\_RESOLUTION  |
| `バッチサイズ`               | バッチで生成するビデオの数（デフォルト: 1）。                                                                                                                         | INT                  | はい  | 1〜4096                |
| `ポーズビデオ`               | ポーズ条件付けに使用するビデオ。メインビデオの解像度の半分にダウンスケールされます。                                                                                                       | IMAGE                | いいえ | -                     |
| `pose_video_mask`      | SCAIL-2 のみ。`pose_video` と同じ解像度の、IDごとに色分けされたSAM3マスクビデオです。                                                                                         | IMAGE                | いいえ | -                     |
| `replacement_mode`     | SCAIL-2 のみ。False = アニメーションモード（`pose_video_mask` の背景は黒にする必要があります）。True = 置換モード（`pose_video_mask` の背景は白にする必要があります）。（デフォルト: False）                  | BOOLEAN              | いいえ | -                     |
| `ポーズ強度`                | ポーズ潜在表現の強度。（デフォルト: 1.0）                                                                                                                          | FLOAT                | はい  | 0.0〜10.0              |
| `ポーズ開始ステップ`            | ポーズ条件付けの開始ステップ。（デフォルト: 0.0）                                                                                                                      | FLOAT                | はい  | 0.0〜1.0               |
| `ポーズ終了ステップ`            | ポーズ条件付けの終了ステップ。（デフォルト: 1.0）                                                                                                                      | FLOAT                | はい  | 0.0〜1.0               |
| `参照画像`                 | 参照画像。最初の画像がプライマリ参照です（すべてのIDをその上に合成します）。SCAIL-2: バッチ内の追加画像は追加ビュー（背面、クローズアップ、遮蔽された背景）として使用され、それぞれに対応する `reference_image_mask` をそのIDの色で指定する必要があります。 | IMAGE                | いいえ | -                     |
| `reference_image_mask` | SCAIL-2 のみ。色分けされた参照マスクです。バッチは `reference_image` に対応します（最初 = プライマリ参照マスク、残り = 追加の参照画像用のIDマスク）。                                                     | IMAGE                | いいえ | -                     |
| `clip_vision_output`   | 条件付け用のCLIPビジョン特徴量。モデルはアスペクト比に合わせてストレッチリサイズして学習されています。                                                                                            | CLIP\_VISION\_OUTPUT | いいえ | -                     |
| `video_frame_offset`   | このチャンクが開始する累積出力フレーム。前のチャンクの `video_frame_offset` 出力から接続します。（デフォルト: 0）                                                                            | INT                  | はい  | 0 to MAX\_RESOLUTION  |
| `previous_frame_count` | アンカーとして使用する `previous_frames` の末尾フレーム数。SCAIL-2 は5で学習されています（81フレームのチャンク、76フレームのステップ）。（デフォルト: 5）                                                   | INT                  | はい  | 1 to MAX\_RESOLUTION  |
| `previous_frames`      | SCAIL-2 のみ。前のチャンクの完全なデコード出力。拡張アンカーとして使用されるのは、最後の `previous_frame_count` フレームのみです。                                                                | IMAGE                | いいえ | -                     |

**注：** `pose_video` と `pose_video_mask` の入力は、2つのうち短い方に合わせて切り詰められ、最初の `length` フレームについてのみ処理されます。どちらかの入力が `video_frame_offset` 以下である場合、その入力は完全に無視されます。`pose_video` はエンコード前にメインビデオの半分の解像度にダウンスケールされ、エンコードされたポーズ潜在表現は `pose_strength` で乗算され、`pose_start` から `pose_end` のタイムステップ間でのみ条件付けに適用されます。`pose_video_mask` が指定された場合、色分けされたマスクビデオは半分の解像度にダウンスケールされ、28チャンネルのドライビングマスクに変換され、ポジティブとネガティブの両方の条件付けに追加されます。

**注：** `reference_image` が指定されると、バッチ内の各画像は個別に潜在表現にエンコードされ、ポジティブとネガティブの両方の条件付けに埋め込まれます。最初の画像はプライマリ参照です。追加の画像は追加ビューとして使用され、それぞれに対応する `reference_image_mask` が必要です。`reference_image_mask` は `reference_image` も指定されている場合にのみ使用されます。両方が指定された場合、参照フレームをIDにバインドする28チャンネルの参照マスクもマスクから構築され、条件付けに追加されます。置換モード（`replacement_mode=True`）では、参照画像は参照画像マスクをアルファマットとして使用して黒い背景に合成されます。`clip_vision_output` が指定された場合、それはポジティブとネガティブの両方の条件付けに適用されます。

**注：** `previous_frames` が指定された場合、最後の `previous_frame_count` フレームのみが拡張アンカーとして使用され、`video_frame_offset` はそれに応じて調整されます（アンカーされたフレーム数だけ減算され、0でクランプされます）。アンカーされたフレームはエンコードされて出力潜在表現の先頭に書き込まれ、生成中にそれらのフレームが変更されないようにノイズマスクが含められます。

## 出力

| 出力名                  | 説明                                                                                                                                                     | データ型         |
| -------------------- | ------------------------------------------------------------------------------------------------------------------------------------------------------ | ------------ |
| `positive`           | 変更されたポジティブ条件付け。埋め込まれた参照画像の潜在表現、CLIPビジョン出力、ポーズビデオの潜在表現、ドライビングマスク、参照マスク、または前フレームの潜在表現を含む可能性があります。                                                        | CONDITIONING |
| `negative`           | 変更されたネガティブ条件付け。埋め込まれた参照画像の潜在表現、CLIPビジョン出力、ポーズビデオの潜在表現、ドライビングマスク、参照マスク、または前フレームの潜在表現を含む可能性があります。                                                        | CONDITIONING |
| `latent`             | 形状 `[batch_size, 16, ((length - 1) // 4) + 1, height // 8, width // 8]` の空の潜在テンソル。`previous_frames` が指定された場合、潜在表現はエンコードされた前フレームで部分的に埋められ、ノイズマスクが含まれます。 | LATENT       |
| `video_frame_offset` | 調整後のオフセット + length。シーケンシャルなビデオ生成のために次のチャンクに接続します。                                                                                                      | INT          |

> このドキュメントは AI によって生成されました。エラーを見つけた場合や改善のご提案がある場合は、ぜひ貢献してください！ [GitHub で編集](https://github.com/Comfy-Org/embedded-docs/blob/main/comfyui_embedded_docs/docs/WanSCAILToVideo/ja.md)

***

**Source fingerprint (SHA-256):** `4a1a2201dfa94bd2f1330db02ec18a5e0a6aae9e9ac5ae97d456b7af1aa84b7b`
