入力
出力
このドキュメントは AI によって生成されました。エラーを見つけた場合や改善のご提案がある場合は、ぜひ貢献してください! GitHub で編集
Source fingerprint (SHA-256):
b1148cd00d8999dd6842e3c2fb13655fda8f20d5befed975a6d1652688b2807cDocumentation Index
Fetch the complete documentation index at: /llms.txt
Use this file to discover all available pages before exploring further.
WanSoundImageToVideo ノードは、オプションのオーディオコンディショニングを使用して、画像からビデオコンテンツを生成します。
| パラメータ | 説明 | データ型 | 必須 | 範囲 |
|---|---|---|---|---|
ポジティブ | 生成されるビデオに表示されるべきコンテンツを導くポジティブなコンディショニングプロンプト | CONDITIONING | はい | - |
ネガティブ | 生成されるビデオで回避すべきコンテンツを指定するネガティブなコンディショニングプロンプト | CONDITIONING | はい | - |
VAE | ビデオの潜在表現のエンコードとデコードに使用されるVAEモデル | VAE | はい | - |
幅 | 出力ビデオの幅(ピクセル単位)(デフォルト:832、16で割り切れる必要があります) | INT | はい | 16 to MAX_RESOLUTION |
高さ | 出力ビデオの高さ(ピクセル単位)(デフォルト:480、16で割り切れる必要があります) | INT | はい | 16 to MAX_RESOLUTION |
長さ | 生成されるビデオのフレーム数(デフォルト:77、4で割り切れる必要があります) | INT | はい | 1 to MAX_RESOLUTION |
バッチサイズ | 同時に生成するビデオの数(デフォルト:1) | INT | はい | 1〜4096 |
オーディオエンコーダ出力 | 音声の特性に基づいてビデオ生成に影響を与えることができるオプションのオーディオエンコーディング。入力されると、オーディオ特徴が補間され、ビデオ生成のコンディショニングに使用されます。 | AUDIO_ENCODER_OUTPUT | いいえ | - |
参照画像 | ビデオコンテンツに視覚的なガイダンスを提供するオプションの参照画像。画像は指定された幅と高さに合わせてアップスケールされ、その後、潜在表現にエンコードされます。入力の最初の画像のみが参照として使用されます。 | IMAGE | いいえ | - |
制御ビデオ | 生成されるビデオのモーションと構造を導くオプションのコントロールビデオ。ビデオはアップスケールおよびエンコードされた後、出力のコンディショニングに使用されます。最初のlengthフレームのみが使用されます。 | IMAGE | いいえ | - |
参照モーション | ビデオの動きのパターンに関するガイダンスを提供するオプションのモーション参照。入力が73フレームを超える場合は、最後の73フレームのみが使用されます。73フレーム未満の場合は、シーケンスがニュートラルフレームでパディングされます。 | IMAGE | いいえ | - |
| 出力名 | 説明 | データ型 |
|---|---|---|
ポジティブ | オーディオ埋め込み、参照潜在表現、モーション参照、コントロールビデオコンディショニングを含む、ビデオ生成用に変更された処理済みのポジティブコンディショニング | CONDITIONING |
ネガティブ | オーディオ埋め込み(ゼロに設定)、参照潜在表現、モーション参照、コントロールビデオコンディショニングを含む、ビデオ生成用に変更された処理済みのネガティブコンディショニング | CONDITIONING |
潜在表現 | 最終的なビデオフレームにデコードできる潜在空間内の生成ビデオ表現。潜在テンソルの形状は[batch_size, 16, latent_t, height/8, width/8]で、latent_tはlengthパラメータから導出されます。 | LATENT |
このドキュメントは AI によって生成されました。エラーを見つけた場合や改善のご提案がある場合は、ぜひ貢献してください! GitHub で編集
b1148cd00d8999dd6842e3c2fb13655fda8f20d5befed975a6d1652688b2807c