ノイズ潜在変数の作成 (Create Noise Latents)
接続されたパイプラインが要求するテンソル形状に合わせてランダムノイズの潜在変数テンソルを生成します。Text-to-Image / Text-to-Video フローの典型的な開始点となります。
カテゴリ: ModularDiffusion/Create
概要 (TL;DR)
- 純粋な Text-to-Image / Text-to-Video フローを構築する場合、Pipeline Builder と Generate Media Latents の間に本ノードを配置します。
width(幅)とheight(高さ)はピクセル空間での値です。ノードが内部で VAE ダウンサンプリングスケールに合わせて自動変換します。num_framesは、接続されたパイプラインが動画生成用(LTX, LTX2, WAN)の場合のみ表示され、静止画パイプラインでは非表示になります。seed(シード値)によって再現性を制御します。同じシード + 同じパイプライン + 同じ解像度 → 同一の潜在変数が生成されます。
ワークフローにおける一般的な配置 (Typical workflow position)
Pipeline Builder → [Create Noise Latents] → Generate Media Latents → Decode Media Latent
ノードプレビュー (Node preview)

入力 (Inputs)
| 名前 | 型 | 必須 | 備考 |
|---|---|---|---|
pipeline |
Pipeline Config |
はい | Pipeline Builder から供給。潜在変数の形状、VAE スケールファクター、および num_frames を表示するかどうかを決定します。 |
出力 (Outputs)
| 名前 | 型 | 備考 |
|---|---|---|
output_latent |
LatentArtifact |
アンパックされ正規化された(~N(0,1))ノイズテンソル。Generate Media Latents に渡します。 |
パラメータ一覧 (Parameters)
| 名前 | 型 | デフォルト | 備考 |
|---|---|---|---|
width |
int (ピクセル) | 1024 |
ピクセル空間での幅。内部で VAE スケールファクターによって除算されます。 |
height |
int (ピクセル) | 1024 |
ピクセル空間での高さ。 |
num_frames |
int | 41 |
動画フレーム数。静止画パイプラインでは非表示。 |
seed |
int | ランダム | 再現性制御用のシード値。 |
num_inference_steps |
int | 20 |
SDXL の場合のみ表示 — SDXL が初期ノイズをスケーリングするために使用します。他のパイプラインでは無視されます。 |
ヒントと注意点 (Tips & pitfalls)
- 幅と高さは VAE の除算制約を満たす必要があります: 多くの VAE は 8 または 16 の倍数を必要とします。テンソル形状の不整合を防ぐため、標準的な解像度(512, 768, 1024 など)を指定してください。
- パイプラインが異なれば同じシードでも同一画像にはなりません: 潜在変数の形状や VAE 空間はモデルごとに異なるため、シード値は同一のパイプライン種別内でのみ有効です。
- Image-to-Image や再拡散(Rediffusion)の場合は Encode Media Latent を使用してください: 既存の画像をエンコードすることで条件付けされた開始点が得られます。必要に応じて Generate Media Latents 側で
add_noise=Trueを設定してノイズを付加します。
関連項目 (See also)
- Create Empty Latents — マスク合成や特定のマルチステージ処理用のゼロ埋め潜在変数。
- Encode Media Latent — 画像 / 動画から潜在変数への変換。
- Generate Media Latents — 生成を実行する典型的な接続先。