コンテンツにスキップ

ノイズ潜在変数の作成 (Create Noise Latents)

接続されたパイプラインが要求するテンソル形状に合わせてランダムノイズの潜在変数テンソルを生成します。Text-to-Image / Text-to-Video フローの典型的な開始点となります。

カテゴリ: ModularDiffusion/Create

概要 (TL;DR)

  • 純粋な Text-to-Image / Text-to-Video フローを構築する場合、Pipeline Builder と Generate Media Latents の間に本ノードを配置します。
  • width(幅)と height(高さ)はピクセル空間での値です。ノードが内部で VAE ダウンサンプリングスケールに合わせて自動変換します。
  • num_frames は、接続されたパイプラインが動画生成用(LTX, LTX2, WAN)の場合のみ表示され、静止画パイプラインでは非表示になります。
  • seed(シード値)によって再現性を制御します。同じシード + 同じパイプライン + 同じ解像度 → 同一の潜在変数が生成されます。

ワークフローにおける一般的な配置 (Typical workflow position)

Pipeline Builder → [Create Noise Latents] → Generate Media Latents → Decode Media Latent

ノードプレビュー (Node preview)

Create Noise Latents

入力 (Inputs)

名前 型 必須 備考
pipeline Pipeline Config はい Pipeline Builder から供給。潜在変数の形状、VAE スケールファクター、および num_frames を表示するかどうかを決定します。

出力 (Outputs)

名前 型 備考
output_latent LatentArtifact アンパックされ正規化された(~N(0,1))ノイズテンソル。Generate Media Latents に渡します。

パラメータ一覧 (Parameters)

名前 型 デフォルト 備考
width int (ピクセル) 1024 ピクセル空間での幅。内部で VAE スケールファクターによって除算されます。
height int (ピクセル) 1024 ピクセル空間での高さ。
num_frames int 41 動画フレーム数。静止画パイプラインでは非表示。
seed int ランダム 再現性制御用のシード値。
num_inference_steps int 20 SDXL の場合のみ表示 — SDXL が初期ノイズをスケーリングするために使用します。他のパイプラインでは無視されます。

ヒントと注意点 (Tips & pitfalls)

  • 幅と高さは VAE の除算制約を満たす必要があります: 多くの VAE は 8 または 16 の倍数を必要とします。テンソル形状の不整合を防ぐため、標準的な解像度(512, 768, 1024 など)を指定してください。
  • パイプラインが異なれば同じシードでも同一画像にはなりません: 潜在変数の形状や VAE 空間はモデルごとに異なるため、シード値は同一のパイプライン種別内でのみ有効です。
  • Image-to-Image や再拡散(Rediffusion)の場合は Encode Media Latent を使用してください: 既存の画像をエンコードすることで条件付けされた開始点が得られます。必要に応じて Generate Media Latents 側で add_noise=True を設定してノイズを付加します。

関連項目 (See also)