> ## Documentation Index
> Fetch the complete documentation index at: https://docs.comfy.org/llms.txt
> Use this file to discover all available pages before exploring further.

# PixelDiT ComfyUI ワークフロー例

> PixelDiT は NVIDIA のピクセル空間拡散トランスフォーマーで、1024px のテキストから画像への生成を行います。VAE エンコード/デコードを必要とせず、ピクセル空間で直接生成します。

**PixelDiT** は NVIDIA が開発したピクセル空間拡散トランスフォーマーで、**1024px** のテキストから画像への生成を行います。従来の潜在空間で動作する拡散モデルとは異なり、PixelDiT はデュアルレベル DiT アーキテクチャを使用してピクセル空間で直接画像を生成します：パッチレベル DiT とピクセルレベル DiT を組み合わせ、MM-DiT フュージョンによるテキストと画像トークン間の共同アテンションを実現します。

**モデルのハイライト**：

* **VAE不要**: ピクセル空間で直接生成、従来の VAE エンコード/デコードは不要
* **デュアルレベル DiT**: パッチレベル DiT + ピクセルレベル DiT による高品質生成
* **マルチアスペクト比**: 1024px ベース解像度、複数のアスペクト比に対応
* **約 1.3B パラメータ**: コンシューマー GPU でも実行可能
* **ライセンス**: NSCLv1（非商用研究/評価のみ）

**関連リンク**：

* [Hugging Face 公式モデル](https://huggingface.co/nvidia/PixelDiT-1300M-1024px)
* [Comfy-Org/PixelDiT](https://huggingface.co/Comfy-Org/PixelDiT)

## PixelDiT テキストから画像へのワークフロー

<img src="https://raw.githubusercontent.com/Comfy-Org/workflow_templates/main/templates/image_pixeldit_t2i-1.webp" alt="PixelDiT テキストから画像へのワークフロー" />

<CardGroup cols={2}>
  <Card title="ワークフローをダウンロード" icon="download" href="https://github.com/Comfy-Org/workflow_templates/blob/main/templates/image_pixeldit_t2i.json">
    JSON をダウンロード、またはテンプレートライブラリで "PixelDiT" を検索
  </Card>

  <Card title="Comfy Cloud で実行" icon="cloud" href="https://cloud.comfy.org/?template=image_pixeldit_t2i&utm_source=docs&utm_medium=referral&utm_campaign=pixeldit">
    クラウドで開く
  </Card>
</CardGroup>

<Tip>
  <Tabs>
    <Tab title="ローカルユーザー">
      ComfyUI が最新版に更新されていることを確認してください。

      * [ComfyUI のダウンロード](https://www.comfy.org/download)
      * [更新手順](/ja/installation/update_comfyui)

      このガイドで紹介するワークフローは、[ワークフローテンプレート](/ja/interface/features/template)から入手できます。
      テンプレート内に該当のワークフローが見つからない場合、ComfyUI のバージョンが古くなっている可能性があります。

      ワークフローを読み込んだ際にノードが欠落している場合の考えられる原因：

      1. 最新の ComfyUI（Nightly 版）を使用していない
      2. 起動時に一部のノードのインポートに失敗している
    </Tab>

    <Tab title="クラウドユーザー">
      * [Cloud](https://cloud.comfy.org) は、ComfyUI の安定版リリース後に更新されます。

      したがって、このドキュメントでコアノードが見つからない場合、それは新しいコアノードがまだ最新の安定版にリリースされていない可能性があります。次回の安定版リリースをお待ちください。
    </Tab>
  </Tabs>
</Tip>

ワークフローは 3 つの主要ノードで構成されています：

1. **ResolutionSelector** — 出力解像度を選択
2. **Text to Image (PixelDiT) サブグラフ** — プロンプト、シード、モデル選択、解像度などの制御パラメータを外部公開したコア生成ノード
3. **SaveImage** — 生成された画像を保存

<Card title="サブグラフについて" icon="book-open" href="/ja/interface/features/subgraph">
  このワークフローはサブグラフノードを使用してモジュール化された処理を行います。サブグラフのドキュメントを参照して、ワークフローをカスタマイズおよび拡張する方法を学んでください。
</Card>

### ワークフローコントロール

**Text to Image (PixelDiT)** サブグラフノードで外部公開されているコントロール：

| コントロール              | 説明                      |
| ------------------- | ----------------------- |
| **Positive Prompt** | 生成したい画像を説明するテキストプロンプト   |
| **Negative Prompt** | 生成画像で避けたい内容を説明するテキスト    |
| **Seed**            | 再現性のためのランダムシード          |
| **UNet Model**      | PixelDiT モデルチェックポイントの選択 |
| **CLIP Model**      | テキストエンコーダーモデルの選択        |

## モデルダウンロード

PixelDiT はテキストエンコーダーと拡散モデルの 2 つのモデルファイルを使用します。

<CardGroup cols={2}>
  <Card title="テキストエンコーダー" icon="download" href="https://huggingface.co/Comfy-Org/PixelDiT/blob/main/text_encoders/gemma_2_2b_it_elm_bf16.safetensors">
    gemma\_2\_2b\_it\_elm\_bf16.safetensors — Gemma-2-2B-IT テキストエンコーダー
  </Card>

  <Card title="拡散モデル" icon="download" href="https://huggingface.co/Comfy-Org/PixelDiT/blob/main/diffusion_models/pixeldit_1300m_1024px_bf16.safetensors">
    pixeldit\_1300m\_1024px\_bf16.safetensors — PixelDiT 1300M 1024px 拡散モデル
  </Card>
</CardGroup>

### モデル保存場所

```
📂 ComfyUI/
├── 📂 models/
│   ├── 📂 text_encoders/
│   │      └── gemma_2_2b_it_elm_bf16.safetensors
│   └── 📂 diffusion_models/
│          └── pixeldit_1300m_1024px_bf16.safetensors
```
