**Z-Image (造相)**は、AlibabaのTongyi Labが開発した、6Bパラメータを備えた強力かつ高効率な画像生成モデルです。Scalable Single-Stream DiT(S3-DiT)アーキテクチャを採用しており、テキスト、視覚意味トークン、画像VAEトークンをシーケンスレベルで連結して統一された入力ストリームとすることで、パラメータ効率を最大化しています。
モデルバリアント:
- 🚀 Z-Image-Turbo:わずか8 NFE(関数評価回数)で主要な競合モデルに匹敵、あるいは上回る蒸留版。エンタープライズグレードのH800 GPUで1秒未満の推論遅延を実現し、16GB VRAMのコンシューマーデバイスにも収まります。
- 🧱 Z-Image-Base:コミュニティ主導のファインチューニングやカスタム開発のための非蒸留基盤モデル。
- ✍️ Z-Image-Edit:印象的な指示遵守能力を備え、画像編集タスク向けにファインチューニングされたバリアント。
- フォトリアリスティックな品質:優れた美的品質を維持しながら、強力なフォトリアリスティックな画像生成を提供
- 正確なバイリンガルテキストレンダリング:複雑な中国語と英語のテキストを正確にレンダリングすることに優れる
- プロンプト強化と推論:Prompt Enhancerがモデルに推論能力を付与
- 1秒未満の推論:対応ハードウェアで高速な生成速度を実現
Z-Image-Turbo テキストから画像へのワークフロー
Z-Image-Turbo: テキストから画像へ
Single-Stream Diffusion Transformerを採用した高効率の画像生成基盤モデルで、英語と中国語をサポートします。
Comfy Cloudで実行
このワークフローをComfy Cloudで直接実行
ワークフローをダウンロード
Z-Image-Turboテキストから画像へのワークフローJSONファイルをダウンロード
Z-Image-Turbo モデルのダウンロード
qwen_3_4b.safetensors
Z-Image-Turbo用テキストエンコーダー。
z_image_turbo_bf16.safetensors
Z-Image-Turbo用diffusionモデル。
ae.safetensors
Z-Image-Turbo用VAE。
Z-Image-Turbo Fun Union ControlNet ワークフロー
Z-Image-Turbo Fun Union ControlNet
Z-Image-Turbo向けにCanny、HED、Depth、Pose、MLSDをサポートするマルチコントロールControlNet。
Comfy Cloudで実行
このワークフローをComfy Cloudで直接実行
ワークフローをダウンロード
Z-Image-Turbo Fun Union ControlNetワークフローJSONファイルをダウンロード
LoadImageノードにアップロードしてください:
image_z_image_turbo_fun_union_controlnet_input_image.png
LoadImageノード 58 · image_z_image_turbo_fun_union_controlnet_input_image.png
ControlNet用の追加モデル
Z-Image-Turbo-Fun-Controlnet-Union.safetensors
Z-Image-Turbo用ControlNetモデルパッチ。