Skip to main content
Z-Image (造相) 是阿里巴巴通义实验室开发的一款强大且高效的图像生成模型,拥有 6B 参数。它采用 Scalable Single-Stream DiT(S3-DiT)架构,将文本、视觉语义 token 和图像 VAE token 在序列层面拼接为统一的输入流,从而最大化参数效率。 模型版本
  • 🚀 Z-Image-Turbo:蒸馏版本,仅需 8 次 NFE(函数评估次数)即可达到或超越领先的竞争对手。在企业级 H800 GPU 上可实现亚秒级推理延迟,并可适配 16GB 显存的消费级设备
  • 🧱 Z-Image-Base:未经蒸馏的基础模型,用于社区驱动的微调和自定义开发。
  • ✍️ Z-Image-Edit:针对图像编辑任务微调的变体,具有出色的指令遵循能力。
模型亮点
  • 照片级真实感质量:在保持出色美学质量的同时,提供强大的照片级真实感图像生成
  • 精准的双语文本渲染:擅长准确渲染复杂的中英文文本
  • 提示词增强与推理:Prompt Enhancer 赋予模型推理能力
  • 亚秒级推理:在支持的硬件上实现快速生成
相关链接
请确保你的 ComfyUI 已经更新。本指南里的工作流可以在工作流模板中找到。如果找不到,可能是 ComfyUI 没有更新。如果加载工作流时有节点缺失,可能原因有:
  1. 你用的不是最新版(每夜版)。
  2. 启动时有些节点导入失败。

Z-Image-Turbo 文生图工作流

Z-Image-Turbo:文生图

采用 Single-Stream Diffusion Transformer 的高效图像生成基础模型,支持英文和中文。 Z-Image-Turbo text-to-image workflow preview

在 Comfy Cloud 上运行

在 Comfy Cloud 上直接运行此工作流

下载工作流

下载 Z-Image-Turbo 文生图工作流 JSON 文件
示例输出 Z-Image-Turbo example output

Z-Image-Turbo 模型下载

qwen_3_4b.safetensors

Z-Image-Turbo 的文本编码器。

z_image_turbo_bf16.safetensors

Z-Image-Turbo 的 diffusion 模型。

ae.safetensors

Z-Image-Turbo 的 VAE。
Z-Image-Turbo 模型保存位置

Z-Image-Turbo Fun Union ControlNet 工作流

Z-Image-Turbo Fun Union ControlNet

为 Z-Image-Turbo 提供 Canny、HED、Depth、Pose 和 MLSD 支持的多控制 ControlNet。 Z-Image-Turbo Fun Union ControlNet workflow preview

在 Comfy Cloud 上运行

在 Comfy Cloud 上直接运行此工作流

下载工作流

下载 Z-Image-Turbo Fun Union ControlNet 工作流 JSON 文件
输入素材 将此文件上传到对应的 LoadImage 节点:

image_z_image_turbo_fun_union_controlnet_input_image.png

LoadImage 节点 58 · image_z_image_turbo_fun_union_controlnet_input_image.png
image_z_image_turbo_fun_union_controlnet_input_image.png

ControlNet 附加模型

Z-Image-Turbo-Fun-Controlnet-Union.safetensors

Z-Image-Turbo 的 ControlNet 模型补丁。
模型保存位置