메인 콘텐츠로 건너뛰기
**Z-Image (造相)**는 알리바바의 퉁이 랩에서 개발한 강력하고 매우 효율적인 이미지 생성 모델로, 6B 파라미터를 갖추고 있습니다. 이 모델은 확장 가능한 단일 스트림 DiT(S3-DiT) 아키텍처를 사용하며, 텍스트, 시각적 의미 토큰, 이미지 VAE 토큰을 시퀀스 수준에서 연결해 통합된 입력 스트림으로 활용함으로써 파라미터 효율성을 극대화합니다. Z-Image (Base)는 커뮤니티 주도의 미세조정 및 맞춤형 개발을 위해 설계된 비증류 기반 모델입니다. 모델 주요 특징:
  • 사진과 같은 사실성: 뛰어난 심미적 품질을 유지하면서 강력한 사진과 같은 이미지 생성을 제공합니다.
  • 정확한 양국어 텍스트 렌더링: 복잡한 중국어와 영어 텍스트를 정확하게 렌더링하는 데 뛰어납니다.
  • 프롬프트 향상 및 추론 기능: 프롬프트 엔핸서는 모델에 추론 능력을 부여합니다.
  • 미세조정 준비 완료: 맞춤형 학습과 적응에 이상적인 기본 모델입니다.
관련 링크:

Z-Image 텍스트 기반 이미지 생성 워크플로우

워크플로우 다운로드

Z-Image 텍스트 기반 이미지 생성 워크플로우 JSON 파일을 다운로드하세요.

ComfyUI 클라우드에서 실행하기

이 워크플로우를 ComfyUI 클라우드에서 바로 실행하세요.
ComfyUI가 최신 버전으로 업데이트되었는지 확인하세요.이 가이드의 워크플로우는 워크플로우 템플릿에서 확인할 수 있습니다. 템플릿에서 찾을 수 없다면, 귀하의 ComfyUI가 오래된 버전일 수 있습니다. (데스크톱 버전의 업데이트는 다소 지연될 수 있습니다)워크플로우를 로드할 때 노드가 누락되는 경우, 가능한 원인:
  1. 최신 ComfyUI 버전(야간 빌드)을 사용하고 있지 않음
  2. 일부 노드가 시작 시 가져오기에 실패함

Z-Image 모델 다운로드

qwen_3_4b.safetensors

Z-Image용 텍스트 인코더

z_image_bf16.safetensors

Z-Image용 확산 모델

ae.safetensors

Z-Image용 VAE
모델 저장 위치
📂 ComfyUI/
├── 📂 models/
│   ├── 📂 text_encoders/
│   │      └── qwen_3_4b.safetensors
│   ├── 📂 diffusion_models/
│   │      └── z_image_bf16.safetensors
│   └── 📂 vae/
│          └── ae.safetensors