**Z-Image (造相)**는 Alibaba의 Tongyi Lab이 개발한 6B 파라미터의 강력하고 매우 효율적인 이미지 생성 모델입니다. Scalable Single-Stream DiT(S3-DiT) 아키텍처를 사용하여 텍스트, 시각적 의미 토큰, 이미지 VAE 토큰을 시퀀스 수준에서 연결해 통합된 입력 스트림으로 사용함으로써 파라미터 효율성을 극대화합니다.
모델 변형:
- 🚀 Z-Image-Turbo: 단 8 NFE(함수 평가 횟수)만으로 주요 경쟁 모델과 동등하거나 뛰어난 성능을 제공하는 증류 버전입니다. 엔터프라이즈급 H800 GPU에서 1초 미만의 추론 지연 시간을 제공하며 16GB VRAM 소비자용 디바이스에도 적합합니다.
- 🧱 Z-Image-Base: 커뮤니티 주도의 파인튜닝 및 커스텀 개발을 위한 비증류 파운데이션 모델입니다.
- ✍️ Z-Image-Edit: 인상적인 지시 준수 능력을 갖춘 이미지 편집 작업용 파인튜닝 변형입니다.
- 사실적인 품질: 뛰어난 미적 품질을 유지하면서 강력한 사실적 이미지 생성 제공
- 정확한 이중 언어 텍스트 렌더링: 복잡한 중국어와 영어 텍스트를 정확하게 렌더링하는 데 탁월
- 프롬프트 향상 및 추론: Prompt Enhancer가 모델에 추론 능력을 부여
- 1초 미만 추론: 지원되는 하드웨어에서 빠른 생성 속도 달성
Z-Image-Turbo 텍스트 기반 이미지 생성 워크플로우
Z-Image-Turbo: 텍스트 기반 이미지 생성
Single-Stream Diffusion Transformer를 사용하는 효율적인 이미지 생성 파운데이션 모델로, 영어와 중국어를 지원합니다.
Comfy Cloud에서 실행
이 워크플로우를 Comfy Cloud에서 바로 실행
워크플로우 다운로드
Z-Image-Turbo 텍스트 기반 이미지 생성 워크플로우 JSON 파일 다운로드
Z-Image-Turbo 모델 다운로드
qwen_3_4b.safetensors
Z-Image-Turbo용 텍스트 인코더.
z_image_turbo_bf16.safetensors
Z-Image-Turbo용 diffusion 모델.
ae.safetensors
Z-Image-Turbo용 VAE.
Z-Image-Turbo Fun Union ControlNet 워크플로우
Z-Image-Turbo Fun Union ControlNet
Z-Image-Turbo를 위한 Canny, HED, Depth, Pose, MLSD를 지원하는 멀티 컨트롤 ControlNet입니다.
Comfy Cloud에서 실행
이 워크플로우를 Comfy Cloud에서 바로 실행
워크플로우 다운로드
Z-Image-Turbo Fun Union ControlNet 워크플로우 JSON 파일 다운로드
LoadImage 노드에 업로드하세요:
image_z_image_turbo_fun_union_controlnet_input_image.png
LoadImage 노드 58 · image_z_image_turbo_fun_union_controlnet_input_image.png
ControlNet용 추가 모델
Z-Image-Turbo-Fun-Controlnet-Union.safetensors
Z-Image-Turbo용 ControlNet 모델 패치.