Skip to main content
Ming Image 0.1 Design 是来自 inclusionAI(蚂蚁集团)的 6B 开放权重文生图模型,以 MIT 许可证发布。它面向设计类工作而非照片级真实感:UI 界面、信息图、海报以及其他包含大量文字的版式。其输出为带有真实 alpha 通道的 RGBA,因此透明结果可以直接放入设计文件中。 该工作流在采样器之前加入了提示词重写阶段。Qwen3.8-27B 会在采样之前将简短的创意扩展为结构化的版面描述,而当你希望按原样发送文字时,可以关闭该增强器。 相关链接

Ming Image 0.1 Design 擅长什么

  • 长篇幅结构化排版:包含大量分区的页面、海报和信息图,可逐段构建
  • 文本渲染:提示词中引用的字符串会被严格遵循,因此标签、价格和标题都保持清晰可读
  • 透明输出:带有真实透明度通道的 RGBA 图像,可用于合成独立元素
  • 提示词重写:遵循指令的视觉语言模型可将简短的说明扩展为详细的布局描述
  • 开放权重:采用 MIT 许可,因此可以自由使用和微调模型

示例输出

文生图生成文本密集的版式,并保存为单个 PNG: Ming Image 0.1 Design 文生图示例
请确保你的 ComfyUI 已经更新。本指南里的工作流可以在工作流模板中找到。如果找不到,可能是 ComfyUI 没有更新。如果加载工作流时有节点缺失,可能原因有:
  1. 你用的不是最新版(每夜版)。
  2. 启动时有些节点导入失败。

Ming Image 0.1 Design 文生图工作流

根据文本提示词生成设计稿,模型会自动处理版式布局、文字排版和背景透明度。 Ming Image 0.1 Design 文生图工作流预览

下载工作流

下载 JSON,或在模板库中搜索 “Ming Image 0.1 Design”

运行工作流的步骤

  1. 使用该节点底部的 Enter subgraph 按钮进入 Text to Image (Ming Image 0.1 Design) 子图
  2. 在 prompt 字段中写入提示词,逐段描述版式布局,并将任何希望渲染出来的文案放在引号内
  3. 使用 ResolutionSelector 节点选择画布:2048 x 2048 可获得最佳质量,1024 x 1024 速度更快
  4. 保持提示词增强器开启,让 Qwen3.8-27B 展开你的提示词;或将 enable_PE 切换为关闭,原样发送你输入的文本
  5. 将提示词加入队列。解码后的图像会显示在 PreviewImage 节点中
  6. 如需透明背景,请在提示词开头加上一个 RGBA 短语,例如 RGBA, 4-channel, transparent background

模型下载

ming_image_0.1_design_int8_convrot.safetensors

Ming Image 0.1 Design 的 diffusion 模型(由模板加载)。

ming_image_0.1_ling_mini_2.0_int8_convrot.safetensors

Ming Image 0.1 Design 的文本编码器(由模板加载)。

qwen3.8_27b_w4a8.safetensors

提示词增强器所使用的提示词重写文本编码器。

ming_image_vae_bf16.safetensors

Ming Image 0.1 Design 的 VAE。
模型存储位置
同一仓库还发布了全精度模型:ming_image_0.1_design_bf16.safetensors 和 ming_image_0.1_ling_mini_2.0_bf16.safetensors,以及 diffusion 模型和文本编码器各自的 _layer 变体。

提示词指南

开始使用

  1. 将 ComfyUI 更新到最新版本。Ming Image 0.1 支持位于最新的 ComfyUI 构建中
  2. 前往模板库,搜索 Ming Image 0.1 Design
Comfy Desktop 和 Comfy Cloud 遵循稳定版本发布,因此仅在最新 ComfyUI 构建中才支持的模型可能尚未在它们中提供。