- inclusionAI/Ming-Image (GitHub)
- Comfy-Org/Ming-Image (Hugging Face)
- inclusionAI/Ming-Image-0.1-Design (Hugging Face)
Ming Image 0.1 Design が得意なこと
- 長く構造化されたレイアウト: ページ、ポスター、インフォグラフィックなど、多くのセクションを持つものをセクションごとに構成
- テキストレンダリング: プロンプトで引用した文字列が忠実に反映されるため、ラベル、価格、見出しが読みやすいまま保たれる
- 透明な出力: 分離した要素を合成するための、実際のアルファチャンネルを持つ RGBA 画像
- プロンプトの書き換え: 指示に従う視覚言語モデルが、短い概要を詳細なレイアウトキャプションに拡張
- オープンウェイト: MIT ライセンスのため、チェックポイントを自由に使用およびファインチューニング可能
出力例
テキスト量の多いレイアウトをテキストから画像へ生成し、単一の PNG として保存した例:
Ming Image 0.1 Design テキストから画像へのワークフロー
テキストプロンプトからデザインコンポジションを生成します。レイアウト、タイポグラフィ、背景の透過はモデルが処理します。
ワークフローをダウンロード
JSON をダウンロードするか、テンプレートライブラリで「Ming Image 0.1 Design」を検索してください
ワークフローを実行する手順
- そのノード下部の Enter subgraph ボタンで Text to Image (Ming Image 0.1 Design) サブグラフに入ります
promptフィールドにプロンプトを書き、レイアウトをセクションごとに記述し、描画したいコピーは引用符で囲みますResolutionSelectorノードでキャンバスを選択します。2048 x 2048 が最高品質、1024 x 1024 はより高速です- プロンプトエンハンサーをオンのままにすると Qwen3.8-27B がプロンプトを展開します。
enable_PEをオフに切り替えると、入力したテキストをそのまま送信します - プロンプトをキューに入れます。デコードされた画像は
PreviewImageノードに表示されます - 背景を透過させるには、プロンプトの先頭に RGBA フレーズを 1 つ追加します。例えば
RGBA, 4-channel, transparent backgroundです
モデルのダウンロード
ming_image_0.1_design_int8_convrot.safetensors
Ming Image 0.1 Design 用の diffusion モデル(テンプレートで読み込まれます)。
ming_image_0.1_ling_mini_2.0_int8_convrot.safetensors
Ming Image 0.1 Design 用のテキストエンコーダー(テンプレートで読み込まれます)。
qwen3.8_27b_w4a8.safetensors
プロンプトエンハンサーが使用する、プロンプト書き換え用のテキストエンコーダー。
ming_image_vae_bf16.safetensors
Ming Image 0.1 Design 用の VAE。
_layer バリアントも公開されています。
プロンプトガイド
- テキストから画像へのプロンプト書き換え: 公式のプロンプト構造と、このワークフローのエンハンサーが実行するリライターシステムプロンプト
- 透明背景生成のヒント: プロンプトの先頭に付ける固定の RGBA フレーズ
はじめる
- ComfyUIを最新バージョンにアップデートします。Ming Image 0.1のサポートは最新のComfyUIビルドに含まれています
- Template Libraryに移動し、
Ming Image 0.1 Designを検索します
Comfy DesktopとComfy Cloudは安定版リリースに準拠しているため、最新のComfyUIビルドでのみサポートされているモデルは、まだ利用できない場合があります。