Skip to main content
ComfyUI が最新版に更新されていることを確認してください。このガイドで紹介するワークフローは、ワークフローテンプレートから入手できます。 テンプレート内に該当のワークフローが見つからない場合、ComfyUI のバージョンが古くなっている可能性があります。ワークフローを読み込んだ際にノードが欠落している場合の考えられる原因:
  1. 最新の ComfyUI(Nightly 版)を使用していない
  2. 起動時に一部のノードのインポートに失敗している
Gemma 4 は Google DeepMind による次世代の軽量オープン LLM ファミリーで、テキスト生成、画像理解、動画分析、音声文字起こし、構造化ツール使用のために設計されています。ComfyUI ではネイティブの Text Generation モデルとして統合されています。 モデルのハイライト
  • マルチモーダル設計 — テキスト、画像、動画、音声入力を同時に受け付け可能
  • 3 サイズから選択
    • E2B(2B) — 高速・軽量、コンシューマー GPU に最適
    • E4B(4B) — バランスの取れた性能、推奨デフォルト
    • 31B — 最高品質、より多くの VRAM が必要
  • 思考モード — 回答生成前の段階的推論を内蔵
  • 長いコンテキスト — 最大 128K トークン(E2B/E4B)、256K トークン(31B)
  • 多言語対応 — 35+ 言語を即座にサポート、140+ 言語で事前学習
  • 関数呼び出し — 構造化ツール使用とエージェント型ワークフローをネイティブサポート
  • ComfyUI ネイティブ — 組み込みの TextGenerate ノードと CLIPLoader ノードで読み込み・実行
関連リンク

利用可能なワークフロー

Gemma 4:テキスト生成

テキストプロンプトと、オプションで画像、オーディオ、またはビデオを入力します。設定可能な推論、コーディング、多言語サポートを備えたテキスト出力を生成します。 Gemma 4 テキスト生成ワークフローのプレビュー

Comfy Cloud で実行

Comfy Cloud で開く

ワークフローをダウンロード

JSON をダウンロード、またはテンプレートライブラリで “Gemma4: Text Generation” を検索
入力素材 これらの任意のファイルを対応するノードにアップロードします:

the_lily_veil.png

LoadImage ノード 2 · the_lily_veil.png

voice_demo.mp3

LoadAudio ノード 5 · voice_demo.mp3

video_wan_vace_inpainting_input_video.mp4

LoadVideo ノード 6 · video_wan_vace_inpainting_input_video.mp4
このワークフローは Gemma 4 のコアとなるテキスト生成機能を示しています。テキストプロンプトに加えて、オプションで画像、オーディオファイル、またはビデオを追加コンテキストとして受け付け、推論、コーディング、多言語プロンプトに対応した自然言語出力を生成します。 入力
  • テキストプロンプト:質問または指示
  • 画像(オプション):視覚理解タスク用(OCR、物体検出、チャート読み取りなど)
  • オーディオ(オプション):音声認識または文字起こし用
  • ビデオ(オプション):フレームをまたいだビデオ理解用(内部で 1 FPS にサブサンプリング)
主要な制御パラメータ
  • Max length:生成する最大トークン数(デフォルト 256)
  • Sampling mode:サンプリングのオン/オフを切り替え、temperature、top-k、top-p、繰り返しペナルティ、シードを調整
  • Thinking mode:最終回答の前に段階的推論を有効化
  • Use default template:モデル用の内蔵システムプロンプトを適用
出力
  • Generated text:モデルの応答をプレーンテキスト文字列として返します

Subgraph について

このワークフローは Subgraph ノードを使用してモジュール処理を実現しています。Subgraph ドキュメントでカスタマイズと拡張の方法を確認してください。

モデルのダウンロード

Gemma 4 モデルは ComfyUI ではテキストエンコーダー(text encoder)として読み込まれます。該当するモデルファイルをダウンロードし、正しいディレクトリに配置してください:

Gemma 4 2B (E2B IT FP8)

高速・軽量、コンシューマー GPU に最適。

Gemma 4 4B (E4B IT FP8)

バランスの取れた性能。ワークフローのデフォルトモデル。

全バリアントを表示

すべての Gemma 4 モデルウェイトを閲覧。
ダウンロードした .safetensors ファイルを以下のディレクトリに配置してください: