메인 콘텐츠로 건너뛰기
ComfyUI가 최신 버전으로 업데이트되었는지 확인하세요.이 가이드의 워크플로우는 워크플로우 템플릿에서 확인할 수 있습니다. 템플릿에서 찾을 수 없다면, 귀하의 ComfyUI가 오래된 버전일 수 있습니다. (데스크톱 버전의 업데이트는 다소 지연될 수 있습니다)워크플로우를 로드할 때 노드가 누락되는 경우, 가능한 원인:
  1. 최신 ComfyUI 버전(야간 빌드)을 사용하고 있지 않음
  2. 일부 노드가 시작 시 가져오기에 실패함
Gemma 4는 구글 딥마인드에서 개발한 경량 오픈 LLM의 최신 세대이며, 텍스트 생성, 이미지 이해, 비디오 분석, 오디오 전사 및 구조화된 도구 사용을 위해 설계되었습니다. ComfyUI에서는 기본 텍스트 생성 모델로 원활하게 지원됩니다. 모델 주요 특징:
  • 멀티모달 설계 — 텍스트, 이미지, 비디오, 오디오 입력을 동시에 수용합니다.
  • 세 가지 크기 제공:
    • E2B (2B) — 빠르고 가벼워 소비자용 GPU에 적합합니다.
    • E4B (4B) — 균형 잡힌 성능으로, 권장되는 기본 모델입니다.
    • 31B — 최고의 품질을 제공하며 더 높은 VRAM이 필요합니다.
  • 사고 모드 — 답변 생성 전 내장된 단계별 추론 기능
  • 긴 컨텍스트 — 최대 128K 토큰(E2B/E4B) 및 256K 토큰(31B)
  • 다국어 지원 — 기본적으로 35개 이상의 언어를 지원하며, 140개 이상의 언어로 사전 학습됨
  • 함수 호출 — 구조화된 도구 사용 및 에이전트 기반 워크플로에 대한 기본 지원
  • ComfyUI 기본 지원 — 내장된 TextGenerateCLIPLoader 노드를 통해 로드되고 실행됩니다.
관련 링크:

이용 가능한 워크플로

Gemma 4: 텍스트 생성

워크플로 다운로드

JSON 파일을 다운로드하거나 템플릿 라이브러리에서 “Gemma 4 텍스트 생성”을 검색하세요.

Comfy Cloud에서 실행하기

Comfy Cloud에서 열기
Gemma 4 텍스트 생성 워크플로 이 워크플로는 Gemma 4의 핵심 텍스트 생성 기능을 보여줍니다. 텍스트 프롬프트와 함께 추가적인 컨텍스트로 이미지, 오디오 파일 또는 비디오를 선택할 수 있으며, 자연어 출력을 생성합니다. 추론, 코딩 및 다국어 프롬프트까지 지원합니다. 입력:
  • 텍스트 프롬프트 — 질문이나 지침
  • 이미지 (선택사항) — 시각적 이해 작업용 (OCR, 객체 감지, 차트 읽기 등)
  • 오디오 (선택사항) — 음성 인식 또는 오디오 전사용
  • 비디오 (선택사항) — 프레임별 비디오 이해용 (내부적으로 1 FPS로 하위 샘플링됨)
주요 제어 옵션:
  • 최대 길이 — 생성할 최대 토큰 수 (기본값 256)
  • 샘플링 모드 — 샘플링 켜기/끄기 및 온도, top-k, top-p, 반복 페널티, 시드 조정 가능
  • 사고 모드 — 최종 답변 전 단계별 추론 활성화
  • 기본 템플릿 사용 — 모델에 맞는 내장 시스템 프롬프트 적용
출력:
  • 생성된 텍스트 — 모델의 응답을 일반 텍스트 문자열로 반환

서브그래프 알아보기

이 워크플로는 서브그래프 노드를 사용해 모듈식 처리를 수행합니다. 서브그래프 문서를 확인하여 워크플로를 사용자 정의하고 확장하는 방법을 배워보세요.

모델 다운로드

Gemma 4 모델은 ComfyUI에서 텍스트 인코더로 로드됩니다. 관련 모델 파일을 다운로드하여 올바른 디렉토리에 저장하세요:

Gemma 4 2B (E2B IT FP8)

빠르고 가벼움. 소비자용 GPU에 권장됩니다.

Gemma 4 4B (E4B IT FP8)

균형 잡힌 성능. 워크플로의 기본 모델입니다.

모든 변형 보기

모든 Gemma 4 모델 가중치 찾아보기.
다운로드한 .safetensors 파일을 다음 위치에 저장하세요: