- 멀티모달 설계 — 텍스트, 이미지, 비디오, 오디오 입력을 동시에 수용합니다.
- 세 가지 크기 제공:
- E2B (2B) — 빠르고 가벼워 소비자용 GPU에 적합합니다.
- E4B (4B) — 균형 잡힌 성능으로, 권장되는 기본 모델입니다.
- 31B — 최고의 품질을 제공하며 더 높은 VRAM이 필요합니다.
- 사고 모드 — 답변 생성 전 내장된 단계별 추론 기능
- 긴 컨텍스트 — 최대 128K 토큰(E2B/E4B) 및 256K 토큰(31B)
- 다국어 지원 — 기본적으로 35개 이상의 언어를 지원하며, 140개 이상의 언어로 사전 학습됨
- 함수 호출 — 구조화된 도구 사용 및 에이전트 기반 워크플로에 대한 기본 지원
- ComfyUI 기본 지원 — 내장된
TextGenerate및CLIPLoader노드를 통해 로드되고 실행됩니다.
이용 가능한 워크플로
Gemma 4: 텍스트 생성
워크플로 다운로드
JSON 파일을 다운로드하거나 템플릿 라이브러리에서 “Gemma 4 텍스트 생성”을 검색하세요.
Comfy Cloud에서 실행하기
Comfy Cloud에서 열기
이 워크플로는 Gemma 4의 핵심 텍스트 생성 기능을 보여줍니다. 텍스트 프롬프트와 함께 추가적인 컨텍스트로 이미지, 오디오 파일 또는 비디오를 선택할 수 있으며, 자연어 출력을 생성합니다. 추론, 코딩 및 다국어 프롬프트까지 지원합니다.
입력:
- 텍스트 프롬프트 — 질문이나 지침
- 이미지 (선택사항) — 시각적 이해 작업용 (OCR, 객체 감지, 차트 읽기 등)
- 오디오 (선택사항) — 음성 인식 또는 오디오 전사용
- 비디오 (선택사항) — 프레임별 비디오 이해용 (내부적으로 1 FPS로 하위 샘플링됨)
- 최대 길이 — 생성할 최대 토큰 수 (기본값 256)
- 샘플링 모드 — 샘플링 켜기/끄기 및 온도, top-k, top-p, 반복 페널티, 시드 조정 가능
- 사고 모드 — 최종 답변 전 단계별 추론 활성화
- 기본 템플릿 사용 — 모델에 맞는 내장 시스템 프롬프트 적용
- 생성된 텍스트 — 모델의 응답을 일반 텍스트 문자열로 반환
서브그래프 알아보기
이 워크플로는 서브그래프 노드를 사용해 모듈식 처리를 수행합니다. 서브그래프 문서를 확인하여 워크플로를 사용자 정의하고 확장하는 방법을 배워보세요.
모델 다운로드
Gemma 4 모델은 ComfyUI에서 텍스트 인코더로 로드됩니다. 관련 모델 파일을 다운로드하여 올바른 디렉토리에 저장하세요:Gemma 4 2B (E2B IT FP8)
빠르고 가벼움. 소비자용 GPU에 권장됩니다.
Gemma 4 4B (E4B IT FP8)
균형 잡힌 성능. 워크플로의 기본 모델입니다.
모든 변형 보기
모든 Gemma 4 모델 가중치 찾아보기.
.safetensors 파일을 다음 위치에 저장하세요: