Google Gemini
体验 Google 的多模态 AI 与 Gemini 的推理能力。
在 Comfy Cloud 上运行
在 Comfy Cloud 中打开
下载工作流
下载 JSON 或在模板库中搜索 “Google Gemini”
LoadImage 节点:
example.png
LoadImage 节点 2 · example.png
按步骤完成工作流的执行

在对应模板中,我们构建了一个用于分析并生成角色提示词的提示词,用于将你的图像解读成对应的绘图提示词。
- 在
Load Image节点中加载需要 AI 解读的图像。 - (可选)如果需要,你可以修改
Google Gemini中的提示词,从而让 AI 来执行特定任务。 - 点击
Run按钮,或使用快捷键Ctrl(cmd) + Enter来执行对话。 - 等待 API 返回结果后,你可在
Preview Any节点中查看对应 AI 返回的内容。
补充说明
- 目前文件输入节点
Gemini Input Files需要先将文件上传至ComfyUI/input/目录下,此节点正在改进,我们会在更新后修改模板。 - 工作流中提供了使用
Batch Images来输入的示例。如果你有多张图像需要 AI 解读,可参考步骤图,使用右键将对应的节点模式设置为总是(Always)来启用。