Skip to main content
FLUX 3 是 Black Forest Labs 的多模态基础模型,于 2026 年 7 月 23 日发布,目前处于早期访问阶段。它在基于 Self-Flow 构建的统一架构中联合学习图像、视频和音频。Self-Flow 是他们在同一模型中实现多模态生成与理解对齐的方法。FLUX 3 不会孤立地处理每种模态,而是学习对世界的共享表征:物体如何保持在一起、事物如何运动、事件如何发出声音。随着早期访问的推进,其功能和限制可能会发生变化。 在视频方面,FLUX 3 可在单次生成中创建高度多样化的视频片段,并原生带有最长 20 秒的音频。所有输出均包含同步生成的音频,包括环境声音、语音和效果音。它支持文生视频和图生视频生成,提供多镜头输出,可将单个片段串联成更长的序列,并支持灵活的宽高比。
使用 API 节点需要保证你已经正常登录,并在受许可的网络环境下使用,请参考API 节点总览部分文档来了解使用 API 节点的具体使用要求。
请确保你的 ComfyUI 已经更新。本指南里的工作流可以在工作流模板中找到。如果找不到,可能是 ComfyUI 没有更新。如果加载工作流时有节点缺失,可能原因有:
  1. 你用的不是最新版(每夜版)。
  2. 启动时有些节点导入失败。

主要功能

  • 原生音频:每个视频都附带同步音频,包括环境音、语音和音效
  • 最长 20 秒:单次生成即可产出长片段
  • 文本和图像输入:根据文本提示生成视频,或从起始帧图像继续生成
  • 灵活格式:支持 720p 或 1080p 分辨率、24fps,以及 9:16 到 21:9 的宽高比
  • 多镜头输出:将单个片段串联成更长的序列,以支持更长的叙事

FLUX 3 文生视频工作流

仅凭一条文本提示词即可生成完整视频。FLUX 3 将自然语言扩展为包含同步音频、运动与物理效果的完整场景,无需参考图像或复杂设置。

在 Comfy Cloud 上运行

在 Comfy Cloud 中打开

下载工作流

下载 JSON,或在模板库中搜索“FLUX 3 Video”

FLUX 3 图生视频工作流

根据文本提示和起始帧图像生成完整视频。FLUX 3 会自动将你的描述扩展为连贯的场景,并生成同步的音频、运动和物理效果。

在 Comfy Cloud 上运行

在 Comfy Cloud 中打开

下载工作流

下载 JSON,或在模板库中搜索“FLUX 3 Video”
FLUX 3 图生视频输入

开始使用

  1. 将 ComfyUI 更新到最新版本
  2. 前往模板库,搜索 FLUX 3 Video