模型亮点
- 音频驱动的舞蹈生成:直接从音乐生成舞蹈动作,无需手动关键帧或动作捕获
- 分层框架:两阶段架构(全局+局部),实现连贯的身体运动和精细的动作优化
- 音乐同步输出:舞蹈动作自然对齐到输入音频的节奏和速度
- 风格控制:可配置的舞蹈风格和动作幅度,提供创意方向
- 分钟级生成:生成长格式连贯舞蹈视频,全时段保持时空一致性
工作流总览
Wan万相 Dancer 工作流接受两个输入:角色参考图像和一个音频文件。它生成两个视频输出:一个全局输出预览,展示整体舞蹈结构;以及一个最终精炼输出,带有增强的动作细节。Wan Dancer 工作流
Wan Dancer:音乐驱动舞蹈(video_wan_dancer)
使用分层 Wan Dancer 框架,从音乐生成长达分钟级且连贯的舞蹈视频。输入音乐文件和参考图像,即可生成同步的舞蹈视频。
在 Comfy Cloud 上运行
在 Comfy Cloud 中打开
下载工作流
下载 JSON 或在模板库中搜索“Wan Dancer”
blue_dancer.png
LoadImage 节点 547 · blue_dancer.pngwan_dancer_reference_audio.mp3
LoadAudio 节点 548 · wan_dancer_reference_audio.mp3
3. 手动下载模型
扩散模型 LoRA 文本编码器 CLIP 视觉 VAE4. 工作流说明
-
加载参考图像:使用“加载图像”节点上传角色图像。默认输入为
blue_dancer.png。 -
加载音频文件:使用“加载音频”节点上传音乐或音频轨道。默认输入为
wan_dancer_reference_audio.mp3。 -
配置舞蹈参数:
dance_style:选择输出视频的舞蹈风格motion_amplitude:控制舞蹈动作的强度audio_duration:设置为与输入音频的时长匹配final_duration:选择最终输出视频的时长
-
配置输出尺寸:
width和height:设置输出视频的分辨率。请根据 GPU 的可用显存选择合适的值。
-
验证模型路径:确保模型选择器指向正确的模型文件:
global_model:应加载wan2.2_dancer_14b_global_fp8_scaled.safetensorslocal_model:应加载wan2.2_dancer_14b_local_fp8_scaled.safetensorslightning_lora:应加载lightx2v_I2V_14B_480p_cfg_step_distill_rank64_bf16.safetensorsclip_vision:应加载clip_vision_h.safetensors
-
运行生成:点击“运行”按钮或使用快捷键
Ctrl(Cmd) + Enter执行视频生成。
5. 输出
工作流产生两个视频输出:- 全局输出预览:显示全局模型生成的舞蹈整体结构
- 最终输出:经局部模型优化后的精细舞蹈视频
SaveVideo 节点自动保存。
模型信息
Wan Dancer 是一个基于 Apache 2.0 许可证发布的开源模型。模型权重可在 Hugging Face 上获取:- Comfy-Org/Wan-Dancer:全局和局部扩散模型
反馈问题
如果您遇到运行时错误或意外行为:- 确保 ComfyUI 已更新到最新版本
- 检查所有必填模型是否已下载并放置在正确的目录中
- 对于桌面/云端用户:更新跟随稳定版本发布,因此每夜支持的模型可能无法立即使用