Skip to main content
Google Gemini Omni (Video) 使用 Google 的 Gemini Omni Flash 模型,根据文本提示生成带音频的视频。您可以选择附加参考图像和/或视频来引导生成结果或编辑现有素材。请在提示中直接描述所需时长(3-10 秒)。

输入

通用输入

Omni Flash 1.1 输入

Omni Flash 输入

参考输入

注意:
  • prompt 不能为空;如果为空,节点会报错。
  • “text_to_video”任务仅根据提示生成——附加图像或视频会报错。
  • “image_to_video”任务仅接受图像(不接受视频),且需要恰好 1 或 2 张图像:第一张为起始帧,可选的第二张为结束帧。
  • “edit”任务(两种模型均支持)和“extend”任务(仅 Omni Flash 1.1 支持)需要恰好一个输入视频,并保持该输入视频的宽高比,从而覆盖 aspect_ratio
  • 最多可附加 14 张图像和 3 个视频,且每个附加视频的长度必须不超过 10 秒。
  • Omni Flash 始终输出 720p、24 FPS 且带音频的视频;仅 Omni Flash 1.1 提供分辨率选择。
  • temperaturetop_p 控件仅适用于 Omni Flash 模型;Omni Flash 1.1 使用固定的生成设置。

输出

本文档由 AI 生成。如果您发现任何错误或有改进建议,欢迎贡献! 在 GitHub 上编辑

Source fingerprint (SHA-256): 7a0dda4bcd662c9df3c680297ec9de7886d35e618de8b3ce0cd95b9afd13a892