Skip to main content
使用 Google 的 Gemini Omni Flash 模型,根据文本提示生成带音频的视频。可以选择提供参考图片和/或视频来指导或编辑生成结果。请在提示中直接描述所需的时长(3-10秒)和宽高比(16:9 或 9:16)。

输入

注意:
  • 如果图片输入包含多帧,则每一帧都计入 14 张图片的上限。
  • 当提供 imagesvideos 时,编码后媒体的总大小必须保持在大约 90 MB 以下;否则节点会引发错误。

输出

本文档由 AI 生成。如果您发现任何错误或有改进建议,欢迎贡献! 在 GitHub 上编辑

Source fingerprint (SHA-256): 1b7ca51d07cfb6a166cfed2a7e7174fd62f3290abcc1bdfdce94369dda242d3f