Skip to main content
Google Gemini Omni (Video) は、Google の Gemini Omni Flash モデルを使用して、テキストプロンプトから音声付き動画を生成します。必要に応じて参照画像や参照動画を添付し、結果をガイドしたり、既存の映像を編集したりすることもできます。希望する長さ(3〜10秒)はプロンプトに直接記述してください。

入力

共通入力

Omni Flash 1.1 入力

Omni Flash 入力

参照入力

注記:
  • prompt は空にできません。空の場合、ノードはエラーを発生させます。
  • text_to_video タスクはプロンプトのみから生成します。画像や動画を添付するとエラーが発生します。
  • image_to_video タスクは画像のみ(動画不可)を受け付け、画像が正確に1枚または2枚必要です。1枚目が開始フレーム、2枚目(任意)が終了フレームです。
  • edit タスク(両モデル)と extend タスク(Omni Flash 1.1 のみ)は、入力動画が正確に1本必要です。また、aspect_ratio を上書きして、その入力動画のアスペクト比を維持します。
  • 添付できる画像は最大14枚、動画は最大3本です。また、添付する各動画は10秒以下である必要があります。
  • Omni Flash は常に720p・24 FPSの音声付き動画を出力します。解像度の選択は Omni Flash 1.1 でのみ利用できます。
  • temperaturetop_p のコントロールは Omni Flash モデルでのみ利用できます。Omni Flash 1.1 は固定の生成設定を使用します。

出力

このドキュメントは AI によって生成されました。エラーを見つけた場合や改善のご提案がある場合は、ぜひ貢献してください! GitHub で編集

Source fingerprint (SHA-256): 7a0dda4bcd662c9df3c680297ec9de7886d35e618de8b3ce0cd95b9afd13a892