Skip to main content
FLUX 3 は、Black Forest Labs のマルチモーダル基盤モデルで、2026年7月23日に発表され、現在はアーリーアクセス中です。これは、Self-Flow を基盤とした統一アーキテクチャ内で、画像、ビデオ、オーディオから共同で学習します。Self-Flow は、同じモデル内でマルチモーダル生成と理解を整合させる彼らのアプローチです。各モダリティを個別に扱うのではなく、FLUX 3 は世界の共有表現を学習します。つまり、物体がどのように結びついているか、物事がどのように動くか、出来事がどのように聞こえるかです。機能と制限は、アーリーアクセスの展開中に変更される可能性があります。 ビデオに関して、FLUX 3 は1回の生成で、最大20秒のネイティブオーディオ付きの、非常に多様なクリップを作成します。すべての出力には、環境音、音声、エフェクトを含む同期オーディオ生成が付属します。テキストから動画への生成と画像から動画への生成をサポートしており、個々のクリップをより長いシーケンスへと連結するマルチショット出力と、柔軟なアスペクト比に対応しています。
APIノードを使用するには、正しくログインしていることと、許可されたネットワーク環境で使用していることを確認する必要があります。APIノードの使用に必要な具体的な要件については、ドキュメントの「APIノードの概要」セクションをご参照ください。
ComfyUI が最新版に更新されていることを確認してください。このガイドで紹介するワークフローは、ワークフローテンプレートから入手できます。 テンプレート内に該当のワークフローが見つからない場合、ComfyUI のバージョンが古くなっている可能性があります。ワークフローを読み込んだ際にノードが欠落している場合の考えられる原因:
  1. 最新の ComfyUI(Nightly 版)を使用していない
  2. 起動時に一部のノードのインポートに失敗している

主な機能

  • ネイティブオーディオ: すべてのビデオに同期されたオーディオが付属し、環境サウンド、音声、効果音が含まれます
  • 最大20秒: 1回のパスで長いクリップを生成します
  • テキストと画像の入力: テキストプロンプトからビデオを生成するか、開始フレームの画像から続きを生成します
  • 柔軟なフォーマット: 720pまたは1080pの解像度、24fps、9:16から21:9のアスペクト比に対応
  • マルチショット出力: 個々のクリップを連結して長いシーケンスにし、ストーリーテリングを拡張します

FLUX 3 テキストから動画へのワークフロー

単一のテキストプロンプトから完全なビデオを生成します。FLUX 3 は、参照画像や複雑な設定を必要とせず、自然言語を、オーディオ・モーション・物理が同期された完全なシーンへと展開します。

Comfy Cloud で実行

Comfy Cloud で開く

ワークフローをダウンロード

JSON をダウンロードするか、テンプレートライブラリで「FLUX 3 Video」を検索してください

FLUX 3 画像から動画へのワークフロー

テキストプロンプトと開始フレーム画像から完全なビデオを生成します。FLUX 3 は、あなたの説明を、同期されたオーディオ、モーション、物理演算を伴う一貫性のあるシーンへと自動的に拡張します。

Comfy Cloud で実行

Comfy Cloud で開く

ワークフローをダウンロード

JSON をダウンロードするか、テンプレートライブラリで「FLUX 3 ビデオ」を検索してください
FLUX 3 画像から動画への入力

はじめる

  1. ComfyUIを最新バージョンにアップデートする
  2. テンプレートライブラリに移動して、FLUX 3 Video を検索する