本当の意味でマルチモーダル
画像・動画・音声・動作予測が1つのアーキテクチャを共有するため、静止画と動画を行き来してもスタイルと被写体が保たれます。
Microsoft Clarity と Google Analytics は常に有効で、訪問数の測定、ページをまたぐ操作の関連付け、訪問者の導線の把握、不具合の発見に使用されます。
「続行」を選ぶと、Google ログイン案内を含むその他の任意機能も有効になります。
CookieポリシーFlux 3はBlack Forest Labsの新しいマルチモーダルモデルです。画像・動画・音声・動作予測を1つのアーキテクチャで扱い、Flux 3 Videoは早期アクセス中。ここでカットを準備し、必要なクレジットを正確に確認してからImyaワークスペースへ進めます。
ByteDanceのSeedance 2.0モデルで、テキストから動画、画像から動画、マルチリファレンス生成を行えます。
シーンを文章で説明すると、ネイティブ音声付きの動画をゼロから生成します。
被写体、カメラワーク、照明、雰囲気を具体的に書いてください。英語のプロンプトが最も安定します。
モデル
解像度
アスペクト比
生成には数分かかります。このタブを開いたままにしてください。完了した動画はここに表示されます。
4秒 · 480p · 16:9 · 音声あり · 230クレジット
モデル1つ
画像・動画・音声・動作
最大20秒
1プロンプトでマルチショット
セリフ
シーンと同時に音声を生成
2026年7月23日
BFLがFlux 3を発表
1つのアーキテクチャ、すべてのメディア
Flux 3は、Black Forest Labsが2026年7月23日に発表したマルチモーダルモデルです。個別のモデルをつなぎ合わせるのではなく、1つの共同学習アーキテクチャが画像・動画・音声・動作予測を生成します。Flux 3 Videoは同日に早期アクセスが開始されました。
早期テスターが挙げる特徴は2つ。1つのプロンプトから複数カットにまたがって破綻しない最大20秒のクリップと、かなり曖昧な指示からでも成立するセリフです。Flux 3はまだImyaには載っていません。本ページはアクセス状況を正直に追いながら、動画はSeedance 2.0、画像はFlux 2で、今日から動く作成ツールを提供します。
画像・動画・音声・動作予測が1つのアーキテクチャを共有するため、静止画と動画を行き来してもスタイルと被写体が保たれます。
1つのプロンプトから、つながった複数カットで最大20秒を生成します。起承転結のあるシーンを収めるのに十分な長さです。
デモでは、話題を伝える程度の指示からFlux 3がセリフを生成しています。音声は後乗せではなく、シーンと同時に生成されます。
FLUX 3 早期アクセス
Flux 3 Videoは現在、早期アクセスの制限下にあります。実際に入れるルートと、一般公開前にワークフローを組んでおく現実的なやり方をまとめます。
Black Forest LabsはFlux 3 Videoの早期アクセスを自社チャネルで運用しており、発表記事から申込先にリンクしています。枠は段階的に開放されるため、早めの申請が効きます。
出典:2026年7月23日のBFL公式発表。
期間限定のFlux 3プレビューがパートナープラットフォームに登場することがあり、1〜2日で終わる場合もあります。本物ですが一時的なので、ワークフローではなくデモとして扱ってください。
原則:プレビューの真偽はBFL自身の投稿で確認する。
上の作成ツールは今日、Seedance 2.0で生成します。マルチショット向きのプロンプト、ネイティブ音声、公開されたクレジット価格。同じ下書きはFlux 3の接続時にそのまま引き継がれます。
おすすめ:まず5秒720pの下書きでカットを固める。
Flux画像ラインはすでにImyaで稼働中です。ポスター、商品カット、フォトリアルな静止画ならFlux 2が今日から使えます。同じファミリー、待機リストなし。
/flux-2 にあります。本ページ下部からもリンクしています。
実用的な3つのワークフロー
早期アクセスのデモは3つの用途に集まっています。いずれも本ページの作成ツールで今日下書きでき、アクセスが開いたらFlux 3で再実行できます。
開始画像の例Flux 3の目玉デモは会話です。一行の指示から、まくし立てる・冗談を言う・説明する人物が生まれ、セリフはシーン内で生成されます。今は構図を固めましょう。話者1人、カメラ移動1つに絞ります。
“彼女はダイナーのテーブル越しに身を乗り出し、カメラに向かって乾いた一言を放つ。タングステン光、浅い被写界深度、ゆっくりとしたプッシュイン、カットなし。”
開始画像の例画像と動画が1つのアーキテクチャを共有するため、Flux調の商品静止画がルックを崩さずスポットへ展開できます。ヒーローフレームは今日Flux 2で用意し、ここで動かします。
“コーヒーから湯気が立ち、朝の光がテーブルを横切っていく。カメラはゆっくり半周し、ラベルは読める状態を保ち、背景は静止したまま。”
開始画像の例テスターがFlux 3を評価しているのは時代の質感です。90年代のカムコーダーで撮った教室、粒状のニュース映像、VHSの色にじみ。時代・媒体・動作を1つずつ指定し、質感はモデルに任せます。
“1990年代のカムコーダー映像:教室で大きなCRTパソコンに向かう子どもたち。わずかなVHSの色にじみ、ひとりがレンズを振り返って笑う、手持ちの揺れ。”
FLUX 3 ショットライブラリ
Flux 3の早期テスターが繰り返し使っているルックの参考フレームと、マルチモーダルアーキテクチャの構成です。いずれも開始フレームの例であり、出力を保証するものではありません。

Black Forest Labsは画像・動画・音声・動作予測を同時に学習させています。そのため同じ被写体の静止画とクリップでルックが揃い、Flux系の静止画がぶれずに20秒のスポットへ展開できます。




FLUX 3 プロンプト
Flux 3は多くのモデルより曖昧な指示に強いものの、構造があるほうが結果は安定します。4つの要素で組み立てます。この形は作成ツールの現行モデルでもそのまま有効です。
被写体の動作 + セリフか音 + カメラ移動 + 時代とスタイル
目に見える動作を1つ置いてカットを固定します。テーブル越しに身を乗り出す、レンズを振り返る、カップを持ち上げる。まず動詞、形容詞は後です。
話題か一行を与えます。「渋滞について愚痴る」程度でもデモ水準の演技になります。現行の無音モデルでは、この行は単に無視されます。
1カットにつき1つ。プッシュ、トラック、オービット、手持ちの揺れ、固定のいずれか。マルチショットは移動を重ねるのではなく、順序立てた拍から生まれます。
Flux 3は名前のある媒体が得意です。90年代カムコーダー、16mmニュース映像、現代のデジタル。媒体とその質感を一度だけ指定し、そこで止めます。
完成プロンプトの例
“疲れたニュースキャスターが原稿を整え、天気について無表情に一言。1980年代の放送ルック、わずかな走査線とテープの揺れ、固定カメラ、声の下にスタジオのハム音。”
動作1つ、セリフ1行、固定カメラ1つ、名前のある時代とその質感1組。Flux 3のデモが報いる4部構成であり、現行モデルでも無音の下書きとしてきれいにまとまります。
使い方
テキストから始める、最初のフレーム(任意で最後のフレームも)を動かす、または参照画像・動画・音声を組み合わせます。
シーンを書き、必要な参照メディアを加えたら、長さ・解像度・画面構成・音声を選びます。送信前にクレジット見積もりがリアルタイムで更新されます。
必要ならログインし、表示されたSeedance 2.0のコストを確認して1回だけ送信します。進行状況と完成した動画はコントロールの横に表示されます。
実際の制限とクレジット
このFlux 3ページは、作成ツールで実際に選択されているモデルに対してクレジットを見積もります。発表済みのFlux 3の機能(20秒マルチショット、ネイティブのセリフ)は「発表済み」として明示し、稼働中の機能として売り込むことはしません。
入力
テキスト、フレーム、参照メディア
形式
画像、MP4/MOV、音声
Imyaのアップロード上限
1ファイルあたり30MB
プロンプト
最大5,000文字
長さ
Seedance 2.0で4〜15秒
解像度
480p / 720p / 1080p
見積もりは選択したモデル・長さ・解像度に連動します。既定のSeedance 2.0なら、5秒720pの下書きが安価にカットを固める方法です。対象のメンバーシップは、続行前に割引が自動適用されます。
ワークフローで選ぶ
発表済みのFlux 3が、画像専用の前世代と、今このページを支えている動画モデルに対してどう位置づくか。発表済みの仕様はその旨を明示しています。
Imyaでの状態
BFLで早期アクセス — Imyaには未接続
得意なこと
発表済み:20秒マルチショット動画、ネイティブのセリフ、1つのマルチモーダルアーキテクチャ
選ぶ場面
画像・動画・音声を1つのモデルで揃えたいとき。切り替えは本ページで告知します。
Imyaでの状態
画像で稼働中
得意なこと
フォトリアルな静止画、ポスター、商品カット、編集可能な結果
選ぶ場面
Fluxのルックを今日、静止画で使いたいとき。本ページで動かすヒーローフレームにもなります。
Imyaでの状態
稼働中(本ページの既定)
得意なこと
4〜15秒、最大1080p、ネイティブ音声、アスペクト比6種類
選ぶ場面
公開された価格で、音付きの動画を今日実際に生成したいとき。
まずは短く安く下書きを。Flux 3が開放されたら、同じ開始画像とプロンプトで再実行し、自分の素材でアップグレードを判断してください。
下書きを直す
ここでの対処は現在このページを支えているモデルに当てはまり、Flux 3にもそのまま通用します。一度に1つだけ変えるという原則は変わりません。
互いに competing する質感を並べすぎているか、開始画像が指定した媒体と矛盾しています。
媒体は一度だけ、質感は多くても2つ。すでに時代に近い色調の画像から始めてください。
選択中のモデルは無音、または環境音のみを出力します。ネイティブのセリフは早期アクセス中の目玉機能です。
セリフはプロンプトに残しておき、今日は環境音に対応したモデルに切り替えて、声は後工程で足してください。
拍を重ねたプロンプトは未撮影の角度を引き出し、元のポートレートが甘いと破綻します。
開始画像をシャープに、振り向きは小さく、「顔を一貫させる」と明示。1クリップあたりの拍も減らします。
数秒の中で複数の動作・効果・カメラ移動が競合しています。
動作1つ、カメラ移動1つ、時代の記述1行。物理的な動きがはっきり読めるまで形容詞を削ってください。
プライバシーと保存期間
ログイン前に開始画像・プロンプト・設定を準備できます。準備中、画像はこの端末のブラウザ内に留まります。「生成」を押すと短期間のローカル下書きが保存され、ログイン後、Imyaはリクエストされた生成をImyaおよび委託先のAI処理事業者を通じて提供する目的でのみメディアをアップロードします。
Imyaプライバシーポリシー全文を読むBlack Forest Labs公式サイトを見る選択した画像はアップロードされません。下書きやブラウザのストレージを消去すると、この端末からローカルの準備データが削除されます。
結果はImyaの履歴保存ポリシーに従います。無料アカウントは7日間、有効な有料またはLifetimeメンバーは最大30日間です。いつでも結果を先に削除できます。
Imyaは独立したインターフェースであり、FluxはBlack Forest Labsのモデルファミリーです。Imyaは提携を主張せず、ファイルを販売せず、Imya所有モデルの学習にも使用しません。
よくある質問
Flux 3は、Black Forest Labsが2026年7月23日に発表したマルチモーダルモデルです。1つのアーキテクチャで画像・動画・音声・動作予測を生成し、Flux画像ラインの後継にあたります。
はい、動画が目玉です。Flux 3 Videoは1つのプロンプトから複数カットにまたがる最大20秒のクリップを生成し、発表と同日に早期アクセスが始まりました。
はい。デモでは曖昧な指示からシーンと同時にセリフが生成され、環境音や効果音も出ています。音声は別工程ではなく、同じ生成の一部です。
Black Forest Labs公式の早期アクセス申込から取得します。2026年7月23日の発表記事にリンクがあります。パートナープラットフォームで短期の一般プレビューが出ることもあります。
2026年7月23日に発表され、Flux 3 Videoは初日から早期アクセスです。一般提供の日程は公表されていません。本ページはFlux 3がImyaに載った時点で作成ツールの既定を切り替えます。
Flux 2は画像モデルです。Flux 3は画像・動画・音声を1つのアーキテクチャにまとめ、20秒のマルチショット動画とネイティブのセリフを追加しました。静止画については、Flux 2が今日もImyaで稼働しています。
まだ使えません。Flux 3はBFLで早期アクセス中です。本ページの作成ツールは今日Seedance 2.0で生成し、その旨を生成ボタンの下に明記しています。画像側はFlux 2が担当します。
ここでの入力準備は無料です。新規アカウントには20クレジットが付与され、生成前にSeedance 2.0のリアルタイム見積もりが表示されます。ImyaでのFlux 3の価格はモデル稼働時に公開します。
いいえ。検索ではゼルダのフラックス・コンストラクトIIIや物理の「フラックス(磁束)」と混ざります。本ページはBlack Forest LabsのAIモデルFlux 3、すなわち画像・動画・音声の生成についてのページです。
開始画像とプロンプトを今のうちに固め、現行モデルで下書きしておけば、Flux 3が稼働した瞬間に本ページが同じワークフローをそのまま引き渡します。
Flux 3の下書きを準備する