真正的多模态
Flux 3 让图像、视频、音频与动作预测共用一套架构,静态与动态输出之间风格与主体保持一致。
Microsoft Clarity 和 Google Analytics 始终启用,用于统计访问、关联跨页面操作、了解访问路径并帮助我们发现问题。
选择“继续”还会启用其他可选体验功能,包括 Google 登录提示。
Cookie 政策Flux 3 是 Black Forest Labs 的全新多模态模型——图像、视频、音频与动作预测共用一套架构,Flux 3 视频已开放抢先体验。在本页准备镜头,进入 Imya 工作台前先看清积分消耗。
使用字节跳动 Seedance 2.0 模型进行文生视频、图生视频和多参考生成。
描述一个镜头,模型会从零生成视频并加入原生音频。
请具体描述主体、镜头运动、光线和氛围。英文提示词通常效果更好。
模型
分辨率
画面比例
生成通常需要几分钟。请保持此标签页打开,完成后视频会显示在这里。
4 秒 · 480p · 16:9 · 音频已开启 · 230 积分
一个模型
图像、视频、音频、动作
最长 20 秒
一条提示词多镜头成片
原生对白
台词随场景一次生成
2026-07-23
BFL 官宣 Flux 3
一套架构,覆盖全媒介
Flux 3 是 Black Forest Labs 于 2026 年 7 月 23 日发布的多模态模型——图像、视频、音频与动作预测在同一套联合训练的架构中生成,而不是把多个模型拼接起来。Flux 3 视频当天即开放抢先体验。
早期测试者反复提到两点:一条提示词生成最长 20 秒、跨多个镜头仍保持连贯的视频,以及从非常模糊的指令中也能"演出来"的对白。Flux 3 尚未接入 Imya——本页如实跟踪进度,同时提供可用的创作器:视频部分暂由 Seedance 2.0 生成,图像部分可直接使用已上线的 Flux 2。
Flux 3 让图像、视频、音频与动作预测共用一套架构,静态与动态输出之间风格与主体保持一致。
Flux 3 用一条提示词生成最长 20 秒的连贯多镜头片段——足够讲一个有开头、发展与结尾的小场景。
演示显示,仅给一个话题 Flux 3 就能生成自然的台词。声音与场景一次生成,不是后期叠加。
FLUX 3 抢先体验
Flux 3 视频目前在抢先体验阶段。这里是真实的进入路径,以及在全面开放前搭建工作流的正确姿势。
Black Forest Labs 通过官方渠道开放 Flux 3 视频抢先体验,发布公告中附有申请入口。名额分批放出,越早申请越有利。
信息源:BFL 2026 年 7 月 23 日的官方公告。
合作平台上出现过限时的 Flux 3 公开预览——有时只持续一两天。它们是真的,但转瞬即逝;当作演示看,别当作工作流。
原则:所有预览消息以 BFL 官方发布为准。
上方创作器今天由 Seedance 2.0 生成——适合多镜头式提示词、支持原生音频、积分价格全公开。Flux 3 上线后同一份草稿直接迁移。
建议:先出 5 秒 720p 草稿锁定镜头。
Flux 图像系列已在 Imya 上线。海报、产品图与写实静帧,Flux 2 现在就能做——同一家族,无需排队。
入口:/flux-2,本页底部也有链接。
三个实用工作流
抢先体验演示集中在三类工作。每一类今天都能用本页创作器出草稿,等 Flux 3 开放后原样重跑。
示例起始图片Flux 3 最出圈的演示是对话:一句话的指令就能让角色吐槽、开玩笑或讲解,台词在场景里直接生成。现在先把构图定下来;保持一个说话者、一种运镜。
“她隔着餐馆桌子俯身,对镜头干脆地说出一句话;钨丝灯暖光,浅景深,缓慢推进,不切镜。”
示例起始图片图像与视频共用一套架构,意味着 Flux 风格的产品静帧可以直接延展成广告而不跑味。今天先用 Flux 2 做主视觉,再到这里让它动起来。
“咖啡的热气升起,晨光缓缓扫过桌面;镜头缓慢环绕半圈,标签保持可读,背景静止。”
示例起始图片测试者最爱用 Flux 3 做历史质感——90 年代摄像机里的教室、颗粒感新闻片、VHS 偏色。写明年代、介质和一个动作,让模型自己补齐瑕疵美学。
“1990 年代家用摄像机画面:教室里孩子们守着笨重的 CRT 电脑;轻微 VHS 偏色,一个孩子回头对镜头咧嘴笑,手持晃动。”
FLUX 3 镜头图库
Flux 3 抢先体验用户反复回到的几种质感参考帧,以及多模态架构的组合方式。每张都是起始帧示例,不代表保证输出。

Black Forest Labs 把图像、视频、音频与动作预测联合训练,因此同一主体的静帧与视频保持同样的质感。这正是 Flux 静帧能延展成 20 秒广告而不跑味的原因。




FLUX 3 提示词
Flux 3 对松散指令的响应好于多数模型,但结构化仍然更稳。四段式——同样适用于本页当前的模型。
主体动作 + 对白或声音 + 镜头运动 + 年代与风格
一个可见动作定住镜头:俯身向前、转向镜头、举起杯子。先写动词,再谈形容词。
给 Flux 3 一个话题或一句台词——"吐槽堵车"就足够出演示级效果。今天的无声模型会自动忽略这一行。
每个镜头一种运动:推、跟、环绕、手持晃动或固定。多镜头靠有序节拍实现,不靠叠加运镜。
Flux 3 擅长具名介质:90 年代摄像机、16mm 新闻片、现代数码。介质加最多两个瑕疵特征,写一次就停。
完整提示词示例
“疲惫的新闻主播理了理稿纸,对天气面无表情地播报一句;1980 年代广播画风,轻微扫描线与磁带抖动,固定机位,演播室底噪垫在声音下。”
一个动作、一句台词、一个固定机位、一种具名年代及其瑕疵——这正是 Flux 3 演示所奖励的四段结构,在今天的模型上也是一条干净的无声草稿。
使用流程
可以直接文生视频、用首帧和可选尾帧做图生视频,或组合参考图片、视频与音频。
写清场景,添加所需的参考素材,再选择时长、分辨率、比例和音频。提交前实时更新积分报价。
需要时先登录,确认屏幕上的 Seedance 2.0 积分后提交一次。进度与完成视频会显示在参数右侧。
真实限制与积分
本 Flux 3 页面的积分报价始终对应创作器中实际选中的模型。Flux 3 公布的能力——20 秒多镜头、原生对白——一律标注"官方公布",不当作已上线功能出售。
输入
文字、首尾帧或参考素材
格式
图片、MP4/MOV 与音频
Imya 上传上限
每个文件 30 MB
提示词
最长 5,000 字符
时长
Seedance 2.0 为 4–15 秒
分辨率
480p / 720p / 1080p
报价跟随所选模型、时长与分辨率——在默认的 Seedance 2.0 上,5 秒 720p 草稿是锁定镜头的省钱方案。符合条件的会员折扣在继续前自动生效。
按工作流选择
把公布中的 Flux 3、它的图像前代与当前为本页服务的视频模型放在一起看。公布中的规格均已标注。
在 Imya 的状态
BFL 抢先体验中——尚未接入 Imya
标志性能力
官方公布:20 秒多镜头视频、原生对白、单一多模态架构
适合选择的时机
你想要图像、视频、音频风格一致——关注本页等切换。
在 Imya 的状态
图像功能现已上线
标志性能力
写实静帧、海报与产品图,结果可编辑
适合选择的时机
今天就要 Flux 质感的静态图——主视觉可在本页动起来。
在 Imya 的状态
现已上线(本页默认)
标志性能力
4–15 秒、最高 1080p、原生音频、六种画面比例
适合选择的时机
今天就要真实出片、带声音、价格全公开。
先用低价短草稿验证。等 Flux 3 开放后,用同一张起始图和提示词重跑一次,用自己的素材判断升级幅度。
修正草稿
以下修正方法适用于当前为本页服务的模型,Flux 3 上线后同样适用——一次只改一个变量的纪律永远不变。
年代描述堆了太多互相竞争的瑕疵特征,或起始图与所写介质冲突。
介质只写一次、瑕疵最多两个,并从已调成对应年代色调的图片出发。
所选模型输出无声或仅环境声——对白是 Flux 3 的亮点,仍在抢先体验中。
台词留在提示词里备用,今天切到支持音频的模型出环境声,人声后期补录。
多节拍提示词暴露未见过的角度,且原图人像偏软。
更清晰的起始图、更小的转动,写明"保持面部一致",并减少单条片段的节拍数。
几秒内塞进了多个动作、特效与镜头运动。
一个动作、一种运镜、一行年代描述。删掉形容词,直到物理运动清晰可读。
隐私与保留
登录前即可准备起始图片、提示词与设置,此阶段图片仅保存在此设备的浏览器中。点击生成会保存一份短期本地草稿;登录后,Imya 仅为完成本次生成而上传媒体,由 Imya 与签约的 AI 处理服务商处理。
阅读完整的 Imya 隐私政策访问 Black Forest Labs 官方网站所选图片不会被上传。清除草稿或浏览器存储即可从设备上删除本地准备数据。
结果遵循 Imya 历史保留策略:免费账户 7 天,付费或 Lifetime 会员最长 30 天。你可以随时提前删除。
Imya 是独立产品界面;Flux 是 Black Forest Labs 的模型系列。Imya 不声称官方合作,不出售你的文件,也不用它们训练 Imya 自有模型。
常见问题
Flux 3 是 Black Forest Labs 于 2026 年 7 月 23 日发布的多模态模型——一套架构生成图像、视频、音频与动作预测,是 Flux 图像系列之后的新一代。
能——视频正是主打。Flux 3 视频用一条提示词生成最长 20 秒的多镜头片段,并在发布当天开放抢先体验。
能。演示显示它能从松散指令中生成自然台词,外加环境声与音效——声音属于同一次生成,不是后期叠加。
通过 Black Forest Labs 官方公告中的申请入口报名。合作平台也出现过限时公开预览,但窗口很短。
2026 年 7 月 23 日官宣,Flux 3 视频当天进入抢先体验。全面开放时间未公开固定;接入 Imya 后本页创作器默认自动切换。
Flux 2 是图像模型;Flux 3 把图像、视频、音频折叠进一套架构,新增 20 秒多镜头视频与原生对白。Flux 2 目前仍在 Imya 提供静态图生成。
还不能——Flux 3 处于 BFL 抢先体验阶段。本页创作器目前由 Seedance 2.0 生成,生成按钮下方有明确说明;图像侧可用 Flux 2。
在本页准备输入免费。新账号赠送 20 积分,实际 Seedance 2.0 报价会在生成前显示。Flux 3 在 Imya 的价格将在模型上线时公布。
不一样。搜索结果常把它与塞尔达的 Flux Construct III 或物理学的"通量"混在一起。本页讨论的是 Black Forest Labs 的 Flux 3 AI 模型——图像、视频与音频生成。