使用 FLUX 3 生成电影级视频

探索文生视频、图生视频和参考引导生成,支持同步音频、关键帧控制与最长 20 秒视频。

Flux 3 Video

文生视频 · 图生视频 · 原生音频 · 精准控制

什么是 FLUX 3?

FLUX 3 是 Black Forest Labs 面向图像、视频、音频与动作预测的多模态基础模型。
FLUX 3 可根据文本提示词、图片和参考视频生成最长 20 秒、带原生音频的视频。

FLUX 3 官方文生视频展示

这些 FLUX 3 官方展示视频使用 Black Forest Labs 发布的素材。
Black Forest Labs 尚未公布原始提示词;可通过每段视频下方的来源链接查看官方展示。

FLUX 3 图生视频

FLUX 3 可以让起始帧动起来,也可以通过参考图片引导主体、角色与视觉风格。
第一项采用 Black Forest Labs 发布的 FLUX 3 官方展示预览,其原始输入图片和提示词尚未公开。其余项目用于说明图生视频工作流,并非 FLUX 3 输出。
原始图片
黄金时刻,柔和光线,温暖且饱和的色彩,广角镜头,构图重心偏左。一位饱经风霜的贡多拉船夫站在平底船上,用长木杆撑船穿过被水淹没的威尼斯遗迹。两侧破败建筑爬满藤蔓,锈蚀的金属构件与逐渐坍塌入水的立面清晰可见。镜头缓慢向前移动并向左倾斜,展现夕阳琥珀色光芒中的城市遗迹。坍塌的拱门与破损的穹顶剪影映在金色天际,静止水面倒映天空与周围建筑的暖色。
提示词

黄金时刻,柔和光线,温暖且饱和的色彩,广角镜头,构图重心偏左。一位饱经风霜的贡多拉船夫站在平底船上,用长木杆撑船穿过被水淹没的威尼斯遗迹。两侧破败建筑爬满藤蔓,锈蚀的金属构件与逐渐坍塌入水的立面清晰可见。镜头缓慢向前移动并向左倾斜,展现夕阳琥珀色光芒中的城市遗迹。坍塌的拱门与破损的穹顶剪影映在金色天际,静止水面倒映天空与周围建筑的暖色。

视频
原始图片
让变化瞬间发生。
提示词

让变化瞬间发生。

视频

FLUX 3 能力

FLUX 3 在统一的多模态架构中联合训练图像、视频与音频,支持原生同步音频、视觉参考、视频续写、关键帧转场和多语言对话。

最长 20 秒视频

FLUX 3 单次生成可创建最长 20 秒的视频,并同步生成音频。

多模态参考

通过文本、图片和参考视频引导动画、转换与续写工作流。

视频与原生音频

同时生成画面与同步声音,包括对白、环境音和音效。

视频续写

从输入视频及其音频继续创作,或将参考片段的核心元素带入新的情境。

关键帧控制

定义重要视觉时刻,并生成受控的关键帧间转场。

多语言对话

在丰富多样的视觉风格中创建包含多语言对话的场景。

可以用 FLUX 3 Video 创作什么?

FLUX 3 Video 将提示词、图片、参考素材、运动和声音整合到同一个多模态创作流程中。它不只适合生成孤立的 AI 片段,还能帮助创作者为叙事、营销、设计和前期制作规划完整的视听场景,并控制主体的外观、运动、对白以及随时间发生的变化。

电影概念与预演

在投入完整制作前,用 FLUX 3 Video 探索场景。可以在一份创意说明中描述地点、主体、动作、构图、镜头特征、相机运动、光线、节奏、对白和环境音。导演与创意团队可借此测试视觉方案、比较不同方向,并通过故事板、提案影片和电影预演清晰传达创作意图。

产品与营销视频

从产品图片或其他视觉参考出发,确定形态、材质、色彩、造型与品牌语境,再将主体置入运动与同步音效均可控制的场景。该工作流适用于产品亮相、发布概念、广告方案、电商视觉和营销团队的早期创意探索。

角色驱动的视觉故事

参考引导生成可以帮助角色或核心视觉元素在不同场景间延续,再结合表情、动作、环境、镜头和氛围提示。FLUX 3 Video 面向需要在连续镜头中保持身份与故事语境的工作流,包括短篇叙事、品牌角色、音乐视频概念和系列化创意。

多语言对话与社交内容

让口语对白、面部表情、环境声以及与物理事件对应的音效在同一场景中协同呈现。FLUX 3 Video 已公布的多语言能力可支持面向不同受众和市场的创意,包括竖屏视频、短营销创意、对白驱动内容和本地化版本。

动画、文字排版与视觉设计

FLUX 3 Video 不局限于传统电影写实风格。其公布能力包括多样化风格、动画设计和较强的文字生成。创作者可以探索风格化动画、动态图形、标题驱动片段、纪实画面或精致电影处理,并利用参考与提示词保持视觉语言与原始创意一致。

视频续写与多镜头序列

可以从输入视频及其音频继续创作,将参考素材转化到新情境,或把多个片段连接成长序列。视觉参考有助于保留核心元素,同时通过不同提示词改变地点、动作、镜头和情绪,从而发展连续的多镜头故事。

如何探索 FLUX 3 Video

用四个步骤写好视频创意说明

从清晰的场景开始,加入合适的参考,指导运动与声音,再根据结果持续优化。

1

描述场景

在提示词中说明主体、环境、镜头方向、运动、氛围,以及场景应如何开始和结束。

2

添加视觉参考

准备图片或参考视频,引导主体、角色、环境、视觉风格与运动;在模型支持时,来源音频也可用于对白与续写。

3

指导运动与声音

明确相机运动、动作、节奏、对白、环境音和音效,让场景具有清晰的视听方向。

4

生成并优化

生成场景,检查运动与声音,然后每次只调整一个创意变量。

常见问题

FLUX 3 Video 常见问题

了解 FLUX 3 能力、多模态参考和生成工作流。

1

什么是 FLUX 3?

FLUX 3 是 Black Forest Labs 面向图像、视频、音频与动作预测的多模态基础模型。

2

Black Forest Labs 公布了哪些视频能力?

FLUX 3 已公布的能力包括文生视频、图生视频、视频转视频、视频与音频续写、关键帧转场、原生音频和多语言对话。

3

FLUX 3 可以生成多长的视频?

Black Forest Labs 表示,FLUX 3 单次生成可创建最长 20 秒、带音频的视频。

4

FLUX 3 Video 会生成原生音频吗?

会。FLUX 3 Video 在多模态架构中联合生成视频和音频。已公布能力包括同步对白、环境音、与物理事件对应的音效以及多语言对话,让创作者可以在同一场景中同时规划画面与声音。

5

FLUX 3 Video 能创作更长的多镜头故事吗?

FLUX 3 Video 单次可生成最长 20 秒的视频。Black Forest Labs 还介绍了将单个片段通过智能链式方式连接为更长多镜头序列的能力。视觉参考可帮助维持角色或核心元素,而新的提示词可以指定地点、动作、镜头选择和故事节点。

6

如何获得更好的预览结果?

清楚描述主体、动作、环境、镜头、光线、节奏与声音;需要视觉一致性时,请添加相关图片。

探索 FLUX 3 Video 工作流

探索 FLUX 3 文生视频、图生视频、参考引导生成和原生音频工作流。