SceneFlare
登录

FLUX 3 Video

FLUX 3 Video即将上线

源文件

0/7

预览

即将上线

用 FLUX 3 Video 同时探索视频和原生音频

FLUX 3 Video 是 Black Forest Labs 为统一多模态 FLUX 3 模型公布的视频与音频能力。BFL 已展示最长 20 秒、包含对白、音效和音乐的片段,并支持文字、图片、视频参考、关键帧与续写控制。SceneFlare 为独立服务,与 Black Forest Labs 没有隶属、合作或背书关系。

单次最长 20 秒对白与音效原生生成文字、图片、视频参考多镜头续写
状态
即将上线

BFL 已开放邀请制早期访问;SceneFlare 暂未接入。

输出
视频 + 音频

与画面一起生成对白、音效和音乐。

时长
最长 20 秒

生成单个片段后,还可将多个片段连接成更长的多镜头序列。

FLUX 3 Video 可以做什么

把视频和原生音频生成结合起来,支持文字、图片、视频参考、关键帧与续写等创作方式。

带原生音频的文生视频

同时生成运动画面、多语言对白、音效和音乐,让可见事件与观众听到的声音保持对应。正式使用前请确认输出符合渠道要求。

两种图生视频方式

将图片作为起始帧进行动画化,或将一张及多张图片用作主体、人物、场景或风格的视觉参考。发布前请进行一次人工复核。

视频转视频

使用源视频作为参考,将人物等核心元素带入新的场景、情境或视觉处理方式。请在交付前检查结果。

视频与音频续写

延长输入片段及其声音,并让模型在原时间线之后继续动作、事件和音频。发布前请核对结果。

关键帧与多镜头连接

定义关键时刻以控制画面过渡,再将多个独立片段连接成更长的多镜头序列。正式使用前请确认输出符合渠道要求。

多种风格、动态排版与动画

支持纪实录像、动画、电影感场景、多种画面比例、动态设计和视觉文字。发布前请进行一次人工复核。

FLUX 3 Video 的创作方向

了解 FLUX 3 Video 如何用于角色动作、品牌短片和多镜头视听叙事。

构建富有表现力的生物与动作场景

在一个由提示词主导的场景中,组合清晰主体、物理环境、镜头路径、动作节奏和声音方向。发布前请进行一次人工复核。

描述因果关系

说明什么在运动、接触了什么、环境如何响应,以及每个事件应产生什么声音。请在交付前检查结果。

指导镜头

明确取景、镜头特性、相机运动、主体距离和最终构图。发布前请核对结果。

检查物理连续性

检查解剖结构、物体持续性、碰撞、速度、比例、阴影和音画同步。正式使用前请确认输出符合渠道要求。

制作带原生声音的角色场景

使用视觉参考和多语言对白指引,构建人物、环境、声音和氛围相互匹配的场景。请在交付前检查结果。

准备人物参考

定义需要保持一致的外观、服装、道具、行为、声音特征和视觉细节。发布前请核对结果。

按表演需求编写对白

分别说明说话者、台词、语言、情绪、节奏、打断方式和相关背景声音。正式使用前请确认输出符合渠道要求。

核对声音与肖像权

确认每个人物、角色、声音、品牌和源素材都已获得所需授权。发布前请进行一次人工复核。

将动态镜头连接成更长序列

分别创建具有强烈运动感的片段,再将它们组合为结构清晰的多镜头故事。发布前请核对结果。

列出镜头清单

为每个片段设定单一目的、动作、镜头运动、时长、转场和音频节点。正式使用前请确认输出符合渠道要求。

重复使用视觉参考

在不同镜头间保持人物、服装、物体、环境、色板和镜头语言一致。发布前请进行一次人工复核。

在时间线上完成后期

在编辑器中检查转场、节奏、对白、字幕、音乐、品牌元素和法律要求。请在交付前检查结果。

FLUX 3 Video 的创作流程

01

编写场景、声音和镜头计划

描述主体、动作、物理效果、环境、相机、对白、音效、音乐、节奏和目标画面比例。交付前确认输出。

02

准备已获授权的图片和视频参考

整理起始帧、人物、地点、风格、源视频和关键帧,并明确每个素材的用途与使用权。交付前确认输出。

03

生成、检查并完成剪辑

检查动作连续性、音画同步、对白、字幕和品牌元素,再通过剪辑完成节奏与镜头衔接。交付前确认输出。

关于 FLUX 3 Video 的常见问题

FLUX 3 Video 是什么?

FLUX 3 Video 是 FLUX 3 的视频与音频生成和编辑能力。FLUX 3 是 Black Forest Labs 的统一多模态基础模型。

FLUX 3 Video 现在可以使用吗?

BFL 已开放邀请制早期访问,但 FLUX 3 Video 尚未接入 SceneFlare。在获得接入方式和生产规格前,本页会保持“即将上线”状态。

FLUX 3 可以生成多长的视频?

BFL 表示,FLUX 3 Video 单次可以生成最长 20 秒且带音频的多样化视频。多个独立片段还可以连接为更长的多镜头序列。

FLUX 3 Video 会生成音频吗?

会。BFL 公布的视频输出均包含原生音频能力,包括多语言对白、音效和音乐,也支持从输入片段续写视频与音频。

FLUX 3 Video 支持哪些输入?

已公布的输入包括文字提示词、起始图片、视觉参考图、源视频、用于续写的输入视频与音频,以及关键帧。

FLUX 3 Video 支持什么分辨率?

BFL 的初步评估使用了带音频的 10 秒 720p 视频,但最终生产分辨率和帧率尚未公布。发布前请再次检查结果。

FLUX 3 Video 会开放权重吗?

BFL 已宣布未来会提供开放权重的 FLUX 3 Dev 多模态底座,但发布时间、许可证条款、模型规模和硬件要求尚未公布。

使用 FLUX 3 Video 需要多少费用?

公开 API 定价以及 SceneFlare 点数成本均尚未公布。

FLUX 3 Video 即将开放

完成模型接入并确认价格与正式控件后,SceneFlare 将在这里开放 FLUX 3 Video 生成功能。

即将上线 状态最长 20 秒 时长原生生成 音频