Black Forest Labs 发布 FLUX 3 多模态模型,支持单次生成 20 秒视频与原生音频
推荐理由
FLUX 3 实现视频与原生音频的联合生成,降低多模态内容创作门槛,对 AI 视频生成赛道具有商业推动价值。
ROBOAIRADAR BRIEF
结构化情报
01
发生了什么
Black Forest Labs 以 Early Access 方式推出 FLUX 3 多模态基础模型,采用统一架构联合学习图像、视频和音频,基于 Self-Flow 学习框架扩展,可在单次生成中输出最长 20 秒视频并附带原生音频,支持文生视频、图生视频、多镜头串联等任务。
02
为什么重要
FLUX 3 实现视频与原生音频的联合生成,降低多模态内容创作门槛,对 AI 视频生成赛道具有商业推动价值。
03
行业影响
新品将为硬件能力和产品定价提供新的比较样本,后续重点是订单、交付与真实使用反馈。
04
仍需确认
当前是单一公开来源,需要补充公司公告、客户确认或其他可信媒体报道。
信息说明
RoboAIRadar 对公开信源进行聚合、中文整理和价值判断,不替代原始报道。 涉及产品参数、交易金额或公司声明时,请以原文为准。
查看原始报道