FLUX 3 视频模型结束灰度,登陆 Runway 与 Krea
Black Forest Labs 的 20 秒原生带音轨视频模型 8 月 4 日在 Runway、Krea、Replicate 同步开放,结束限量灰度期。
从 Discord 排队到公开可调用
Black Forest Labs 的 FLUX 3 Video 于 8 月 4 日大范围开放,当天同时出现在 Krea、Replicate 和 Runway 上。该模型 7 月 23 日发布,但此前只以邀请制灰度方式提供,限制商用,也没有公开 API 和第三方托管——7 月下旬 Replicate 与 fal.ai 都还查不到入口。周二的同步上线,才是普通创作者真正能用上它的时间点。
这个模型能做什么
FLUX 3 是一套统一的多模态流模型,用同一组主干权重覆盖图像、视频、音频以及机器人动作预测,底层是 BFL 的 Self-Flow 方法,把生成与理解放进同一架构。视频部分可生成最长 20 秒、720p 的片段,音轨在同一次生成过程中产出而非事后配音;支持文生视频、图生视频、参考片段的视频转视频、关键帧过渡控制,以及带音频的续写延长。BFL 强调的卖点包括人脸表情还原、声音与画面内物理事件的对应,以及多语种对白。1080p 输出、FLUX 3 Image,以及官方称年内会放出的开源权重版 FLUX 3 Dev,目前仍未到位。
值得注意的是 Runway 的上架:这家平台如今把竞争对手的「视频+音频」模型摆在自家生成能力旁边一起卖,延续了它近来的聚合器路线。
影响
生成式视频的竞争点已经从「片段能有多长」转向「画面和声音是否一次生成」,而 FLUX 3 是少数能原生做到 20 秒同步出声的模型之一。全面开放也解决了一个现实问题:此前商用条款受限的灰度模型,工作室和广告公司无法真正押注。更长线的看点是动作预测头——BFL 让生成画面的同一组权重也去预测物理动作,把一家以图像生成成名的公司塞进了世界模型与机器人的赛道。