黑森林实验室发布多模态基础模型 Flux3,支持原生音频生成

德国 AI 初创公司黑森林实验室(Black Forest Labs)发布多模态基础模型 Flux3。该模型基于 Self-Flow 架构,配备图像、视频、音频及动作编解码器,支持文本、图像、视频转视频、关键帧转场和多角色对话等能力,可一次生成最长 20 秒音视频同步片段。早期测试显示,在 720p、10 秒片段设置下,Flux3 相较 Luma Ray3.2 胜率为 93%,相较 Runway Gen-4.5 胜率为 77%。公司还与 Mimic Robotics 开发机器人动作模型 Flux-mimic,并已在奥迪工厂开展生产任务测试。Flux3Video 已上线,Flux3Image 及开源权重版本 Flux3Dev 将陆续发布。

上一篇:

下一篇:

发表回复

登录后才能评论