7月23日,德国AI初创公司黑森林实验室(Black Forest Labs)发布多模态基础模型Flux3。该模型基于Self-Flow架构,配备图像、视频、音频及动作编解码器,支持最长20秒原生音视频同步生成,并提供文本、图像、视频转视频、关键帧转场和多语言对话等功能。公司称,Flux3Video已上线,Flux3Image及开源权重Flux3Dev将陆续发布;其与Mimic Robotics合作开发的机器人视频动作模型Flux-mimic已在奥迪工厂测试。
7月23日,德国AI初创公司黑森林实验室(Black Forest Labs)发布多模态基础模型Flux3。该模型基于Self-Flow架构,配备图像、视频、音频及动作编解码器,支持最长20秒原生音视频同步生成,并提供文本、图像、视频转视频、关键帧转场和多语言对话等功能。公司称,Flux3Video已上线,Flux3Image及开源权重Flux3Dev将陆续发布;其与Mimic Robotics合作开发的机器人视频动作模型Flux-mimic已在奥迪工厂测试。