FLUX 3
Black Forest Labs 发布的多模态流模型。单一架构同时支持图像、视频、音频和机器人动作预测。基于 Self-Flow 方法,结合 flow matching 和自监督特征重建。视频生成最长 20 秒含原生音频。Apache-2.0 开源。
🎯适用场景:多模态内容生成(图像/视频/音频)和机器人动作预测的统一模型
#black-forest-labs#multimodal#video#audio#robotics#open-source
📊 仓库数据
Stars3,500
Forks420
语言Python
协议Apache-2.0
上线2026/1/1
更新2026/7/26
✅ 优点
- •单一架构覆盖图像/视频/音频/动作
- •Apache-2.0 开源
- •FLUX-mimic 机器人策略 <80ms 推理
⚠️ 限制
- •视频和动作预测需早期访问权限
- •训练计算 95%+ 用于视频
- •开放权重分阶段发布
