Black Forest Labs发布FLUX 3多模态模型,统一学习图像、视频和音频,基于Self-Flow方法。视频生成最长20秒含原生音频,在偏好测试中优于多数竞品,但训练计算超95%用于视频。访问受限,优先开放视频和动作内容。
完成下面两步后,将自动完成登录并继续当前操作。