Black Forest Labs 与 mimic robotics 宣布推出 FLUX-mimic,这是一款基于 FLUX 3 多模态基础模型的视频-动作预测系统 。FLUX 3 在统一训练框架中可同时生成图像、视频和音频,并能预测机器人动作 。
Flux公司推出了新一代多模态基础模型FLUX 3,支持图像、视频和音频的联合学习与生成。该模型能够生成长达20秒的视频和音频内容,并可合成和编辑各种风格的图像,同时具备动作预测能力。