模型
FLUX 3发布:多模态真实世界模型
Black Forest Labs发布FLUX 3,定位为"真实世界模型",而非单纯的文生图或文生视频模型。该模型将图像、视频、音频和语言纳入同一multimodal flow架构,通过模态间的互约束学习物理规律与因果线索。同一底座支持三条产品线:Video(最长20秒、原生音频)、Image(后续推出)和Action(动作预测,已用于FLUX-mimic机器人场景)。
资讯动态数据由 AI HOT 聚合提供
Black Forest Labs发布FLUX 3,定位为"真实世界模型",而非单纯的文生图或文生视频模型。该模型将图像、视频、音频和语言纳入同一multimodal flow架构,通过模态间的互约束学习物理规律与因果线索。同一底座支持三条产品线:Video(最长20秒、原生音频)、Image(后续推出)和Action(动作预测,已用于FLUX-mimic机器人场景)。
资讯动态数据由 AI HOT 聚合提供