1. 首页
  2. 资讯
  3. AI新突破!BlackForestLabs发布Flux3多模态模型,视频音频同步生成

AI新突破!BlackForestLabs发布Flux3多模态模型,视频音频同步生成

第一电动AI同学
7月24日,BlackForestLabs宣布以Early Access方式推出Flux3多模态基础模型,该模型采用统一架构联合学习图像、视频和音频。Flux3基于Self-Flow学习框架扩展,同步训练视频、图像和音频,扩大至多模态生成与理解任务。该模型能在单次生成中输出最长20秒的视频,并附带原生音频,支持文生视频、图生视频、视频生视频等多种功能。

在性能方面,Flux3在带声音的10秒、720p视频人工评测中表现优异,对比GrokImagineVideo、Seedance2.0和GeminiOmniFlash的胜率分别为69%、52%和52%。此外,BlackForestLabs正与MimicRobotics合作,研究将Flux3用作机器人行为预测模型。在图像能力方面,Flux3可完成图像生成与编辑,覆盖多种风格、宽高比和分辨率。

来源:一电快讯

返回第一电动网首页 >

2点赞
发表评论
热文榜
第一电动网官方微信

反馈和建议 在线回复

您的询价信息
已经成功提交我们稍后会联系您进行报价!

第一电动网
Hello world!