登录体验完整功能(收藏、点赞、评论等) — 已累计有 13172 人加入

黑森林实验室推出FLUX3多模态模型 音视频生成能力领跑行业

详情页推荐

2026年7月24日,Black Forest Labs(黑森林实验室)正式以Early Access模式上线FLUX3多模态基础模型,该模型基于Self-Flow自监督流匹配框架开发,支持单次生成最长20秒同步音视频,在10秒720P带声视频人工评测中,对Grok Imagine Video胜率达69%,对Seedance 2.0、Gemini Omni Flash胜率均为52%,多模态能力全面领先前代及同类竞品。

配图

不少AIGC创作者都曾遭遇生成视频音画不同步、时长上限短、跨模态调用繁琐的痛点,而黑森林实验室最新推出的FLUX3,直接从底层架构层面给出了解决方案。此前该实验室推出的FLUX1、FLUX2系列图像生成模型,已经凭借生成质量稳定、细节还原度高的优势,成为商用场景使用率最高的图像生成模型之一。

和多数厂商拼接不同模态模型的方案不同,FLUX3采用统一架构联合学习图像、视频、音频三类数据,基于Self-Flow自监督流匹配框架同步完成三类模态的训练,不需要额外接入音频生成模型做后期对齐,从底层解决了音画不同步的行业通病。

免责声明:本网站AI资讯内容仅供学习参考,不构成任何建议,不对信息准确性与完整性负责。