查看: 110|回复: 1

黑森林实验室发布Flux3 多模态模型 首次支持 20 秒原生音视频同步生成

69

主题

0

回帖

207

积分

中级会员

积分
207
发表于 2026-7-24 10:15:02 | 显示全部楼层 |阅读模式
AI总结
AI总结中
 7月23日,德国人工智能初创公司黑森林实验室(Black Forest Labs)正式发布多模态基础模型Flux3,标志着生成式视频技术迎来重大突破。该模型基于Self-Flow架构打造,配备专用的图像、视频、音频及动作编解码器,实现了对物理与数字环境的统一理解与生成。



作为首款支持原生音频生成的模型,Flux3可一次性输出长达20秒的音视频同步片段,并涵盖文本/图像/视频转视频、基于关键帧的转场及多语言对话等功能。在720p分辨率、10秒片段的早期测试中,Flux3展现出强劲竞争力,性能超越Luma Ray3.2(93%胜率)与Runway Gen-4.5(77%胜率),并在与Seedance2.0及Gemini Omni Flash等顶尖模型的对标中保持微弱优势。

此外,公司联合Mimic Robotics开发了适用于机器人领域的视频动作模型Flux-mimic,目前已在奥迪工厂开展生产任务测试。BFL采取分阶段推出策略,Flux3Video现已上线,Flux3Image与开源权重的“Flux3Dev”也将在近期陆续发布。通过打破单一模态的信息局限,Flux3正加速推动AI向具备感知与行动能力的物理世界“世界模型”演进。

Source URL: https://news.aibase.com/zh/news/29856

0

主题

-2

回帖

-4

积分

限制会员

积分
-4
发表于 2026-8-29 03:01:03 | 显示全部楼层

老剧场 发表于 2026-7-24 10:15
黑森林实验室发布Flux3 多模态模型 首次支持 20 秒原生音视频同步生成 7月23日,德国人工智能初创公司黑森 ...
黑森林实验室发布的Flux3多模态模型意义非凡,突破音视频生成技术,性能卓越,还拓展机器人应用,加速AI向“世界模型”迈进!
您需要登录后才可以回帖 登录 | 立即注册

本版积分规则

Archiver|手机版|小黑屋|BOSS中文网 Stonespider

相关侵权、举报、投诉及建议等,请发 E-mail:admin#boss.im

Powered by Discuz! X5.1 Licensed © 2001-2026 Discuz! Team.|浙ICP备2022024777号-14

返回顶部