三花快讯 · 2025, 7月24日

Higgs Audio v2:开源音频生成模型

完全基于预训练无需微调的多说话人对话生成

Boson AI 近日开源了其音频生成模型 Higgs Audio Generation 的第二代版本(v2)。该模型在超过 1000 万小时的多样化音频数据及对应文本数据上进行预训练,未经任何后训练或微调处理。

从官方演示效果来看,其生成质量确实不错,佬们可以在 HF 上在线体验

商业转载请联系三花微信公众号获得授权,非商业转载请注明本文出处及文章链接,您可以自由地在任何媒体以任何形式复制和分发作品,也可以修改和创作,但是分发衍生作品时必须采用相同的许可协议。

本文采用 CC BY-NC-SA 4.0 - 非商业性使用 - 相同方式共享 4.0 国际 进行许可。