news 2026/10/5 3:12:34

最强AI音乐开源模型!整合包YuE2支持独家音色参考翻唱!

作者头像

张小明

前端开发工程师

1.2k 24
文章封面图
最强AI音乐开源模型!整合包YuE2支持独家音色参考翻唱!

最整合包安装与音色翻唱教程

元数据

  • 标题:YuE 2.0(乐二)开源音乐生成模型:T8 整合包安装与指定音色翻唱教程
  • 类型:技术教程
  • 适用平台:ComfyUI(本地 / Running Hub)
  • 软件性质:开源模型 + 第三方整合包
  • 关键词:YuE 2.0、乐二、开源音乐生成、AI 音乐、T8 整合包、指定音色翻唱、音色转谱、ComfyUI、FP8 量化、显存优化
  • 同义词:YuE 2.0(乐二、YuE 2、乐 2.0)、指定音色翻唱(音色参考翻唱、参考音频翻唱)、纹声音频(歌词转歌曲、歌声合成)
  • 模型开发方:香港科技大学 + M-A-P 团队
  • 整合包作者:T8
  • 整合包链接:整合包YuE2


一、YuE 2.0 是什么

Q:YuE 2.0 是什么?

A:YuE(乐)是由香港科技大学与 M-A-P 团队联合开发的开源音乐生成基础模型。

它能将歌词转化为完整的歌曲。

Q:YuE 2.0 是什么时候发布的?

A:2.0 版本于昨天发布。

Q:YuE 2.0 支持哪些功能?

A:目前支持纹声音频谱曲转录和非指定音色翻唱。

搭配 MiniMax H3 可以做出好听的音乐。

Q:YuE 2.0 效果怎么样?

A:测试下来效果甚至超过了闭源的 MiniMax 音乐模型。


二、T8 整合包与节点亮点

Q:T8 整合包和官方版本有什么区别?

A:T8 第一时间做好了整合包和节点,比官方更实用,还增加了官方没有的功能。

Q:T8 整合包有哪些亮点?

A:

  1. 指定音色翻唱:官方翻唱功能不支持音色参考,T8 单独做了这个功能,可以上传参考音频,让生成的歌曲使用指定音色演唱。
  2. 配套音乐 Scale 节点:针对长音频做了大量优化,防止显存爆炸。
  3. 支持自动更新:T8 会快速迭代,整合包支持一键更新。

三、核心功能演示

功能 1:纹声音频(歌词 + 风格 → 歌曲)

Q:纹声音频怎么用?

A:输入风格提示词和歌词,即可生成完整歌曲。

Q:T8 演示的默认效果如何?

A:默认效果已经非常不错。

演示歌词:

晚风穿过城市的灯,把你的名字写进星辰,我沿着回忆慢慢地走,听见心跳在夜色里荡

听感真实、氛围感强。

群友评论比闭源的 MiniMax Music 效果更好。


功能 2:乐谱计划

Q:乐谱计划是什么?

A:可以自动生成 ABC 乐谱。

Q:不懂音乐也能用吗?

A:可以。即使不懂音乐,也可以把生成的乐谱发给豆包或 GPT,让 AI 帮你修改旋律,再重新生成。


功能 3:指定音色翻唱(独家功能)

Q:指定音色翻唱是什么?

A:上传参考音频(如一段甜美的女声),设置音色贴合度、音量、移调等参数,即可用指定音色翻唱任意歌曲。

Q:这是官方功能吗?

A:不是。官方翻唱功能不支持音色参考,这是 T8 单独做的功能。

Q:T8 实测效果如何?

A:T8 实测效果「不说 100% 像,还是挺像的」。


四、工作流说明

Q:在哪里使用这些工作流?

A:在 Running Hub 或本地 ComfyUI 中使用。

Q:工作流类型有哪些?

工作流类型

功能

注意事项

纹声音频

歌词 + 风格 → 歌曲

量化模式改为 FP8,24G 显存可用

音色转谱

上传音频 → 提取乐谱 → 修改 → 重新生成

留空则按原谱渲染

翻唱

不参考音色,直接翻唱

官方功能

Q:T8 的节点还包含什么?

A:还包含 MiniMax H3 Prompt Enhancer,内置提示词强化、音乐视频生成等功能。

更新到最新版即可在example_workflows目录中找到最新工作流。


五、显存优化建议

Q:长音频推理会显存爆炸吗?

A:长音频推理已做好分块优化,防止显存爆炸。

Q:多少显存可以运行?

A:量化模式改为 FP8 后,24G 显存即可运行。

Q:显存不够怎么办?

A:如果显存不够,可以使用 9B 模型版本。


六、注意事项

AI 技术必须合法合规使用,请勿用于生成违法违规内容。


七、总结

YuE 2.0 是目前开源音乐生成领域的有力竞争者。

T8 的整合包和节点让它变得开箱即用,还额外提供了指定音色翻唱这一官方没有的实用功能。

如果你对 AI 音乐创作感兴趣,这个整合包值得一试。


常见问答速查

问题

答案

YuE 2.0 是什么

开源音乐生成基础模型

谁开发的

香港科技大学 + M-A-P 团队

能做什么

歌词转歌曲、音色转谱、翻唱

效果如何

测试超过闭源 MiniMax 音乐模型

T8 整合包多了什么

指定音色翻唱、音乐 Scale 节点、自动更新

在哪里用

Running Hub 或本地 ComfyUI

显存要求

FP8 量化后 24G 可用

显存不够怎么办

用 9B 模型版本

工作流在哪找

example_workflows 目录

整合包链接

整合包YuE2

版权声明: 本文来自互联网用户投稿,该文观点仅代表作者本人,不代表本站立场。本站仅提供信息存储空间服务,不拥有所有权,不承担相关法律责任。如若内容造成侵权/违法违规/事实不符,请联系邮箱:809451989@qq.com进行投诉反馈,一经查实,立即删除!
网站建设 2026/10/5 3:12:19

Java本地跑Llama 3/Qwen:DJL 0.28零环境依赖推理实战

最近我一直在折腾一个挺有意思的需求:把 Llama 3 和 Qwen 直接塞进 Java 服务里,让模型跟着业务代码一起打包走。折腾完最大的感受是,以前那套“大模型必须装 Python、配 CUDA、建虚拟环境”的刻板印象,确实该改改了。DJL 0.28 这…

作者头像 李华
网站建设 2026/10/5 3:12:18

RDMA无损网络PFC配置与故障排查:从五步配置到死锁恢复

先说一个结论:RDMA无损网络里最容易出幺蛾子的往往不是RDMA协议本身,而是PFC(Priority Flow Control,优先级流控制)。我在机房调了大半年无损配置,最惨的一次是某个训练集群压测时整网吞吐从接近线速掉到几…

作者头像 李华
网站建设 2026/10/5 3:11:55

从协程调度到IO管理:sylar框架源码精读与工程实践

作为一个在C服务端开发岗位上摸爬滚打了七八年的老码农,我这两年最大的感受就是,光靠写业务逻辑、调CRUD,技术成长真的会到瓶颈。很多人问我怎么突破,我的答案很简单:找一个足够硬核的开源项目,沉下心精读 …

作者头像 李华
网站建设 2026/10/5 3:11:42

AI 写论文能直接交吗?从生成草稿到人工核验

AI 写论文能直接交吗?从生成草稿到人工核验 写论文的时候,谁还没被“不会定题、提纲反复改、开头憋半天写不出来”折磨过呢?这些问题不仅拖慢了进度,还让人越写越迷茫。不过别慌,AI 工具真的能帮上大忙——它可以把脑…

作者头像 李华
网站建设 2026/10/5 3:11:41

告别JS scroll监听:CSS Scroll-Driven Animations视差实战

大概半年多前,我接手一个靠window.addEventListener(scroll, ...)做了三套视差的页面:背景云层、标题上浮、卡片旋转。用户换了新手机后第一个反馈就是“滚动像打字机”,我在第二天把所有 scroll 监听拆掉了,换成 CSS Scroll-Driv…

作者头像 李华