工具 YuE(YuE(乐))发布了 YuE2 Music skill 1.2.0 版本,新增了根据文本描述、ABC 乐谱或参考录音生成器乐音乐和器乐翻唱的功能。详情见
GitHub 上的发布说明。yue2-music.zip 包安装到智能体的技能目录中;推荐的智能体是 GPT-6 Astra。默认情况下 YuE2 自行编写乐谱并生成音频,智能体负责启动 workflow 并检查结果。对于翻唱,人声音符会被转移到器乐轨道,同时保留音高、起始位置和时值;音频参考会经过 SheetSage2 处理。推理需要兼容的 NVIDIA GPU,模型权重和依赖需单独安装。作者报告了 51 项器乐 CPU 测试和 35 项打包回归检查。
这意味着什么
在我们的指南中,YuE 被描述为来自 M-A-P 的开源音频生成器,任务类型为 text-generation。代码公开,采用 Apache-2.0 许可证,模型权重同样为 Apache-2.0。最大的单个权重文件为 4.6 GB,所有文件合计 11.6 GB。模型为 Hugging Face 上的 YuE-s1-7B-anneal-en-cot,代码语言为 Python。仓库中代码的最后一次变更为 2025-06-04,仓库创建于 2025-01-23。作者将 YuE 描述为一个生成完整歌曲的开源模型,类似 Suno.ai,但代码开源。
1.2.0 版本针对的正是 yue2-music 技能:在我们
工具页面的 YuE 参数表中,该技能并未单独描述,推理所需的 GPU 要求、确切的模型修订版本以及 GPT-6 Astra 智能体的角色同样未提及。开发者没有说明这是否会改变基础模型权重,还是仅涉及现有模型之上的 workflow。发布说明中未提及显存要求。
对于已经在使用 YuE 的用户来说,此次更新增加了器乐生成以及将旋律转移到无 vocals 翻唱的场景。要评估这对基础模型的改变程度,参数表中的数据目前还不够。
方法的结构。示意图根据这篇简讯绘制。