CPU3D3D、视频与音频的 AI 工具

YuE:音频生成器 — 功能与运行要求

YuE(YuE(乐))是 M-A-P 团队推出的开源音频生成器,作者将其描述为用于创作完整歌曲的模型。据开发者称,该项目旨在成为 Suno.ai 等系统的开源替代品。代码已发布在 GitHub 上,模型权重已上传至 Hugging Face,因此可以自行研究并运行该工具。

功能

该模型的主要任务是 text-generation,即根据文本描述或提示进行生成。仓库描述中指出,YuE(YuE(乐))定位为音乐生成的基础模型,包括完整歌曲。项目的标签包括 audio-generation、music-generation、voice-cloning 和 style-transfers——这表明其涉及音频处理、风格迁移和声音克隆,但作者在参数表中并未说明这些功能具体如何实现。

在架构上,该项目与 GPT 和 Llama 的方法相关,这表明其使用语言模型来处理音频。作者未说明具体的应用场景,以及生成音频的时长或质量限制。

运行要求

代码使用 Python 编写,并以 Apache-2.0 许可证发布。模型权重同样以 Apache-2.0 许可证提供。最大的权重文件占用 4.6 GB,完整文件集为 11.6 GB。在规划磁盘空间时需要考虑到这一点。

作者未说明内存、显卡或处理器的要求。仓库创建于 2025 年 1 月 23 日,代码最后更新于 2025 年 6 月 4 日。源代码可在 github.com/multimodal-art-projection/YuE 获取,权重位于 huggingface.co/m-a-p/YuE-s1-7B-anneal-en-cot,项目网站为 map-yue.github.io。

适合人群

该工具适合那些寻找商业音乐生成器开源替代品,并愿意直接使用模型的人:在本地运行、研究代码、根据自身需求进行调整。开放的权重和 Apache-2.0 许可证允许在自有开发中使用该项目。

对于期望现成服务、带有网页界面且易于配置的用户,YuE(YuE(乐))可能并不合适:参数表中没有关于用户界面、云服务或现成构建版本的信息。另外需要注意的是,作者未公布硬件要求,因此能否在特定机器上运行需要自行尝试评估。

YuE(YuE(乐))是一个开放代码、开放权重的研究项目,专注于根据文本提示生成音乐。它提供了完整歌曲级别的模型访问,但需要自行配置和足够的磁盘空间。适合重视开放性并希望按需二次开发的开发者和研究人员。

YuE(YuE(乐))— 音频与语音生成管线 文本 歌词 或台词 分词 文本转令牌 供模型使用 YuE 模型 生成音频 与语音 解码 令牌转音频 与语音 音频 语音 开源 · Apache-2.0 · Python 模型:YuE-s1-7B-anneal-en-cot · 权重:11.6 GB 歌曲模式 完整作品 语音模式 语音台词 两种工作模式
YuE 的处理流程。示意图依据工具参数表绘制。

参数表

任务text-generation 来源
代码许可证Apache-2.0 来源
权重许可证apache-2.0 来源
最大权重文件4.6 GB 来源
全部权重文件11.6 GB 来源
语言Python 来源
代码最近更新2025-06-04 来源
仓库创建时间2025-01-23 来源
经常变化 — 数据截至 2026-08-19
GitHub 星标6395 来源
Fork 数758 来源
月下载量6034 来源
模型更新2025-03-12 来源

数值由程序自动从官方来源采集,并于 2026-08-19 核对。每个数值都附来源链接;取自开发者页面的数值还附有原文引用——将鼠标悬停在标注上即可查看。价格与版本为核对日期时的数据,变化最频繁——购买前请以官网为准。

相关阅读