CPU3D3D、视频与音频的 AI 工具

音频生成器,显存不超过 6 GB

显存门槛、后端与许可证均来自工具参数表:每个数值都由程序从官方来源采集,并标注核对日期。带星号 * 的要求出自作者的描述,并非我们的实测。详情见各工具页面。

显示 2 / 68

工具类型运行方式显存后端格式
ChatTTStext-to-audio音频开源≥ 4 GB *
MMAudio音频开源≥ 6 GB *CUDA

作者未说明要求

这些工具的官方来源中没有与所选筛选条件对应的数据——这表示“未知”,而不是“不适用”。

CosyVoicetext-to-speech音频开源未说明
DiffRhythm音频开源未说明
F5-TTStext-to-speech音频开源未说明AMD ROCm
Fish Speechtext-to-speech音频开源未说明CUDA
MOSS-SoundEffecttext-to-audio音频开源未说明
MusicGentext-to-audio音频开源未说明
OpenVoicetext-to-speech音频开源未说明
Stable Audio Opentext-to-audio音频开源未说明
XTTStext-to-speech音频开源未说明CUDA
YuEtext-generation音频开源未说明

参数表每月复核;工具页面上的每个数值都附来源链接和核对日期。星号 * 表示“依据作者描述”:这是开发者的声明,而非独立测量。