哪些 AI 生成器真的能在你的显卡上跑起来
我们亲自安装并运行这些生成器——从 3D 模型、视频到音效。记录每个工具需要多少显存,哪些在 CUDA 上运行、哪些能在 Apple MPS 和 AMD ROCm 上启动,哪些开源、哪些是订阅制云服务。
我们会阅读访客的搜索需求并据此撰写内容——直接在这里提问即可。
0篇文章
0个栏目
0年创办
提示词 → 结果拖动滑块 ↔


“一只陶土茶壶,
壶盖有棱面,
低多边形”


“雨点打在铁皮屋顶上,
远处有雷声”插图由 AI 生成——展示的是目录中工具能做什么的示例,而非它们的实时输出。显存门槛来自参数表。
哪些能在本地运行
完整工具库 →选择类型、芯片——CUDA、Apple MPS 或 AMD ROCm——以及显存上限。剩下的就是真正能启动的模型。要求依据作者描述,每个数值都有来源和核对日期。
| 工具 | 类型 | 运行方式 | 显存 | 后端 | 格式 |
|---|---|---|---|---|---|
| LTX-Videoimage-to-video | 视频 | 开源 | ≥ 1 GB * | Apple MPS | — |
| ChatTTStext-to-audio | 音频 | 开源 | ≥ 4 GB * | — | — |
| Zero123++ | 3D | 开源 | ≥ 5 GB * | — | — |
| Stable Fast 3Dimage-to-3d | 3D | 开源 | ≥ 6 GB * | CUDAApple MPS | glb |
| threestudio | 3D | 开源 | ≥ 6 GB * | CUDA | obj |
| TripoSRimage-to-3d | 3D | 开源 | ≥ 6 GB * | CUDA | — |
| MMAudio | 音频 | 开源 | ≥ 6 GB * | CUDA | — |
| FramePack | 视频 | 开源 | ≥ 6 GB * | CUDA | — |
显示的是按显存门槛最容易上手的工具。云服务不需要显存——需要的是订阅:它们在单独的列表中。
AI 新闻 — 每日更新
全部动态 →点击加载 · 不预先加载任何内容
从点云到模型
每个 3D 生成器都是这样工作的:先是点云,然后是表面,最后是材质。点击一下,我们分步展示。页面打开时保持轻量:只有在你点击后才加载画面。
01提示词或照片一张图片或一行文字——几乎所有生成器的输入。
02点云模型预测体积:体素、点、潜空间网格。
03网格与纹理多边形、UV、PBR 贴图。这里最容易出问题。
04引擎或打印真正能交给 Blender、Unreal 或 3D 打印机的东西。
画面只在此刻加载,而不是在打开页面时。这些是 AI 生成的插图——等我们的“图片生成 3D”工具上线后,这里会换成真正的查看器。
最新生成器评测
最新最多阅读
YuE:音频生成器 — 功能与运行要求YuE 是 M-A-P 团队推出的开源音频生成器,据作者描述,该模型用于创作完整歌曲。据开发者称,该项目旨在成为 Suno.ai 等系统的开源替代品。代码已在 GitHub 上发布,模型权重已
XTTS:音频生成器 — 功能与运行要求XTTS 是 Coqui 推出的开源语音生成器。它解决 text-to-speech 任务:将文本转换为可听的语音。该项目在 GitHub 仓库中持续开发,并以 Python 库的形式分发。功能 据作者描述,
Stable Audio Open:音频生成器 — 功能与运行要求Stable Audio Open 是 Stability AI 推出的开源音频生成器。它解决 text-to-audio 任务:将文本描述转换为音频文件。该工具适合需要根据文本生成音频、并愿意处理相关工作的用户。
OpenVoice:音频生成器 — 功能与运行要求OpenVoice 是 MyShell 团队开发的开源语音生成器。它解决 text-to-speech 任务,据作者描述,属于音频基础模型类别。主要应用场景是语音合成,支持音色迁移至