哪些 AI 生成器真的能在你的显卡上跑起来
我们亲自安装并运行这些生成器——从 3D 模型、视频到音效。记录每个工具需要多少显存,哪些在 CUDA 上运行、哪些能在 Apple MPS 和 AMD ROCm 上启动,哪些开源、哪些是订阅制云服务。
我们会阅读访客的搜索需求并据此撰写内容——直接在这里提问即可。
0篇文章
0个栏目
0年创办
提示词 → 结果拖动滑块 ↔


“一只陶土茶壶,
壶盖有棱面,
低多边形”


“雨点打在铁皮屋顶上,
远处有雷声”插图由 AI 生成——展示的是目录中工具能做什么的示例,而非它们的实时输出。显存门槛来自参数表。
哪些能在本地运行
完整工具库 →选择类型、芯片——CUDA、Apple MPS 或 AMD ROCm——以及显存上限。剩下的就是真正能启动的模型。要求依据作者描述,每个数值都有来源和核对日期。
| 工具 | 类型 | 运行方式 | 显存 | 后端 | 格式 |
|---|---|---|---|---|---|
| LTX-Videoimage-to-video | 视频 | 开源 | ≥ 1 GB * | Apple MPS | — |
| ChatTTStext-to-audio | 音频 | 开源 | ≥ 4 GB * | — | — |
| Zero123++ | 3D | 开源 | ≥ 5 GB * | — | — |
| Stable Fast 3Dimage-to-3d | 3D | 开源 | ≥ 6 GB * | CUDAApple MPS | glb |
| threestudio | 3D | 开源 | ≥ 6 GB * | CUDA | obj |
| TripoSRimage-to-3d | 3D | 开源 | ≥ 6 GB * | CUDA | — |
| MMAudio | 音频 | 开源 | ≥ 6 GB * | CUDA | — |
| FramePack | 视频 | 开源 | ≥ 6 GB * | CUDA | — |
显示的是按显存门槛最容易上手的工具。云服务不需要显存——需要的是订阅:它们在单独的列表中。
AI 新闻 — 每日更新
全部动态 →
2026-10-05
LiquidAI 发布 d1-3B——无需生成文本、单次前向即可决策的模型
2026 年 10 月 5 日,LiquidAI/d1-3B 模型在 HuggingFace 上发布,任务类型为 image-text-to-text。这是一个拥有 31 亿参数的决策模型,基于 LFM2.5-VL-3B 构建:输入为状态——文本、JSON、图像或其混
2026-10-05
n8n 2.42.3:专注自托管稳定性的智能体平台
2026-10-03
Blockway 发布 Agens-Volundr-32B 模型预览版,面向推理、代码与智能体任务
2026-10-02
FlowHMR 将视频动作捕捉转化为带物理控制的生成任务
2026-10-02
ManifoldSplat 用文本在 90 秒内编辑 3D 头部形状
arXiv 最新论文与模型发布——简明扼要,并注明哪些已经可以在自己的机器上运行。
点击加载 · 不预先加载任何内容
从点云到模型
每个 3D 生成器都是这样工作的:先是点云,然后是表面,最后是材质。点击一下,我们分步展示。页面打开时保持轻量:只有在你点击后才加载画面。
01提示词或照片一张图片或一行文字——几乎所有生成器的输入。
02点云模型预测体积:体素、点、潜空间网格。
03网格与纹理多边形、UV、PBR 贴图。这里最容易出问题。
04引擎或打印真正能交给 Blender、Unreal 或 3D 打印机的东西。
画面只在此刻加载,而不是在打开页面时。这些是 AI 生成的插图——等我们的“图片生成 3D”工具上线后,这里会换成真正的查看器。
最新生成器评测
最新最多阅读
SparkDiffusion:视频生成器 — 功能与运行要求SparkDiffusion 是 Alibaba Research 推出的开源文本生成视频工具。该项目解决 text-to-video 任务,据作者描述,通过联合采样将基于扩散 Transformer 的视频生成速度提升 265 倍。
LiquidAI 发布 d1-3B——无需生成文本、单次前向即可决策的模型2026 年 10 月 5 日,LiquidAI/d1-3B 模型在 HuggingFace 上发布,任务类型为 image-text-to-text。这是一个拥有 31 亿参数的决策模型,基于 LFM2.5-VL-3B 构建:输入为状态——文本、JSON、图像或其混
n8n 2.42.3:专注自托管稳定性的智能体平台n8n 平台发布 2.42.3 版本——这是一个可视化构建 AI 智能体和工作流的平台。自上次解析以来共积累了六个版本:2.41.3、2.41.4、2.41.5、2.41.6、2.41.7 以及当前的 2.42.3。这些版本的重点是内核修复
Blockway 发布 Agens-Volundr-32B 模型预览版,面向推理、代码与智能体任务HuggingFace 上发布了模型 Blockway/Agens-Volundr-32B-Preview,任务为 text-generation。这是 Blockway 的预览版发布:架构、格式与后训练流程已定稿,但继续预训练仍在进行,完整版