AI 工具,显存不超过 12 GB
显存门槛、后端与许可证均来自工具参数表:每个数值都由程序从官方来源采集,并标注核对日期。带星号 * 的要求出自作者的描述,并非我们的实测。详情见各工具页面。
显示 16 / 68
| 工具 | 类型 | 运行方式 | 显存 | 后端 | 格式 |
|---|---|---|---|---|---|
| Hunyuan3D 2.1image-to-3d | 3D | 开源 | ≥ 10 GB (10–29 GB) * | — | — |
| MeshAnything | 3D | 开源 | ≥ 7 GB * | CUDA | — |
| Stable Fast 3Dimage-to-3d | 3D | 开源 | ≥ 6 GB * | CUDAApple MPS | glb |
| threestudio | 3D | 开源 | ≥ 6 GB * | CUDA | obj |
| TripoSRimage-to-3d | 3D | 开源 | ≥ 6 GB * | CUDA | — |
| Zero123++ | 3D | 开源 | ≥ 5 GB * | — | — |
| ACE-Steptext-to-audio | 音频 | 开源 | ≥ 8 GB * | — | — |
| Barktext-to-speech | 音频 | 开源 | ≥ 12 GB * | CUDA | — |
| ChatTTStext-to-audio | 音频 | 开源 | ≥ 4 GB * | — | — |
| MMAudio | 音频 | 开源 | ≥ 6 GB * | CUDA | — |
| 复旦 MOSS-SoundEffect 无 CUDA(Mac 和 AMD) | 音频 | 开源 | ≥ 8 GB (8–10 GB) * | Apple MPSAMD ROCm | — |
| Allegrotext-to-video | 视频 | 开源 | ≥ 9.3 GB (9.3–27.5 GB) * | CUDA | — |
| FramePack | 视频 | 开源 | ≥ 6 GB * | CUDA | — |
| LTX-Videoimage-to-video | 视频 | 开源 | ≥ 1 GB * | Apple MPS | — |
| Pyramid Flowtext-to-video | 视频 | 开源 | ≥ 8 GB * | Apple MPS | — |
| Wantext-to-video | 视频 | 开源 | ≥ 8.19 GB * | — | — |
云服务 — 不需要显存
它们在自己的服务器上计算,因此硬件筛选对其不适用。
| Luma Genie通过 AI 智能体生成和编辑视频、图像、音频和文本 | 3D | 云服务 | 云服务 | 不需要 | JPG |
| Masterpiece X通过 AI 生成 3D 场景和资产 | 3D | 云服务 | 云服务 | 不需要 | — |
| Meshytext-to-3D、image-to-3D、AI 纹理生成、图像生成、动画 | 3D | 云服务 | 云服务 | 不需要 | GLB, FBX, OBJ, USDZ, STL |
| Polycam3D 扫描、3D 模型生成、楼层平面图生成、现实捕捉 | 3D | 云服务 | 云服务 | 不需要 | GLTF, OBJ, FBX, DAE, STL, USDZ, … |
| Rodintext-to-3D、image-to-3D、text-to-image、image-to-video、3D 头像生成、纹理生成、HDRI 生成 | 3D | 云服务 | 云服务 | 不需要 | GLB, OBJ, FBX |
| Tripo AItext-to-3D, image-to-3D, texturing, rigging, animation | 3D | 云服务 | 云服务 | 不需要 | JPG, PNG, WEBP |
| Dream Machinetext-to-video, image-to-video, video extension, video interpolation | 视频 | 云服务 | 云服务 | 不需要 | MP4 |
| Hailuoimage-to-video, text-to-video | 视频 | 云服务 | 云服务 | 不需要 | — |
| Kling通过 AI 生成视频和图像 | 视频 | 云服务 | 云服务 | 不需要 | — |
| PikaImage-to-Video, Video-to-Video, Text-to-Video | 视频 | 云服务 | 云服务 | 不需要 | — |
| Runway从音频或文本生成视频头像、创建和管理头像、实时对话 | 视频 | 云服务 | 云服务 | 不需要 | — |
| Soratext-to-video, image-to-video, video-to-video | 视频 | 云服务 | 云服务 | 不需要 | MP4 |
| Veotext-to-video, image-to-video | 视频 | 云服务 | 云服务 | 不需要 | video/mp4 |
| Vidu视频生成:text-to-video、image-to-video、reference-to-video、start-end-to-video、upscale | 视频 | 云服务 | 云服务 | 不需要 | png, jpeg, jpg, webp |
作者未说明要求
这些工具的官方来源中没有与所选筛选条件对应的数据——这表示“未知”,而不是“不适用”。
| 3DTopia | 3D | 开源 | 未说明 | CUDA | glb |
| CRM | 3D | 开源 | 未说明 | — | obj |
| DreamGaussian | 3D | 开源 | 未说明 | — | — |
| Era3D | 3D | 开源 | 未说明 | — | — |
| Hunyuan3D 2.1 无 CUDA(Mac 和 AMD) | 3D | 开源 | 未说明 | Apple MPSAMD ROCm | obj, glb, ply, stl, fbx, dae, 3mf |
| InstantMeshimage-to-3d | 3D | 开源 | 未说明 | CUDA | obj |
| LGMtext-to-3d | 3D | 开源 | 未说明 | — | — |
| Michelangelo | 3D | 开源 | 未说明 | — | — |
| MVDream | 3D | 开源 | 未说明 | — | — |
| Nerfstudio | 3D | 开源 | 未说明 | CUDA | — |
| One-2-3-45 | 3D | 开源 | 未说明 | — | — |
| OpenLRMimage-to-3d | 3D | 开源 | 未说明 | CUDA | obj |
| Point-E | 3D | 开源 | 未说明 | — | — |
| Shap-E | 3D | 开源 | 未说明 | — | — |
| TRELLISimage-to-3d | 3D | 开源 | 未说明 | CUDA | glb |
| Unique3D | 3D | 开源 | 未说明 | CUDA | — |
| Wonder3D | 3D | 开源 | 未说明 | — | — |
| CosyVoicetext-to-speech | 音频 | 开源 | 未说明 | — | — |
| DiffRhythm | 音频 | 开源 | 未说明 | — | — |
| F5-TTStext-to-speech | 音频 | 开源 | 未说明 | AMD ROCm | — |
| Fish Speechtext-to-speech | 音频 | 开源 | 未说明 | CUDA | — |
| MOSS-SoundEffecttext-to-audio | 音频 | 开源 | 未说明 | — | — |
| MusicGentext-to-audio | 音频 | 开源 | 未说明 | — | — |
| OpenVoicetext-to-speech | 音频 | 开源 | 未说明 | — | — |
| Stable Audio Opentext-to-audio | 音频 | 开源 | 未说明 | — | — |
| XTTStext-to-speech | 音频 | 开源 | 未说明 | CUDA | — |
| YuEtext-generation | 音频 | 开源 | 未说明 | — | — |
| CogVideoXtext-to-video | 视频 | 开源 | 未说明 | CUDA | — |
| Latte | 视频 | 开源 | 未说明 | CUDA | — |
| Open-Sora | 视频 | 开源 | 未说明 | — | — |
| Stable Video Diffusionimage-to-video | 视频 | 开源 | 未说明 | — | — |
| VideoCrafter | 视频 | 开源 | 未说明 | — | — |
参数表每月复核;工具页面上的每个数值都附来源链接和核对日期。星号 * 表示“依据作者描述”:这是开发者的声明,而非独立测量。