CPU3D3D、视频与音频的 AI 工具

Zero123++:3D 生成器 — 功能与运行要求

Zero123++ — 这是一个由 SUDO-AI 团队开发的开源 3D 模型生成器。该工具解决的是仅凭一张图像生成物体一致多视图投影的问题。作者本人将该项目描述为“用于从单张图像生成一致多视图投影的基础扩散模型”。

功能

基于上传的图片,Zero123++ 会从不同角度生成物体的多个视图。这些投影彼此一致,因此可以作为后续构建三维几何的中间步骤。仓库标签中标注了 image-to-3d 和 text-to-3d 方向,但主要描述中重点强调的是基于图像的生成。作者未透露 text-to-3d 的实现细节。

运行要求

代码使用 Python 编写,并以 Apache-2.0 许可证发布。仓库位于 github.com/SUDO-AI-3D/zero123plus,模型权重可在 huggingface.co/sudo-ai/zero123plus-v1.2 获取。运行需要 diffusers 库。完整权重文件集占用 5.2 GB,其中最大的文件为 3.2 GB。据开发者称,运行示例需要约 5 GB 显存。支持本地运行,不强制要求云基础设施。

适用人群

该工具适合正在尝试 image-to-3D 流程、需要生成多视图投影作为中间表示的研究人员和开发者。开源代码库允许将模型集成到自己的项目中。如果期望输出现成的三维网格,该方案并不适合——Zero123++ 输出的只是从不同角度拍摄的一组平面图像,而非最终 3D 模型。另外需要注意的是,代码最后一次修改是在 2024 年 2 月,此后仓库未再更新。

Zero123++ 在更大的三维内容创建流程中占据了自己的位置,作为其中的一个组件。它不能替代完整的 3D 编辑器,也不会直接给出成品模型,但它解决了生成一致视图这一具体任务,之后可以将结果继续传递到流程的下一环节。

Zero123++ — 3D 生成管线 单张图像 → 一致视图 → 三维模型 输入 图像 单张照片 RGB,任意角度 模型 Zero123++ 扩散模型 生成 6 个视图 视图 多视图 6 个一致的 物体角度 3D 重建 构建网格 与纹理贴图 资源 权重:5.2 GB 显存:约 5 GB 结果 3D 模型 多视图帧 技术栈 Python · Diffusers · Diffusion Models · 开源(Apache-2.0)
Zero123++ 的处理流程。示意图依据工具参数表绘制。

参数表

代码许可证Apache-2.0 来源
显存5 GB 据作者描述 来源
最大权重文件3.2 GB 来源
全部权重文件5.2 GB 来源
diffusers 来源
语言Python 来源
代码最近更新2024-02-23 来源
仓库创建时间2023-10-16 来源
经常变化 — 数据截至 2026-08-19
GitHub 星标2090 来源
Fork 数148 来源
月下载量16805 来源
模型更新2024-02-01 来源

数值由程序自动从官方来源采集,并于 2026-08-19 核对。每个数值都附来源链接;取自开发者页面的数值还附有原文引用——将鼠标悬停在标注上即可查看。价格与版本为核对日期时的数据,变化最频繁——购买前请以官网为准。

相关阅读