Zero123++:3D 生成器 — 功能与运行要求

Zero123++ — 这是一个由 SUDO-AI 团队开发的开源 3D 模型生成器。该工具解决的是仅凭一张图像生成物体一致多视图投影的问题。作者本人将该项目描述为“用于从单张图像生成一致多视图投影的基础扩散模型”。
功能
基于上传的图片,Zero123++ 会从不同角度生成物体的多个视图。这些投影彼此一致,因此可以作为后续构建三维几何的中间步骤。仓库标签中标注了 image-to-3d 和 text-to-3d 方向,但主要描述中重点强调的是基于图像的生成。作者未透露 text-to-3d 的实现细节。
运行要求
代码使用 Python 编写,并以 Apache-2.0 许可证发布。仓库位于 github.com/SUDO-AI-3D/zero123plus,模型权重可在 huggingface.co/sudo-ai/zero123plus-v1.2 获取。运行需要 diffusers 库。完整权重文件集占用 5.2 GB,其中最大的文件为 3.2 GB。据开发者称,运行示例需要约 5 GB 显存。支持本地运行,不强制要求云基础设施。
适用人群
该工具适合正在尝试 image-to-3D 流程、需要生成多视图投影作为中间表示的研究人员和开发者。开源代码库允许将模型集成到自己的项目中。如果期望输出现成的三维网格,该方案并不适合——Zero123++ 输出的只是从不同角度拍摄的一组平面图像,而非最终 3D 模型。另外需要注意的是,代码最后一次修改是在 2024 年 2 月,此后仓库未再更新。
Zero123++ 在更大的三维内容创建流程中占据了自己的位置,作为其中的一个组件。它不能替代完整的 3D 编辑器,也不会直接给出成品模型,但它解决了生成一致视图这一具体任务,之后可以将结果继续传递到流程的下一环节。
参数表
| 代码许可证 | Apache-2.0 来源 |
|---|---|
| 显存 | 5 GB 据作者描述 来源 |
| 最大权重文件 | 3.2 GB 来源 |
| 全部权重文件 | 5.2 GB 来源 |
| 库 | diffusers 来源 |
| 语言 | Python 来源 |
| 代码最近更新 | 2024-02-23 来源 |
| 仓库创建时间 | 2023-10-16 来源 |
数值由程序自动从官方来源采集,并于 2026-08-19 核对。每个数值都附来源链接;取自开发者页面的数值还附有原文引用——将鼠标悬停在标注上即可查看。价格与版本为核对日期时的数据,变化最频繁——购买前请以官网为准。



