CPU3D3D、视频与音频的 AI 工具

OpenLRM:3D 生成器 — 功能与运行要求

OpenLRM — 这是一个由 3DTopia 团队开发的开源 3D 生成器,解决 image-to-3D 任务。该工具允许根据单个输入图像获得三维模型,并被作者定位为 Large Reconstruction Models 的开源实现。

功能

据作者描述,OpenLRM 从平面图像中重建三维几何形状。仓库中指出,代码使用 Python 编写,并利用了 transformers 库。 该模型可供下载:最大的权重文件占用 1.7 GB,所有文件的总大小为 3.4 GB。作者提到了 openlrm-obj-small-1.1 变体,该变体在 Objaverse 数据集上训练,根据文档,可以将结果导出为 obj 格式。开发者未指定其他导出格式。

运行要求

本地运行需要 CUDA 平台——这是文档中的直接说明:作者建议在配置中减小 frame_size 参数,如果出现 CUDA OOM 内存不足错误。 代码根据 Apache-2.0 许可证分发,权重文件则根据 cc-by-nc-4.0 许可证分发。这意味着权重的商业使用受到限制。源代码可以在 github.com/3DTopia/OpenLRM 的仓库中找到,权重可以在 huggingface.co/zxhezexin/openlrm-mix-large-1.1 找到。最后记录的发布版本是 v1.1.1,代码的最后修改日期为 2024 年 5 月。

适合谁

该工具对计算机视觉领域的研究人员和开发者很有用,他们希望了解 Large Reconstruction Models 的架构或根据自己的数据微调模型。开源代码和清晰的源代码许可证有助于这一点。 那些寻找现成商业解决方案的人应该考虑到权重的非商业许可证以及对支持 CUDA 的 GPU 的强制要求。如果没有显卡或显卡不是 NVIDIA 的,就无法在本地运行 OpenLRM。作者不提供云服务,因此只能依赖自己的硬件。 OpenLRM 作为一个具有透明架构的研究项目,占据了自己的细分领域。它并不试图成为适用于所有情况的通用工具,但提供了根据单张照片重建 3D 模型的方法的复现和研究可能性。
OpenLRM 流程 单图 3D 生成器 图像 单张照片 物体 RGB 帧 预处理 归一化 与对齐 张量 LRM 模型 Transformer 大权重 模型 CUDA 三角化 网格 构建 Mesh 结果:三维模型 带纹理的 3D 网格,导出格式 OBJ Wavefront 模型文件 代码许可证:Apache-2.0 / 权重:CC-BY-NC-4.0 输入 准备 生成 组装 输出
OpenLRM 的处理流程。示意图依据工具参数表绘制。

参数表

任务image-to-3d 来源
代码许可证Apache-2.0 来源
权重许可证cc-by-nc-4.0 来源
平台CUDA 据作者描述 来源
最大权重文件1.7 GB 来源
全部权重文件3.4 GB 来源
导出格式obj 据作者描述 来源
transformers 来源
语言Python 来源
代码最近更新2024-05-06 来源
仓库创建时间2023-12-20 来源
经常变化 — 数据截至 2026-08-19
最新版本v1.1.1 来源
发布日期2024-03-13 来源
GitHub 星标1242 来源
Fork 数80 来源
月下载量96 来源
模型更新2024-03-06 来源

数值由程序自动从官方来源采集,并于 2026-08-19 核对。每个数值都附来源链接;取自开发者页面的数值还附有原文引用——将鼠标悬停在标注上即可查看。价格与版本为核对日期时的数据,变化最频繁——购买前请以官网为准。

相关阅读