CPU3D3D、视频与音频的 AI 工具

Scal3R:3D 生成器——功能与运行要求

Scal3R — 来自 ZJU3DV 团队的开源 3D 生成器。该工具解决的是 image-to-3D 任务:输入一张图像,输出一个三维重建结果。作者将该项目定位为面向大规模 3D 重建的可扩展测试时训练方法,并指出该工作已被 CVPR 2026 接收,标注为 Highlight。

功能

据作者描述,Scal3R 用于从图像进行大规模三维重建。仓库标签中列出了三个关键方向:

  • 3D 重建;
  • 深度估计;
  • 大场景处理。

作者在参数表中没有列出支持的输入图像格式或输出网格的详细清单,也没有说明场景尺寸限制或视角数量要求。

运行要求

代码使用 Python 编写。据作者描述,运行需要 CUDA — 仓库中有单独的安装说明,包含针对 PyTorch 和 CUDA 的指引。参数表中未注明具体的库版本和最低显存容量。

代码许可证为非标准类型 — 作者没有明确说明许可证类型,因此使用前需要手动查看仓库中的条款。代码已开源,模型已发布在 Hugging Face 上。

适合谁用

该工具适合从事三维场景重建、深度估计研究,并希望了解测试时训练方法的研究人员和开发者。开源代码和已发布的模型有助于理解该方法,并根据自己的数据加以调整。

对于“上传一张照片就能得到可用于打印的模型”这类日常需求,该项目可能显得过于复杂:作者没有提供现成的界面,安装过程需要处理 CUDA 和 PyTorch。如果不想面对非标准许可证和手动配置环境,建议考虑其他方案。

Scal3R 是一个面向大规模重建的开源研究工具。在将其用于自己的项目之前,建议先仔细阅读仓库中的安装说明和许可证条款。

Scal3R — 3D 生成管线 Scalable Test-Time Training for Large-Scale 3D Reconstruction 输入图像 单帧 场景或物体 特征提取 深度图 与几何 Test-Time Training 模型自适应 实时 重建 体积模型 场景 结果:3D 模型 可直接使用的几何 用于图形应用 平台:CUDA · 语言:Python · 开源
Scal3R 的处理流程。示意图依据工具参数表绘制。

参数表

任务image-to-3d 来源
代码许可证非标准(需手动核实) 来源
平台CUDA 据作者描述 来源
语言Python 来源
代码最近更新2026-05-11 来源
仓库创建时间2026-04-09 来源
经常变化 — 数据截至 2026-09-07
GitHub 星标528 来源
Fork 数38 来源
月下载量0 来源
模型更新2026-04-11 来源

数值由程序自动从官方来源采集,并于 2026-09-07 核对。每个数值都附来源链接;取自开发者页面的数值还附有原文引用——将鼠标悬停在标注上即可查看。价格与版本为核对日期时的数据,变化最频繁——购买前请以官网为准。

相关阅读