CPU3D3D、视频与音频的 AI 工具

Michelangelo:3D 生成器 — 功能与运行要求

Michelangelo 是一个由 NeuralCarver 团队开发的开源 3D 模型生成器。该工具通过结合形状、图像和文本的对齐潜在表示,根据文本描述或图像生成 3D 形状。

功能

  • 根据文本描述生成 3D 形状(text-to-3D)。
  • 根据输入图像生成 3D 形状(image-to-3D)。
  • 采用作者所称的“alignment-before-generation”方法——在生成阶段之前对齐形状、图像和文本的表示。
  • 基于 Transformer 模型。

运行要求

  • 代码使用 Python 编写,并以 GPL-3.0 许可证开源。
  • 代码库可在 github.com/NeuralCarver/Michelangelo 获取。
  • 代码最后更新于 2024 年 4 月 10 日;代码库创建于 2023 年 6 月 29 日。
  • 作者未在参数表中说明具体的硬件要求(GPU、显存容量、内存)和依赖项列表。

适用人群

该工具适用于从事 3D 形状生成模型研究并希望探索或改进潜在表示对齐方法的研究人员和开发者。开源代码库允许根据自身需求调整解决方案。对于寻求“一键式”图形界面现成应用的用户,Michelangelo 并不适合——这是一个研究性代码,需要自行配置环境和运行。

作者在 NeurIPS 2023 会议上展示了 Michelangelo。更多资料和方法描述可在项目网站上找到:neuralcarver.github.io/michelangelo/

米开朗基罗流水线 图像与文本驱动的3D模型生成器 输入数据 图像 文本描述 参考形状 编码器 模态 对齐 潜码 变换器 条件 几何 生成 解码器 表面 重建 细化 3D模型 成品3D几何 带纹理 OBJ GLB PLY 特征直传 对齐 Shape-Image-Text Aligned Latent 共享潜 空间
Michelangelo 的处理流程。示意图依据工具参数表绘制。

参数表

代码许可证GPL-3.0 来源
语言Python 来源
代码最近更新2024-04-10 来源
仓库创建时间2023-06-29 来源
经常变化 — 数据截至 2026-08-03
GitHub 星标485 来源
Fork 数27 来源

数值由程序自动从官方来源采集,并于 2026-08-03 核对。每个数值都附来源链接;取自开发者页面的数值还附有原文引用——将鼠标悬停在标注上即可查看。价格与版本为核对日期时的数据,变化最频繁——购买前请以官网为准。

相关阅读