CPU3D3D、视频与音频的 AI 工具

VoxelModel-v1:HuggingFace 上新的开源 text-to-3d 模型

HuggingFace 上发布了模型 bench-labs/VoxelModel-v1,用于解决 text-to-3d 任务。该模型于 2026 年 7 月 26 日出现,代码已开源。开发者未说明显存要求、导出格式及其他技术细节。

这意味着什么

VoxelModel-v1 是一个根据文本描述生成 3D 的生成器。在我们指南的工具中,目前没有在 text-to-3d 任务上直接对标的开源工具。 AI 3D 分类中最接近的生成器——OpenLRM、Hunyuan3D 2.1 和 TRELLIS——处理的是 image-to-3d 任务,也就是说需要输入图像而非文本。Hunyuan3D 2.1 的仓库标签中提到了 text-to-3d,但主要任务仍然是 image-to-3d。 由于 VoxelModel-v1 的开发者未披露技术参数,目前还无法将新模型与上述工具在显存、模型权重大小或导出格式方面进行比较。 该模型刚刚出现,关于其功能的细节很少。如果 text-to-3d 任务对你来说很重要,值得关注更新——也许很快就会出现在示例和技术文档。
文本 描述 输入提示词 VoxelModel-v1 3D 生成器 按文本 text-to-3d 模型 3D 模型 输出 体素对象 最接近的同类(image-to-3d,非 text-to-3d): OpenLRM 需要图像 作为输入 Hunyuan3D 2.1 主要任务是 image-to-3d TRELLIS 需要图像 作为输入 没有开源的 text-to-3d 直接同类 VoxelModel-v1 — HuggingFace 上的 text-to-3d 新开源模型,技术细节尚未公布
该方法的原理。示意图根据这篇简讯绘制。

相关阅读