CPU3D3D、视频与音频的 AI 工具

VoxelModel-v1:HuggingFace 上新的开源 text-to-3d 模型

HuggingFace 上发布了模型 bench-labs/VoxelModel-v1,用于解决 text-to-3d 任务。该模型于 2026 年 7 月 26 日发布,代码已开源。开发者未说明显存要求、导出格式、许可证及其他技术细节。

这意味着什么

VoxelModel-v1 是一款根据文本描述生成 3D 模型的生成器。在我们指南的工具中,目前没有直接对标 text-to-3d 任务的开源工具。 AI 3D 板块中主题最接近的生成器——OpenLRMHunyuan3D 2.1TRELLIS——均基于 image-to-3d 任务,即输入需要图像而非文本。Hunyuan3D 2.1 的仓库标签中提到了 text-to-3d,但其主要任务仍是 image-to-3d。 由于 VoxelModel-v1 的开发者未公开技术规格,目前无法将新模型与上述工具在显存、模型权重大小或导出格式方面进行比较。 该模型刚刚发布,关于其功能的细节还很少。如果您对 text-to-3d 任务有需求,建议关注后续更新——可能很快会出现运行示例和技术文档。
文本 描述 输入提示词 VoxelModel-v1 3D 生成器 按文本 text-to-3d 模型 3D 模型 输出 体素对象 最接近的同类(image-to-3d,非 text-to-3d): OpenLRM 需要图像 输入 Hunyuan3D 2.1 主要任务 — image-to-3d TRELLIS 需要图像 输入 没有直接的开源 text-to-3d 同类 VoxelModel-v1 — HuggingFace 上的 text-to-3d 新的开源模型,技术细节尚未公开
方法原理示意图。此图根据这篇简讯绘制。

相关阅读