CPU3DИИ-инструменты для 3D и видео

VoxelModel-v1: новая открытая модель text-to-3d на HuggingFace

На HuggingFace опубликована модель bench-labs/VoxelModel-v1, решающая задачу text-to-3d. Модель появилась 26 июля 2026 года, код выложен в открытый доступ. Разработчик не уточняет требований к видеопамяти, форматов экспорта, лицензий и других технических деталей.

Что это значит

VoxelModel-v1 — это генератор 3D по текстовому описанию. Среди инструментов нашего справочника прямых аналогов по задаче text-to-3d с открытым кодом сейчас нет. Ближайшие по теме генераторы из раздела AI 3DOpenLRM, Hunyuan3D 2.1 и TRELLIS — работают по задаче image-to-3d, то есть требуют изображение на вход, а не текст. У Hunyuan3D 2.1 в метках репозитория упоминается text-to-3d, но основная задача всё же image-to-3d. Поскольку разработчик VoxelModel-v1 не раскрывает технических характеристик, сравнить новую модель с перечисленными инструментами по видеопамяти, размерам весов или форматам экспорта пока невозможно. Модель только появилась, и подробностей о её возможностях мало. Если задача text-to-3d для вас актуальна, стоит следить за обновлениями — возможно, вскоре появятся примеры работы и техническая документация.
Текстовое описание промпт на вход VoxelModel-v1 Генератор 3D по тексту text-to-3d модель 3D-модель на выходе воксельный объект Ближайшие аналоги (image-to-3d, не text-to-3d): OpenLRM требует изображение на вход Hunyuan3D 2.1 основная задача — image-to-3d TRELLIS требует изображение на вход прямых аналогов text-to-3d с открытым кодом нет VoxelModel-v1 — text-to-3d на HuggingFace Новая открытая модель, тех. детали пока не раскрыты
Как устроен метод. Схема нарисована по этой заметке.

Смотрите также