LichtFeld-Studio выпустил веса RoMa v1 для сопоставления изображений
У инструмента LichtFeld-Studio вышел новый выпуск — RoMa v1 dense matcher weights. Это постоянный модельный актив в нативном формате .lfw, который используется в пайплайне уплотнения для сопоставления пар изображений. Автор пометил выпуск как pre-release только для того, чтобы он не попадал в бейдж Latest: это не релиз приложения, а файл модели.
Модель собрана из двух чекпоинтов: матчер Parskatt/RoMa roma_outdoor.pth под лицензией MIT и бэкбон facebookresearch/dinov2 ViT-L/14 под Apache-2.0. Внутри также используется fine-feature stem из torchvision vgg19_bn под BSD-3-Clause. Файл содержит 636 тензоров, 416 930 219 параметров в float16, позиционные эмбеддинги запечены для рабочих разрешений 448 и 560. В заголовке файла записаны SHA-256 обоих исходных чекпоинтов, так что актив можно отследить до точных входных данных.
Что это значит
Для LichtFeld-Studio это дополнение к пайплайну уплотнения сцен: веса RoMa v1 нужны для сопоставления пар изображений при densification. Сам инструмент — генератор 3D-моделей на основе 3D Gaussian Splatting с открытым кодом под GPL-3.0, написан на C++23 и требует CUDA 12.8+ на NVIDIA-железе. Экспорт поддерживается в PLY, SOG, SPZ и standalone HTML viewer.
В паспорте инструмента этот модельный актив ранее не значился: раздел справочника по ИИ для 3D описывает LichtFeld-Studio как приложение для тренировки, инспекции и экспорта гауссовых сцен, без упоминания конкретных весов матчера. Теперь у инструмента появился отдельный загружаемый компонент с прозрачной цепочкой происхождения: SHA-256 исходных чекпоинтов записаны прямо в заголовке файла.
Выпуск касается тех, кто использует densification-пайплайн LichtFeld-Studio: веса RoMa v1 — это постоянный модельный актив, который не меняется от версии к версии приложения.Как устроен метод. Схема нарисована по этой заметке.