2026年8月25日,arXiv 上发布了一篇论文 SceneReGen: Generative Reconstruction of 3D Scenes from a Single Image。作者提出了一种基于单张图像进行 3D 场景生成式重建的方法:SceneReGen 不是将场景作为一个整体来重建,而是生成各个独立对象,并将它们组装到与观测对齐的公共坐标系中。核心思想是选择性姿态分解(selective pose factorization):对象的朝向直接编码在生成的网格中,而平移和缩放则从场景特征中单独估计。在 3D-FUTURE 子集上,该方法在场景级 CD、场景级 F-Score 和 3D 边界框 IoU 方面均优于所考察的其他方法。作者未公开代码。