Luce 推出基于单张图像的 3D 资源生成,支持 PBR 材质与重新照明
研究人员在 arXiv 上发表了论文 Luce: Relightable Gaussians for 3D Asset Generation,其中介绍了一种从单张图像生成 3D 模型并支持物理正确渲染的方法。该模型使用体素化的多模态高斯点云,其中各个图元分别负责几何、反照率、金属度-粗糙度和法线。作者未公开代码。
方法的工作原理。示意图根据这篇简讯绘制。
Switch to the English version? It is the same page at the same address, with a language prefix.
Other languages: Русский
FixAnything 通过视频生成模型改进 3D 场景渲染研究人员推出了 FixAnything——一种统一模型,用于修复不同 3D 表示中的渲染伪影,包括 Gaussian Splatting、NeRF、网格和点云。作者没有为每种格式设计专门的架构,而是……
4DStreamCtrl 在流式模式下统一控制相机、物体与深度arXiv 上发布了 4DStreamCtrl 的研究成果——一种交互式视频生成方法,将相机运动、物体轨迹和深度统一为 3D 点轨迹表示。作者在预训练模型之上训练 Geometric Motion Head
MoRoute 提出用于多模态视频生成的动态层路由方案MoRoute 的研究人员发表了一篇论文,提出通过动态层路由将冻结的视觉-语言模型(VLM)与预训练的视频扩散 Transformer(DiT)相结合。该方法允许每个块
Sci-VBench:生成模型视频科学可信度基准Sci-VBench 作者提出了一个用于评估科学领域视频生成的基准。该基准包含 1 253 个由专家标注的示例,涵盖自然科学、医疗健康、人文与社会科学以及工程学等 60 个学科