HuggingFace 发布用于 image-to-video 的新模型 H3_HD_2K_Detailer
2026年8月24日,HuggingFace 上发布了模型 zuanfilm/H3_HD_2K_Detailer,任务为 image-to-video。截至发布时,该模型有 26 个“喜欢”标记,暂无下载量。开发者未说明架构细节、硬件要求或输入输出格式。
方法原理。示意图根据此简讯绘制。
Switch to the English version? It is the same page at the same address, with a language prefix.
Other languages: Русский
ES3D 通过语义嵌入实现 3D 组件级编辑arXiv 上发布了 ES3D 的研究成果——一个用于 3D 资产组件级编辑的框架。作者提出将语义直接嵌入 3D 空间:多视角语义特征被投影到体素化的空
HuggingFace 新模型 h3-vbvr 解决 image-to-video 任务2026年8月18日,HuggingFace 上发布了模型 Patarapoom/h3-vbvr,任务为 image-to-video。发布时已有 2434 次下载,0 个「喜欢」标记。代码已开源。这意味着什么 该模型属于 te
LTX-Video 与 CogVideoX 目前尚无法解决单视频中多对象生成问题arXiv 上发表了一项对比研究,探讨三种无需微调即可生成包含多个对象的视频的方法:直接生成、并行生成和顺序生成。作者分析了每种方法在保持对象外观一致性方面的表现
Latent-to-4D 直接从视频潜变量生成4D场景,无需中间RGB步骤论文《Beyond Pixels: From Video Priors to 4D Worlds》的作者提出了 Latent-to-4D 方法,该方法跳过了 RGB 视频重建阶段,直接从视频模型的最终去噪潜变量预测动态 3D 场景。该方法基于