VoxelModel-v1:HuggingFace 上新的开源 text-to-3d 模型
HuggingFace 上发布了模型 bench-labs/VoxelModel-v1,用于解决 text-to-3d 任务。该模型于 2026 年 7 月 26 日发布,代码已开源。开发者未说明显存要求、导出格式、许可证及其他技术细节。
方法原理示意图。此图根据这篇简讯绘制。
Switch to the English version? It is the same page at the same address, with a language prefix.
Other languages: Русский
Stream4D 为流式自回归视频模型添加 4D 一致性Stream4D: 4D-Consistency for Streaming Autoregressive Diffusion Video Models(arXiv,2026 年 8 月 20 日)的作者提出了一种训练流式自回归扩散模型的方法,该方法在功能中取代了静态 3D 重建
Token Radius Attention 无需微调即可加速扩散 Transformer 中的视频生成北京大学的研究人员提出了 Token Radius Attention (TRA)——一种在 Video Diffusion Transformers 中减少计算量的方法,无需重新训练模型。该论文于 2026 年 8 月 3 日发布在 arXiv 上。A
LTX-2.5 已发布至 HuggingFace,支持 text-to-video 任务HuggingFace 上发布了模型 comfyicu/LTX-2.5,支持 text-to-video 任务。发布日期为 2026 年 8 月 13 日,该模型已有 3630 次下载。详情请见模型页面。这意味着什么 在我们关于 3D 和视频的 AI 工具指南中,目前不
KeyID 提出免微调的身份保持视频生成方法arXiv 上发布了 KeyID 的工作——一种 training-free 框架,用于 identity-preserving video generation,它将视频动态合成与身份嵌入分离。作者建议首先生成不绑定特定人物的草稿视频,然后……