MiniMax-H3-slim 已在 HuggingFace 发布,用于文本生成视频
2026年8月24日,HuggingFace 上发布了模型 fkyyy/MiniMax-H3-slim,任务为 text-to-video。截至发布时,该模型有 508 次下载,且没有任何“喜欢”标记。详情请见模型页面。
方法的工作原理。示意图根据这篇简讯绘制。
Switch to the English version? It is the same page at the same address, with a language prefix.
Other languages: Русский
HuggingFace 发布用于 image-to-video 的新模型 H3_HD_2K_Detailer2026 年 8 月 24 日,HuggingFace 上发布了模型 zuanfilm/H3_HD_2K_Detailer,任务为 image-to-video。截至发布时,该模型有 26 个“喜欢”标记,暂无下载量。开发者未说明架构细节、运行要求等。
DiffVC-ONE 推出基于 Video DiT 的单步视频扩散压缩arXiv 发布了 DiffVC-ONE 论文——基于单步 Video Diffusion Transformer 的生成式视频压缩框架。作者宣称包含三个组件:用于压缩潜在切片的 Unified Unidirectional Latent Compressor、One-Ste
AnyTalk 为任意角色生成 3D 语音动画,无需动画数据研究人员推出了 AnyTalk——一种为任意角色生成 3D 语音动画的方法,既不需要动画数据,也不需要手动绑定。取而代之的是,作者在目标角色的渲染结果上对现成的 video diffusion model 进行微调。
GlanceWAM 在面向机器人的单一视频 DiT 中分离想象与控制研究人员推出了 GlanceWAM——一种 world-action models 方法,将视频生成从控制的关键路径中移出。异步 proposer 以慢节奏在后台提前数秒预测一帧,而 action