H3 Cinematic Multishot Coverage 已在 HuggingFace 上发布,用于 image-to-video
2026年8月24日,HuggingFace 上发布了模型 ethanfel/H3_Cinematic_Multishot_Coverage,其任务为 image-to-video。代码已开源。截至发布时,该模型有 28 个“喜欢”标记,暂无下载量。
方法的工作原理。示意图根据此简讯绘制。
Switch to the English version? It is the same page at the same address, with a language prefix.
Other languages: Русский
Sci-VBench:生成模型视频科学可信度基准Sci-VBench 作者提出了一个用于评估科学领域视频生成的基准。该基准包含 1 253 个由专家标注的示例,涵盖自然科学、医疗健康、人文与社会科学以及工程学等 60 个学科
HuggingFace 上新模型 Minimax_h3_hybrid 解决 image-to-video 任务HuggingFace 上发布了模型 abakanai/Minimax_h3_hybrid,用于根据图像生成视频(image-to-video)。该模型于 2026 年 8 月 9 日上线,截至发布时已有 2111 次下载和 6 个“喜欢”标记。开发
LeFlow 通过生成式潜在先验将 world models 中的规划速度提升一个数量级研究人员推出了 LeFlow——一种将 latent world models 中的迭代轨迹优化替换为生成式规划的方法。LeFlow 不再为每一对“状态—目标”从头运行优化器,而是学习
KeyID 提出免微调的身份保持视频生成方法arXiv 上发布了 KeyID 的工作——一种 training-free 框架,用于 identity-preserving video generation,它将视频动态合成与身份嵌入分离。作者建议首先生成不绑定特定人物的草稿视频,然后……