CPU3D3D、视频与音频的 AI 工具

Minimax-H3-fl2va-ref2va-hybrid-models:HuggingFace 上的新 text-to-video 模型

2026年8月11日,HuggingFace 上发布了模型 smhfacct/Minimax-H3-fl2va-ref2va-hybrid-models,任务为 text-to-video。截至发布时,该模型下载量为零,有 27 个“点赞”。开发者既未说明架构,也未说明硬件要求,更未说明输出文件格式。

这意味着什么

该模型属于根据文本描述生成视频的领域,即 text-to-video 方向。在我们的 3D 与视频 AI 工具指南 中,目前没有任何 text-to-video 任务的模型——所有收录的生成器都是基于图像工作的:OpenLRMHunyuan3D(混元3D)2.1TRELLIS 解决的是 image-to-3d 任务。与新模型在任务上没有直接重叠。 从间接特征来看,比较也很困难:我们收录的三个工具都是开源且发布了模型权重的,而 Minimax-H3-fl2va-ref2va-hybrid-models 的开发者既未说明许可证,也未说明代码是否开源,更未说明文件大小。在模型尚未获得下载量、也没有文档出现之前,无法评估它在指南工具中的位置。 如果该模型被证明可用,并获得了需求说明,就可以考虑将其作为候选加入 text-to-video 板块——目前指南中这一方向尚未覆盖。
Minimax-H3-fl2va-ref2va-hybrid-models HuggingFace 上的新 text-to-video 模型 输入 文本描述 模型 视频生成 架构未公开 输出 视频文件 HUGGINGFACE 状态 无下载量 27 个赞 无文档 ? 未注明许可证 暂无法评估该模型在指南工具中的位置
方法的工作原理。示意图根据这篇简讯绘制。

相关阅读