Minimax-H3-fl2va-ref2va-hybrid-models:HuggingFace 上的新 text-to-video 模型
2026年8月11日,HuggingFace 上发布了模型 smhfacct/Minimax-H3-fl2va-ref2va-hybrid-models,任务为 text-to-video。截至发布时,该模型下载量为零,有 27 个“点赞”。开发者既未说明架构,也未说明硬件要求,更未说明输出文件格式。
方法的工作原理。示意图根据这篇简讯绘制。
Switch to the English version? It is the same page at the same address, with a language prefix.
Other languages: Русский
MiniMax-H3-slim 已在 HuggingFace 发布,用于文本生成视频2026 年 8 月 24 日,模型 fkyyy/MiniMax-H3-slim 在 HuggingFace 上发布,任务为 text-to-video。发布时该模型有 508 次下载,没有任何“喜欢”标记。详情见模型页面。这意味着什么 该模型属于
KeyID 提出免微调的身份保持视频生成方法arXiv 上发布了 KeyID 的工作——一种 training-free 框架,用于 identity-preserving video generation,它将视频动态合成与身份嵌入分离。作者建议首先生成不绑定特定人物的草稿视频,然后……
DeltaWAM 加速双臂机器人动作生成并开源代码AIGeeksGroup 的研究人员推出了 DeltaWAM——一种用于控制机器人双臂的 world-action 模型。它不预测密集的未来帧,而是预测视觉增量和动作,而 Streaming Delta Memory 则更新缓存
GVCCTurbo 为生成式视频和图像压缩提出码率规划方案arXiv 研究人员推出了 GVCCTurbo——一种规划器,它将生成式先验分布的昂贵更新与通过码本传输修正分离。它不再将采样器步数硬性绑定到