HunyuanVideo(混元视频):视频生成器 — 功能与运行要求

HunyuanVideo(混元视频)是腾讯推出的开源视频生成器,解决 text-to-video 任务。该工具基于 diffusion-transformer 构建,用于根据文本描述生成视频片段。
功能
作者将该项目定位为大规模视频生成的系统框架。仓库中并未披露具体的质量指标或支持的风格。从项目标签可以看出,其基础是 diffusion-models 和 diffusion-transformer。源代码使用 Python 编写,可供研究和修改。
运行要求
- 平台:据作者描述,需要支持 CUDA 的 NVIDIA 显卡。
- 显存:作者给出的最低要求为——720x1280(129 帧)需要 60 GB,544x960(129 帧)需要 45 GB。
- 许可证:代码和模型权重按 Tencent Hunyuan Community License 分发:允许商用,但欧盟、英国和韩国除外。
- 模型:可在 Hugging Face 获取,代码在 GitHub 上。
适用人群
该工具面向拥有强大算力资源的研究人员和开发者。最高分辨率需要 60 GB 显存,这一要求将大多数消费级显卡排除在外。该项目适合那些愿意使用开源代码、考虑 Tencent Hunyuan Community License 限制并自行配置环境的用户。如需快速了解,网站 aivideo.hunyuan.tencent.com 提供了云服务版本——无法在本地运行。
HunyuanVideo(混元视频)作为用于视频生成的 diffusion-transformer 开源实现颇具价值,但较高的硬件门槛以及 Tencent Hunyuan Community License 的限制,在将其引入工作流程之前需要加以注意。
参数表
代码仓库 · HuggingFace 模型 · 开发者网站
| 任务 | text-to-video 来源 |
|---|---|
| 代码许可证 | Tencent Hunyuan Community License:允许商用,但欧盟、英国和韩国除外 来源 |
| 权重许可证 | Tencent Hunyuan Community License:允许商用,但欧盟、英国和韩国除外 来源 |
| 平台 | CUDA 据作者描述 来源 |
| 显存 | 45–60 GB 据作者描述 来源 |
| 语言 | Python 来源 |
| 代码最近更新 | 2026-06-29 来源 |
| 仓库创建时间 | 2024-11-28 来源 |
数值由程序自动从官方来源采集,并于 2026-09-14 核对。每个数值都附来源链接;取自开发者页面的数值还附有原文引用——将鼠标悬停在标注上即可查看。价格与版本为核对日期时的数据,变化最频繁——购买前请以官网为准。



