CPU3D3D、视频与音频的 AI 工具

Wan-Dancer-14B:视频生成器——功能与运行要求

Wan-Dancer-14B 是一款开源视频生成器,可将静态图像转换为视频片段。开发者 Wan-AI 同时公开了代码和模型权重,因此该工具可以自行研究并运行。

功能

该模型解决 image-to-video 任务:输入一张图像,输出一段视频。通过 diffusers 库使用该模型。作者未说明对视频时长、分辨率或运动风格的限制。

运行要求

代码使用 Python 编写,以 Apache-2.0 许可证分发。模型权重同样以 Apache-2.0 提供。最大的单个权重文件为 32.1 GB,所有文件合计 79.7 GB。

据作者描述,运行需要 CUDA 平台。描述中原文写道:“Ensure CUDA 12.4 is installed and compatible with your system”。作者对显存的要求表述为:“Hardware: 8 x NVIDIA A800 80GB GPUs”。这是开发者的声明,而非独立测量结果。

仓库代码最后一次修改于 2026 年 7 月 17 日,仓库创建于 2026 年 7 月 13 日。

适合谁

该工具面向从事生成式视频、并愿意研究本地运行的用户。开源许可证允许将模型集成到自己的项目中并修改代码。

对于在普通电脑上快速测试,该模型很可能并不适合:所声明的硬件要求很高,而权重体积超过 79 GB。对于寻找无需配置环境的云服务的用户,建议考虑其他方案。

Wan-Dancer-14B 是一款用于在强大 GPU 服务器上本地部署的模型。代码和权重均开源,但准备环境和下载文件需要时间及相应的资源。

Wan-Dancer-14B 流水线 图像 输入帧 参考图 编码器 转换 为隐 表示 Transformer 生成 序列 解码器 重建 视频帧 视频 生成的帧序列 格式由 diffusers 库决定 所需显存:80 GB · 平台:CUDA · 语言:Python
Wan-Dancer-14B 的处理流程。示意图依据工具参数表绘制。

参数表

任务image-to-video 来源
代码许可证Apache-2.0 来源
权重许可证apache-2.0 来源
平台CUDA 据作者描述 来源
显存80 GB 据作者描述 来源
最大权重文件32.1 GB 来源
全部权重文件79.7 GB 来源
diffusers 来源
语言Python 来源
代码最近更新2026-07-17 来源
仓库创建时间2026-07-13 来源
经常变化 — 数据截至 2026-09-14
GitHub 星标430 来源
Fork 数47 来源
月下载量21134 来源
模型更新2026-07-17 来源

数值由程序自动从官方来源采集,并于 2026-09-14 核对。每个数值都附来源链接;取自开发者页面的数值还附有原文引用——将鼠标悬停在标注上即可查看。价格与版本为核对日期时的数据,变化最频繁——购买前请以官网为准。

相关阅读