CPU3D3D、视频与音频的 AI 工具

VideoCrafter:视频生成器——功能与运行要求

VideoCrafter 是一套用于根据文本描述或起始图像生成视频的开源模型集。该工具由腾讯 AI 实验室(Tencent AI Lab)开发,面向希望在有源代码访问权限的情况下尝试视频扩散模型的研究人员和开发者。

功能

  • 根据文本生成视频(text-to-video)。 该模型根据文本描述生成短视频。
  • 根据图像生成视频(image-to-video)。 可以输入静态图片,获得动画场景。
  • 支持扩散模型。 据作者描述,VideoCrafter2 旨在克服高质量视频扩散模型的数据限制。

运行要求

  • 平台。 代码使用 Python 编写。运行需要支持 Python 及相关库的环境。
  • 硬件。 作者未指明显存或内存的具体最低要求。由于涉及扩散模型,在本地运行需要配备足够显存的独立 GPU。
  • 许可证。 代码开源,但许可证非标准——作者建议在仓库中手动查看使用条款。
  • 仓库。 源代码可在 github.com/AILab-CVC/VideoCrafter 获取。代码最后更新时间为 2026 年 1 月 9 日。

适用人群

VideoCrafter 主要面向熟悉 Python 生态和扩散模型的研究人员与开发者。该工具适合需要开源代码进行微调、修改或研究生成式视频模型架构的用户。它不适合没有编程技能的用户直接“开箱即用”进行日常使用。此外,如果您计划用于商业用途,还需注意其非标准许可证。

项目页面及更多信息请访问 ailab-cvc.github.io/videocrafter2/。在分析仓库时,最新版本为 VideoCrafter1,但作者表示正在开发第二版。

VideoCrafter 流程 根据文本和图像生成视频 文本 文本描述 自然语言 提示词 图像 源图像 动画参考 编码器 CLIP / VAE 转换为 潜空间代码 扩散 U-Net / Transformer 迭代去噪 噪声 解码器 VAE Decoder 恢复 视频帧 视频 生成的视频 格式:MP4、GIF 高分辨率 模式:text-to-video 模式:image-to-video 腾讯AI实验室 · 开源 · Python · VideoCrafter2
VideoCrafter 的处理流程。示意图依据工具参数表绘制。

参数表

代码许可证非标准(需手动核实) 来源
语言Python 来源
代码最近更新2026-01-09 来源
仓库创建时间2023-04-03 来源
经常变化 — 数据截至 2026-08-03
最新版本VideoCrafter1 来源
发布日期2024-01-17 来源
GitHub 星标5070 来源
Fork 数415 来源

数值由程序自动从官方来源采集,并于 2026-08-03 核对。每个数值都附来源链接;取自开发者页面的数值还附有原文引用——将鼠标悬停在标注上即可查看。价格与版本为核对日期时的数据,变化最频繁——购买前请以官网为准。

相关阅读