CPU3D3D、视频与音频的 AI 工具

VideoCrafter:视频生成器 — 功能与运行要求

VideoCrafter 是一套开源模型,用于根据文本描述或起始图像生成视频。该工具由腾讯 AI Lab 实验室创建,面向希望试验视频扩散模型并能访问源代码的研究人员和开发者。

功能

  • 根据文本生成视频(text-to-video)。 模型基于文本描述生成短视频。
  • 根据图像生成视频(image-to-video)。 可以输入一张静态图片,得到动画场景。
  • 处理扩散模型。 作者将 VideoCrafter2 描述为旨在克服高质量视频扩散模型数据限制的解决方案。

运行要求

  • 平台。 代码使用 Python 编写。运行需要支持 Python 及相关库的环境。
  • 硬件。 作者未指明对显存或内存的确切最低要求。由于涉及扩散模型,在本地运行需要一块显存容量足够的独立 GPU。
  • 许可证。 代码以 Apache License 2.0 开源,但有限制:仅限非商业使用。
  • 代码仓库。 源代码可在 github.com/AILab-CVC/VideoCrafter 获取。代码的最后一次变更记录于 2026 年 1 月 9 日。

适合谁

VideoCrafter 主要面向熟悉 Python 生态和扩散模型的研究人员和开发者。对于需要开源代码来进行微调、修改或研究生成式视频模型架构的人来说,这个工具会很有用。它并不适合没有编程技能、想要“开箱即用”的日常使用。同时还应考虑到,商业使用,包括销售、分发以及将其纳入商业产品或服务,是被严格禁止的。

包含更多信息的项目页面位于 ailab-cvc.github.io/videocrafter2/。在分析该仓库时,最新发布版本为 VideoCrafter1,同时作者描述了正在开发第二个版本的工作。

VideoCrafter 流程 根据文本和图像生成视频 文本 文本描述 自然语言 提示词 图像 源图像 动画参考 帧 编码器 CLIP / VAE 转换为 潜空间代码 扩散 U-Net / Transformer 迭代去噪 噪声 解码器 VAE Decoder 恢复 视频帧 视频 生成的视频 格式:MP4、GIF 高分辨率 帧 模式:text-to-video 模式:image-to-video 腾讯AI实验室 · 开源 · Python · VideoCrafter2
VideoCrafter 的处理流程。示意图依据工具参数表绘制。

参数表

代码许可证Apache License 2.0 附限制:仅限非商业使用 来源
语言Python 来源
代码最近更新2026-01-09 来源
仓库创建时间2023-04-03 来源
经常变化 — 数据截至 2026-09-14
最新版本VideoCrafter1 来源
发布日期2024-01-17 来源
GitHub 星标5073 来源
Fork 数413 来源

数值由程序自动从官方来源采集,并于 2026-09-14 核对。每个数值都附来源链接;取自开发者页面的数值还附有原文引用——将鼠标悬停在标注上即可查看。价格与版本为核对日期时的数据,变化最频繁——购买前请以官网为准。

相关阅读