CPU3D3D、视频与音频的 AI 工具

FramePack:视频生成器 — 功能与运行要求

FramePack — 这是一个基于扩散模型的开源视频生成器。据开发者称,其关键特性是能够在显存容量相对较小的硬件上生成长视频。该工具旨在将文本描述或图像转换为视频画面。

功能

作者将该项目定位为让视频扩散变得实用的一次尝试。参数表中未公开支持的生成模式(text-to-video、image-to-video)的具体列表以及最大画面分辨率。主要宣称的能力是生成长视频。开发者声称,使用 130 亿参数的模型生成一分钟视频(60 秒)、每秒 30 帧(1800 帧),至少需要 6 GB GPU 显存。另外还特别强调了与笔记本电脑显卡的兼容性。

运行要求

运行需要支持 CUDA 的图形处理器。作者建议使用独立的 Python 3.10 环境,并提供了现成的安装包,针对 CUDA 12.6 和 PyTorch 2.6 组合进行了优化。据作者描述,最低显存要求为 6 GB。项目代码使用 Python 编写,并以 Apache 2.0 许可证分发。源代码可在 GitHub 仓库中获取,地址为 github.com/lllyasviel/FramePack。最新版本标记为 windows 标签,表明存在针对该操作系统的构建版本。

适用人群

FramePack 适合那些尝试生成长视频但受限于显卡显存容量的用户。关于 13B 模型在 6 GB 显存上运行的声明,使其对笔记本电脑用户和配置不算顶级的台式机 GPU 用户颇具吸引力。该项目不适合没有 NVIDIA 显卡的用户,因为作者未提及除 CUDA 之外的其他平台支持。它也可能不适合那些寻找带有图形界面和技术支持的现成商业解决方案的用户——从各方面来看,交互是通过代码进行的。

FramePack 是降低视频扩散任务硬件准入门槛的一次尝试。在不同于作者描述的场景下,生成过程是否能在宣称的 6 GB 显存下保持稳定,还有待独立测试来验证。

输入数据 文本描述 参考图像 场景参数 Python 3.10 CUDA 12.6 预处理 归一化 文本分词 帧编码 PyTorch 2.6 6 GB 显存 视频生成 13B 模型 帧扩散 30 fps / 1800 帧 FramePack lllyasviel 后处理 帧组装 平滑 视频编码 Apache-2.0 开源 结果 视频文件:1 分钟,30 fps,1800 帧 导出格式:Windows 包(one-click package) 平台:CUDA · 最低显存:6 GB FramePack 流水线 开源视频生成器 · lllyasviel
FramePack 的处理流程。示意图依据工具参数表绘制。

参数表

代码许可证Apache-2.0 来源
平台CUDA 据作者描述 来源
显存6 GB 据作者描述 来源
Python3.10 据作者描述 来源
语言Python 来源
代码最近更新2025-10-16 来源
仓库创建时间2025-04-12 来源
经常变化 — 数据截至 2026-09-03
最新版本windows 来源
发布日期2025-04-18 来源
GitHub 星标17241 来源
Fork 数1738 来源

数值由程序自动从官方来源采集,并于 2026-09-03 核对。每个数值都附来源链接;取自开发者页面的数值还附有原文引用——将鼠标悬停在标注上即可查看。价格与版本为核对日期时的数据,变化最频繁——购买前请以官网为准。

相关阅读