CPU3D3D、视频与音频的 AI 工具

Open-Sora-Plan:视频生成器——功能与运行要求

Open-Sora-Plan 是一个开源的根据文本描述生成视频的工具,由 PKU-YuanGroup 团队创建。该项目旨在通过社区的力量复现 OpenAI 的 Sora 模型,为研究人员和开发者提供一个易于使用的视频生成实验工具。

功能

作者将该项目描述为对文本到视频(T2V)模型复现的尝试。在 1.3.0 版本中,宣称支持 WFVAE 组件、提示词优化器、数据过滤策略、稀疏注意力以及基于桶的训练策略。参数表中未指明具体的质量指标或生成视频的最大长度。

运行要求

代码使用 Python 编写,并以 MIT 许可证分发。代码库可在 github.com/PKU-YuanGroup/Open-Sora-Plan 获取。据开发者称,处理 93x480p 分辨率需要 24 GB 显存。支持在自己的硬件上运行,未提及云服务。

适用人群

该工具面向希望研究视频生成器架构或针对自身任务微调模型的研究人员和开发者。开源代码和 MIT 许可证允许自由修改项目。对于期望获得带界面的现成应用的最终用户来说,该项目可能过于底层——作者未指明是否提供图形界面或网页界面。

该项目正在积极开发中:代码的最后修改日期为 2026 年 3 月,最新版本为 1.5.0。这表明该工具仍在持续更新,尽管作者未在参数表中透露新功能的细节。

Open‑Sora‑Plan 流水线 开源视频生成器 · PKU‑YuanGroup 提示词 文本描述 俄语场景 或英语 优化器 改进 和细化 提示词 WFVAE 压缩到潜 空间 变分自编码器 扩散 帧生成 稀疏注意力 桶式训练 结果:视频 93×480p · 24 GB 显存 导出格式:MP4 · AVI · GIF MIT 许可证 · GitHub 开源 处理阶段
Open-Sora-Plan 的处理流程。示意图依据工具参数表绘制。

参数表

代码许可证MIT 来源
显存24 GB 据作者描述 来源
语言Python 来源
代码最近更新2026-03-08 来源
仓库创建时间2024-02-20 来源
经常变化 — 数据截至 2026-08-19
最新版本v1.5.0 来源
发布日期2025-06-05 来源
GitHub 星标12158 来源
Fork 数1061 来源

数值由程序自动从官方来源采集,并于 2026-08-19 核对。每个数值都附来源链接;取自开发者页面的数值还附有原文引用——将鼠标悬停在标注上即可查看。价格与版本为核对日期时的数据,变化最频繁——购买前请以官网为准。

相关阅读