Allegro:视频生成器 — 功能与运行要求

Allegro 是 Rhymes AI 推出的开源视频生成器,解决 text-to-video 任务。该模型将文本描述转化为短视频,并以自由许可证分发:代码和模型权重均采用 Apache-2.0 许可证。
功能
据开发者称,Allegro 可生成最长 6 秒、每秒 15 帧、分辨率 720p 的视频。该模型基于 diffusers 库运行,接受简单的文本描述作为输入。作者未指明支持的提示词语言,但仓库中的示例均为英文。
运行要求
Allegro 使用 Python 编写。运行需要 PyTorch 2.4 或更高版本以及 CUDA 12.4 或更高版本——作者仅明确提及 CUDA 平台。完整依赖列表见 requirements.txt。
最大的权重文件占用 8.9 GB,完整权重集为 41.3 GB。据作者描述,在不采取特殊措施的情况下,模型需要约 27.5 GB 显存。如果启用 --enable_cpu_offload,显存占用降至约 9.3 GB,但推理时间会显著增加。开发者在内存优化语境中提到的最低门槛为 3 GB,但文档中未对这一数字作进一步说明。
代码位于仓库 github.com/rhymes-ai/Allegro,权重托管在 huggingface.co/rhymes-ai/Allegro。项目官网:rhymes.ai。
适用人群
Allegro 面向那些寻找可在自己机器上运行的开源视频生成器的用户。该模型适合愿意研究 CUDA 环境配置并通过 CPU offload 管理内存的研究人员和开发者。对于显存低于 9—10 GB 的用户,应依赖 CPU 卸载模式,并接受较慢的运行速度。
Allegro 不适合需要生成超过 6 秒视频、高于 15 FPS 帧率,或没有支持 CUDA 的 NVIDIA 显卡的用户。此外,该模型也不面向期望开箱即用、带界面的应用程序的用户:运行需通过 Python 脚本完成。
Allegro 是少数完全开源的视频生成器之一,代码和模型权重均采用宽松的 Apache-2.0 许可证。仓库创建于 2024 年 10 月,并于 2025 年 2 月初更新,项目正处于积极开发阶段。
参数表
代码仓库 · HuggingFace 模型 · 开发者网站
| 任务 | text-to-video 来源 |
|---|---|
| 代码许可证 | Apache-2.0 来源 |
| 权重许可证 | apache-2.0 来源 |
| 平台 | CUDA 据作者描述 来源 |
| 显存 | 9.3–27.5 GB 据作者描述 来源 |
| 最大权重文件 | 8.9 GB 来源 |
| 全部权重文件 | 41.3 GB 来源 |
| 库 | diffusers 来源 |
| 语言 | Python 来源 |
| 代码最近更新 | 2025-02-07 来源 |
| 仓库创建时间 | 2024-10-16 来源 |
数值由程序自动从官方来源采集,并于 2026-08-19 核对。每个数值都附来源链接;取自开发者页面的数值还附有原文引用——将鼠标悬停在标注上即可查看。价格与版本为核对日期时的数据,变化最频繁——购买前请以官网为准。



