LingBot-Video:视频生成器 — 功能与运行要求

LingBot-Video — 来自 Robbyant 的开源视频生成器。作者将其描述为一种用于视频预训练的 mixture-of-experts 架构模型,面向 embodied intelligence 任务。在仓库中,该项目被标记为 image-to-video、video-generation 和 world-models,也就是说,其主要任务是将图像转化为视频序列并构建世界模型。
功能
据作者描述,LingBot-Video 解决的是 mixture-of-experts 在视频预训练中的扩展问题。实际上,这意味着从图像生成视频——仓库中带有 image-to-video 标签。作者在参数表中没有提供详细的使用场景示例,因此关于视频时长、分辨率或运动控制的具体限制,目前无可奉告。
运行要求
代码用 Python 编写,通过 diffusers 库运行。运行需要访问模型权重:最大的文件占用 4.6 GB,所有权重文件合计 11.3 GB。作者没有指明显存或内存的最低要求,因此无法根据参数表判断该模型能在哪款显卡上运行。
代码和权重的许可证均为 Apache-2.0。这允许商业使用和修改。代码已开源,仓库可在 github.com/Robbyant/lingbot-video 获取,权重可在 huggingface.co/robbyant/lingbot-video-dense-1.3b 获取。项目还有独立网站:technology.robbyant.com/lingbot-video。
适合谁
该项目适合从事 image-to-video 生成工作并愿意通过 diffusers 在本地运行模型的人。代码和权重采用 Apache-2.0 开源许可证,允许将生成器集成到自己的流程中,包括商业用途。
对于寻找带 Web 界面的现成服务的人来说,LingBot-Video 并不合适:这是一个包含代码和权重的仓库,而非云产品。另外需要注意的是,作者没有公布硬件要求——运行前需要自行验证内存是否足以容纳 11.3 GB 的权重以及生成过程本身。
LingBot-Video 是一个新项目:仓库创建于 2026 年 7 月,代码最后一次更新是在 2026 年 8 月。这意味着文档和示例可能不完整,模型行为也可能尚未在广泛的任务中得到充分验证。
参数表
代码仓库 · HuggingFace 模型 · 开发者网站
| 代码许可证 | Apache-2.0 来源 |
|---|---|
| 权重许可证 | apache-2.0 来源 |
| 最大权重文件 | 4.6 GB 来源 |
| 全部权重文件 | 11.3 GB 来源 |
| 库 | diffusers 来源 |
| 语言 | Python 来源 |
| 代码最近更新 | 2026-08-05 来源 |
| 仓库创建时间 | 2026-07-08 来源 |
数值由程序自动从官方来源采集,并于 2026-09-05 核对。每个数值都附来源链接;取自开发者页面的数值还附有原文引用——将鼠标悬停在标注上即可查看。价格与版本为核对日期时的数据,变化最频繁——购买前请以官网为准。



