神经网络视频生成器:开源与订阅制
视频生成器——从可安装到自己机器上的开源模型,到按订阅使用的云服务。每个工具的参数表中都包含:是否开源、本地运行需要什么配置、以及可以在什么条件下使用生成结果。
价格和套餐限额几乎每月都在变化,因此文中没有具体金额:只有“免费 / 有条件免费 / 付费”的等级划分,以及指向官方价格页面的链接。
文章
39 篇文章
video-generator-client:视频生成器 — 功能与运行要求video-generator-client 是一个开源视频生成器,将多个外部生成服务整合到一个工具中。据作者描述,它是面向 Seedance、Kling(可灵)、MiniMax 和 Wan(通义万相)的 Python 异步封装。该项目适合
Wan-Dancer-14B:视频生成器——功能与运行要求Wan-Dancer-14B 是一款开源视频生成器,可将静态图像转换为视频片段。开发者 Wan-AI 同时发布代码和模型权重,因此该工具可以自行研究并运行。功能 该模型负责
TE-Speed-MiniMaxH3-OSS:视频生成器 — 功能与运行要求TE-Speed-MiniMaxH3-OSS 是开发者 HELPMEEADICE 推出的开源视频生成器。该项目是作为加速 MiniMax-H3 模型工作的附加组件而创建的,作者在仓库说明中对此有所提及。功能 据作者描述,
RefAlign:视频生成器 — 功能与运行要求RefAlign 是一款开源视频生成器,可根据文本描述和参考图像生成视频。该工具解决的任务是 image-text-to-video:输入图像和文本,输出连贯一致的视频
forge-film:视频生成器——功能与运行要求forge-film 是一款开源视频生成器,它将影片创作流程构建为场景之间的依赖图,并并行运行相互独立的场景。开发者将其描述为一个对剧本依赖关系进行建模的引擎。
wind-comic:视频生成器 — 功能与运行要求wind-comic 是一款开源视频生成器,可将一行文字变成完整的短篇戏剧短片。据作者描述,该项目构建为多智能体流水线:先编写剧本,然后创建电影
Cosmos3-Super-Image2Video:视频生成器 — 功能与运行要求Cosmos3-Super-Image2Video 是 NVIDIA 推出的视频生成器,可将静态图像转换为短视频片段。该工具属于 Cosmos 系列,解决 image-to-video 任务:输入一张图片,输出得到
nano-world-model:视频生成器 — 功能与运行要求nano-world-model 是一个开源视频生成器,作者将其定位为面向世界模型研究的极简工具集。该仓库面向的任务不只是生成视频画面,而是需要处理
4DAnyone:视频生成器 — 功能与运行要求4DAnyone — Ant Research 推出的开源视频生成器,可将普通单目视频转换为四维场景。该项目作为 SIGGRAPH Asia 2026 的成果展示,据作者描述,其定位是用于创建“任意人物”的工具。
AI Comic Builder:视频生成器——功能与运行要求AI Comic Builder——一款开源视频生成器,可将剧本转化为动画漫画。开发者LingyiChen-AI将该工具描述为用于制作全动画视频、并自动刻画角色的工具,
Lance:视频生成器 — 功能与运行要求Lance — 字节跳动(Bytedance Inc.)推出的开源视频生成器。据作者描述,这是一款 any-to-any 模型,旨在理解、生成和编辑图像与视频。代码已在 GitHub 上开源,模型权重可在 Hugging Fa
AlayaRenderer:视频生成器 — 功能与运行要求AlayaRenderer — 来自 Alaya Lab 的开源视频生成器。它解决 image-to-image 任务:输入图像,输出视频序列。作者将该项目描述为生成式世界渲染器,专为游戏和虚拟...
Maestro:视频生成器——功能与运行要求Maestro 是 Blizaine 推出的开源视频生成器,定位为用于制作视频、图像和音乐的本地工作室。它采用 image-text-to-video 模式:输入文本并可选择附带图像,输出
HelixWorld:视频生成器 — 功能与运行要求HelixWorld — 来自 NoizAI 的开源视频生成器。据作者描述,它是一款面向实时交互式视听内容生成的世界模型。该项目专注于图像与空间结合至关重要的任务。
LingBot-Video:视频生成器 — 功能与运行要求LingBot-Video — 来自 Robbyant 的开源视频生成器。据作者描述,它是一款基于 mixture-of-experts 架构的视频预训练模型,面向具身智能任务。在仓库中,该项目被标记为
ViMax:视频生成器 — 功能与运行要求ViMax 是一款开源的视频生成器,据作者描述,它是一套智能体式视频生成系统。该工具集导演、编剧、制片人和视频生成器于一身。该项目由 Data Intelligen 实验室创建。
Wan(通义万相):视频生成器 — 功能与运行要求Wan(通义万相)是阿里巴巴推出的开源视频生成器,解决 text-to-video 任务。该模型将文本描述转换为视频序列,据开发者称,能够在消费级显卡上运行。功能 作者描述
SkyReels(昆仑万维 SkyReels):视频生成器 — 功能与运行要求SkyReels(昆仑万维 SkyReels)是 Skywork AI 推出的开源视频生成器。作者将其定位为首个专注于人物视频生成的开源模型。该工具既支持 text-to-video,也支持 image-to-video。功能
Vidu(生数 Vidu):视频生成器 — 功能、格式与成果权利Vidu(生数 Vidu)是生数科技推出的云视频生成器,支持 text-to-video 和 image-to-video 模式。该服务允许用户根据文本描述、静态图像或多个视角创建短动画片段。
Veo:视频生成器 — 功能、格式与结果权利Veo 是 Google DeepMind 推出的云视频生成器,可将文本或图像转换为带声音的短视频。该服务面向内容创作者,帮助他们快速获得符合需求的视觉素材。
Sora:视频生成器 — 功能、格式与结果权利Sora 是 OpenAI 推出的云视频生成器,能将文本、图像和现有视频片段转化为新场景。该服务面向制作写实及风格化动画素材(含特效)的需求。
Runway:视频生成器 — 功能、格式与结果权利Runway — 云服务,用于根据文本生成图像、视频和音频。开发者将其定位为借助人工智能创建内容的工具。该服务代码不公开,无法在本地运行。功能 在
Pika:视频生成器 — 功能、格式与成果权利Pika — 来自 Pika Labs 的云视频生成器,可将文本、图像和现成视频片段转化为新视频。该服务仅通过浏览器运行,不提供源代码或模型权重。功能 输入可提供文本、图像或视频片段。
Kling(可灵):视频生成器 — 功能、格式与成果权利Kling(可灵)是快手公司推出的云端视频和图像生成器。该服务定位为新一代工具,可根据文本描述或上传的图片生成视频,并支持运动控制。
Hailuo:视频生成器 — 功能、格式与成果权利Hailuo(海螺AI)是MiniMax公司的云视频生成器,可将文本或图像转换为短视频。该服务仅通过浏览器运行,不提供源代码或本地应用形式。功能 该服务支
Dream Machine:视频生成器 — 功能、格式与结果权利Dream Machine 是 Luma AI 推出的云服务,据开发者描述,它定位为创意工作空间的 AI 代理。该服务的任务是在统一平台上创建和编辑图像、视频、音频和文本。本工具页面将介绍其功能、运行要求、输出格式以及生成内容的使用权利。
VideoCrafter:视频生成器 — 功能与运行要求VideoCrafter 是一套开源模型,可根据文本描述或起始图像生成视频。该工具由腾讯 AI Lab 开发,面向希望进行实验的研究人员和开发者。
Stable Video Diffusion:视频生成器 — 功能与运行要求Stable Video Diffusion 是 Stability AI 推出的开源生成模型,用于将静态图像转换为短视频(image-to-video)。该工具面向准备就绪的研究人员和开发者。
Pyramid Flow(快手 Pyramid Flow):视频生成器 — 功能与运行要求Pyramid Flow(快手 Pyramid Flow)是一款开源视频生成器,可完成 text-to-video 任务。该模型采用金字塔式流匹配(flow matching)方法,据开发者称,可在显存较小的显卡上生成视频。
Open-Sora-Plan:视频生成器——功能与运行要求Open-Sora-Plan 是一款开源的文本描述视频生成器,由 PKU-YuanGroup 团队开发。该项目旨在通过社区力量复现 OpenAI 的 Sora 模型,为研究人员和开发者提供易用的工具。