神经网络视频生成器:开源与订阅制
视频生成器——从可安装到自己机器上的开源模型,到按订阅使用的云服务。每个工具的参数表中都包含:是否开源、本地运行需要什么配置、以及可以在什么条件下使用生成结果。
价格和套餐限额几乎每月都在变化,因此文中没有具体金额:只有“免费 / 有条件免费 / 付费”的等级划分,以及指向官方价格页面的链接。
文章
39 篇文章
Open-Sora:视频生成器 — 功能与运行要求Open-Sora 是 HPC-AI Tech 团队开发的开源视频生成器。该工具用于根据文本描述合成视频序列,其主要目标是让高效视频制作对所有人开放。
Mochi 1:视频生成器——功能与运行要求Mochi 1 是一款基于文本描述生成视频(text-to-video)的开源视频生成器,由 Genmo 公司开发。该工具用于根据提示合成视频片段,并支持本地运行和微调。
Latte:视频生成器 — 功能与运行要求Latte 是一款基于 Latent Diffusion Transformer 架构的开源视频生成器。开发者将其定位为用于根据文本描述合成视频的研究工具,已在会议框架内发布。
HunyuanVideo(混元视频):视频生成器 — 功能与运行要求HunyuanVideo(混元视频)是腾讯推出的开源视频生成器,用于解决 text-to-video 任务。该工具基于 diffusion-transformer 构建,旨在根据文本描述生成视频片段。功能 作者们表
FramePack:视频生成器 — 功能与运行要求FramePack 是一款基于扩散模型的开源视频生成器。据开发者称,其关键特性是能够在显存容量相对较小的硬件上生成长视频。该工具
AnimateDiff:视频生成器 — 功能与运行要求AnimateDiff 是一款开源工具,用于从文本描述生成短视频片段。它的目标是为 Stable Diffusion 等流行模型生成的静态图片添加可控的动态效果。
Allegro:视频生成器 — 功能与运行要求Allegro 是 Rhymes AI 推出的开源视频生成器,解决 text-to-video 任务。该模型将文本描述转化为短视频,并自由分发:代码和权重均采用 Apache-2.0 许可证。功能 据作者
CogVideoX(智谱 CogVideoX):视频生成器 — 功能与运行要求这里介绍的是 CogVideoX(智谱 CogVideoX)——一款开源文本描述视频生成器。其开发者智谱 AI 公司将其定位为把文本提示转化为视频短片的工具。该模型也常与以下内容一起被提及:
LTX-Video:视频生成器 — 功能与运行要求LTX-Video 是 Lightricks 公司推出的开源视频生成器,用于解决 image-to-video 任务。该工具可将静态图像转换为视频片段,并支持在自己的硬件上本地运行。功能 A