Vidu(生数 Vidu):视频生成器 — 功能、格式与成果权利

Vidu(生数 Vidu)— 生数科技推出的云端视频生成器,支持 text-to-video 和 image-to-video 模式。该服务可根据文字描述、静态图片或同一物体的多个视角生成短动画片段,并可提升成片画质。
功能
据开发者介绍,共有四种主要生成模式:
- Text2Video — 根据文字描述生成视频,使用关键帧保持主题统一。
- Image2Video — 将静态图片转化为动态视频,包含动画和情节发展。
- Reference2Video — 基于参考图片和文字描述生成视频。支持人物和物体;可上传同一物体的多个视角,以保持其在画面中的视觉一致性。
- Start-End2Video — 将静态图片转化为动态片段;作者对该模式的描述与 Image2Video 相同。
另有独立功能 Upscale — 将视频分辨率从 360p 提升至 1080p。
输入支持文字、图片或物体的多张图片。据作者描述,导出格式为:png、jpeg、jpg、webp。可用视频分辨率:540p、720p、1080p。文档中记录的 Vidu Q3-pro 模型最长视频时长为 16 秒;其他版本模型可能有不同限制 — 从 5 到 16 秒不等。
API 中声明的模型版本包括:viduq3-pro-fast、viduq3-turbo、viduq3-pro、viduq2-pro-fast、viduq2-pro、viduq2-turbo、viduq1、viduq1-classic、vidu2.0。
如何使用
Vidu(生数 Vidu)是云服务,通过 API 使用。参数表中未提及网页界面或独立应用。该服务不提供自有模型和模型权重,无法在自己的硬件上运行。API 文档见:https://platform.vidu.com/docs/llms.txt。
成果权利
所提供的参数表中未描述生成视频的许可条款和权利归属。此问题需查阅该服务的用户协议。
适用人群
该服务适合需要快速将静态图片或草图动画化,以及无需部署本地基础设施即可根据文字描述生成短视频的用户。Reference2Video 模式支持上传物体多个视角,适用于需要角色或物体在帧间保持视觉一致性的场景。
对于寻找开源、支持在自己的硬件上运行或可微调模型的生成器的用户,Vidu(生数 Vidu)并不适合 — 这是一个闭源云 API。另外需注意,视频最长时长为 16 秒,且采用积分制计费,具体细节作者在文档中说明。
Vidu(生数 Vidu)覆盖了将文字和图片转化为短视频的基础场景,但各模式的具体工作细节及 Reference2Video 的视角限制需查阅 API 文档 — 参数表中未作说明。
参数表
| 任务 | 视频生成:text-to-video、image-to-video、reference-to-video、start-end-to-video、upscale 据官网 来源 |
|---|---|
| 使用方式 | API 据官网 来源 |
| 输入 | 文本、图像、物体不同角度的照片 据官网 来源 |
| 分辨率 | 540p, 720p, 1080p 据官网 来源 |
| 视频时长 | 16 с 据官网 来源 |
| 导出格式 | png, jpeg, jpg, webp 据官网 来源 |
| API 文档 | platform.vidu.com/docs/llms.txt 据官网 来源 |
| 模型版本 | viduq3-pro-fast, viduq3-turbo, viduq3-pro, viduq2-pro-fast, viduq2-pro, viduq2-turbo, viduq1, viduq1-classic, vidu2.0 据官网 来源 |
|---|---|
| 最低付费方案 | $0.005/积分 据官网 来源 |
| 限制 | 按积分付费,价格取决于模型、分辨率和时长;大批量需求请联系 platform@vidu.studio 据官网 来源 |
数值由程序自动从官方来源采集,并于 2026-08-05 核对。每个数值都附来源链接;取自开发者页面的数值还附有原文引用——将鼠标悬停在标注上即可查看。价格与版本为核对日期时的数据,变化最频繁——购买前请以官网为准。



