Veo:视频生成器 — 功能、格式与结果权利

Veo 是 Google DeepMind 推出的云视频生成器,可将文本或图像转换为带声音的短视频。该服务面向需要快速获得符合其构思的视觉素材的内容创作者。
功能
Veo 的输入接受文本描述或场景、角色或物体的参考图像。据开发者称,该模型能够生成与作者创作愿景一致的视频。结果包含音轨。
作者给出的输出技术规格如下:
- 视频时长 — 5 或 8 秒;
- 分辨率 — 720p;
- 帧率 — 24 FPS;
- 文件格式 — MP4(MIME 类型 video/mp4)。
开发者指定的模型版本:veo-2.0-generate-001。
如何使用
Veo 仅作为云服务运行。模型代码和权重不公开,无法在本地运行。为访问生成功能,开发者建议通过 Gemini 平台使用浏览器界面。作者在参数表中未提及自有应用或公共 API。
结果权利
服务参数表中没有直接说明生成视频的权利归属。使用条款需查阅服务的用户协议。
适合人群
Veo 适合需要根据文本描述或静态图像生成简短动画片段的人。自带音轨简化了获取成品素材的流程,无需额外剪辑。时长和分辨率的限制使其更适合快速概念、分镜和短篇发布,而非高质量最终制作。对于寻找开源、可本地部署或支持长视频的生成器的用户,Veo 并不合适。
该服务解决的是一个特定问题 — 根据图像或文本快速生成带音频轨道的短视频。关于其功能的所有信息完全基于开发者发布的数据。
参数表
| 任务 | text-to-video, image-to-video 据官网 来源 |
|---|---|
| 使用方式 | API, Google Cloud Console 据官网 来源 |
| 输入 | 文本、图像 据官网 来源 |
| 分辨率 | 720p 据官网 来源 |
| 视频时长 | 5, 8 с 据官网 来源 |
| 帧率 | 24 据官网 来源 |
| 导出格式 | video/mp4 据官网 来源 |
| API 文档 | cloud.google.com/vertex-ai/generative-ai/docs/video/generate-videos 据官网 来源 |
经常变化 — 数据截至 2026-08-05
| 模型版本 | veo-2.0-generate-001 据官网 来源 |
|---|
数值由程序自动从官方来源采集,并于 2026-08-05 核对。每个数值都附来源链接;取自开发者页面的数值还附有原文引用——将鼠标悬停在标注上即可查看。价格与版本为核对日期时的数据,变化最频繁——购买前请以官网为准。



