CPU3D3D、视频与音频的 AI 工具

Veo:视频生成器 — 功能、格式与结果权利

Veo 是 Google DeepMind 推出的云视频生成器,可将文本或图像转换为带声音的短视频。该服务面向需要快速获得符合其构思的视觉素材的内容创作者。

功能

Veo 的输入接受文本描述或场景、角色或物体的参考图像。据开发者称,该模型能够生成与作者创作愿景一致的视频。结果包含音轨。

作者给出的输出技术规格如下:

  • 视频时长 — 5 或 8 秒;
  • 分辨率 — 720p;
  • 帧率 — 24 FPS;
  • 文件格式 — MP4(MIME 类型 video/mp4)。

开发者指定的模型版本:veo-2.0-generate-001。

如何使用

Veo 仅作为云服务运行。模型代码和权重不公开,无法在本地运行。为访问生成功能,开发者建议通过 Gemini 平台使用浏览器界面。作者在参数表中未提及自有应用或公共 API。

结果权利

服务参数表中没有直接说明生成视频的权利归属。使用条款需查阅服务的用户协议。

适合人群

Veo 适合需要根据文本描述或静态图像生成简短动画片段的人。自带音轨简化了获取成品素材的流程,无需额外剪辑。时长和分辨率的限制使其更适合快速概念、分镜和短篇发布,而非高质量最终制作。对于寻找开源、可本地部署或支持长视频的生成器的用户,Veo 并不合适。

该服务解决的是一个特定问题 — 根据图像或文本快速生成带音频轨道的短视频。关于其功能的所有信息完全基于开发者发布的数据。

Veo 流水线 — 视频生成 Google DeepMind · 云服务 输入数据 文本描述 和参考图像 + 音轨 Veo 模型 视频生成 按文本和图像 veo-2.0-generate-001 参数 分辨率 720p 时长 5–8 秒 24 帧/秒 结果 成品视频 带音轨 video/mp4 访问方式 API · Google Cloud Console · Vertex AI 文档 cloud.google.com/vertex-ai/generative-ai/docs/video
Veo 的处理流程。示意图依据工具参数表绘制。

参数表

任务text-to-video, image-to-video 据官网 来源
使用方式API, Google Cloud Console 据官网 来源
输入文本、图像 据官网 来源
分辨率720p 据官网 来源
视频时长5, 8 с 据官网 来源
帧率24 据官网 来源
导出格式video/mp4 据官网 来源
API 文档cloud.google.com/vertex-ai/generative-ai/docs/video/generate-videos 据官网 来源
经常变化 — 数据截至 2026-08-05
模型版本veo-2.0-generate-001 据官网 来源

数值由程序自动从官方来源采集,并于 2026-08-05 核对。每个数值都附来源链接;取自开发者页面的数值还附有原文引用——将鼠标悬停在标注上即可查看。价格与版本为核对日期时的数据,变化最频繁——购买前请以官网为准。

相关阅读