CPU3D3D、视频与音频的 AI 工具

Runway:视频生成器 — 功能、格式与结果权利

Runway — 云服务,用于根据文本生成图像、视频和音频。开发者将其定位为利用人工智能创建内容的工具。该服务代码不公开,无法在本地运行。

功能

输入可以是文本、图像、视频或音频。作者指出,有三种方式可以传递图像、视频或音频文件,这些方式均在文档中有详细说明。

视频生成可使用模型 gen4.5。它支持宽高比 1280:720720:1280,以及 2 到 10 之间的任意整数时长。宽高比和时长参数为必填项。该模型的提示词最多可包含 1,000 个字符。

开发者还提到了其他可用模型,包括 gemini_omni_flashseedance2aleph2

视频增强使用模型 magnific_video_upscaler_creative。输入视频时长不得超过 30 秒。帧率为 30 fps。

如何使用

该服务通过 API 提供。开发者提供了适用于 Node(包 @runwayml/sdk)和 Python(包 runwayml)的官方 SDK。作者建议使用 SDK 而非直接进行 HTTP 请求,因为 SDK 会处理版本头、重试和任务状态轮询。此外,还有用于处理角色的 React SDK

该服务不提供自有模型和权重,无法在本地运行。

结果权利

参数表中未注明权利转让条件。这一点需在合同或服务自身的使用条款中确认。

适用对象

该服务面向希望通过 API 和 SDK 将视频生成集成到自身应用中的开发者。适合需要根据文本、图像、视频或音频进行生成,而无需部署自有算力的用户。

不适合寻找开源解决方案、希望本地运行、微调模型或离线工作的用户。在规划任务时,还需注意输入视频增强时 30 秒的时长限制。

Runway 通过统一 API 提供多种生成模型的访问,但每种模型的具体操作细节,包括特定限制和格式,建议查阅服务文档进行确认。

输入 图像、音频、文本 referenceImage HTTPS URL / URI Prompt 最多 1000 字符 时长最多 30 秒 SDK / API Node: @runwayml/sdk Python: runwayml React SDK 用于虚拟形象 可嵌入组件 模型 gen4.5 gemini_omni_flash seedance2 aleph2 输出 虚拟形象视频 实时对话 实时 最多 30 秒 模式 音频 → 视频 文本 → 视频 云服务 Runway — 代码闭源,通过 API 访问
Runway 的处理流程。示意图依据工具参数表绘制。

参数表

任务从音频或文本生成视频头像、创建和管理头像、实时对话 据官网 来源
使用方式API、Node 和 Python SDK、React 头像 SDK、可嵌入组件 据官网 来源
输入图像、音频、文本 据官网 来源
视频时长30 с 据官网 来源
API 文档docs.dev.runwayml.com/api 据官网 来源
经常变化 — 数据截至 2026-08-05
模型版本gen4.5, gemini_omni_flash, seedance2, aleph2 据官网 来源
最低付费方案$12/月(Standard,年订阅) 据官网 来源
限制用于升级的输入视频不超过 30 秒 据官网 来源

数值由程序自动从官方来源采集,并于 2026-08-05 核对。每个数值都附来源链接;取自开发者页面的数值还附有原文引用——将鼠标悬停在标注上即可查看。价格与版本为核对日期时的数据,变化最频繁——购买前请以官网为准。

相关阅读