CPU3D3D、视频与音频的 AI 工具

4DAnyone:视频生成器 — 功能与运行要求

4DAnyone — Ant Research 推出的开源视频生成器,可将普通单目视频转换为四维场景。该项目作为 SIGGRAPH Asia 2026 的论文成果发布,作者将其描述为从业余视频中创建“任意人物的 4D 形象”的工具。

功能

据开发者描述,4DAnyone 解决的是从单台摄像机拍摄的单个视频中生成人物或物体的四维表示的问题。其核心基于 4D Gaussian Splatting 方法——一种动态场景表示技术,能够重建运动和体积。作者将该工具归类为生成模型和视频世界模型,也就是说,该工具不仅仅是复现原始视频,而是构建一个可进一步操作的场景模型。

具体应用场景——视角、摄像机控制、背景更换或结果时长——作者在仓库描述中并未列出。仅说明了总体用途:从单目视频创建 4D 表示。

运行要求

代码使用 Python 编写,以 Apache-2.0 许可证发布。仓库已开源,源代码可在 github.com/ant-research/4DAnyone 获取。

据作者声明,运行需要支持 CUDA 的显卡。仓库描述中指出,峰值显存占用已降至 24 GB 以下,从而可以在消费级 GPU(例如 RTX 4090)上运行模型。在描述的另一处提到了 22 GB CUDA 显存的峰值占用。这些是开发者的声明,而非独立测试结果。

适合人群

该项目适合从事视频生成模型、4D 重建或 Gaussian Splatting 相关工作的研究人员和开发者。开源代码和 Apache-2.0 许可证允许研究实现细节、微调模型并将其集成到自己的流程中。

对于日常使用,该工具不太合适:需要支持 CUDA 且显存约为 22—24 GB 的显卡。根据描述,在性能较低的 GPU 上不支持运行。另外需要注意的是,该项目仍处于早期阶段:仓库创建于 2026 年 8 月,最后一次代码更新是在 2026 年 9 月初。

4DAnyone 是一款开源研究工具,解决的是具体问题:从单目视频构建 4D 场景。它需要配备 CUDA 的高性能显卡,更适合专业人士而非普通用户。

4DAnyone 流程 视频生成器:从单目视频到 4D 场景 视频 单目 输入 特征 提取 特征 4D 模型 高斯泼溅 生成式 渲染 CUDA 峰值内存 4D 场景 视频 生成 内存要求 CUDA 峰值内存:22 GB 显存:24 GB 消费级 GPU:RTX 4090 平台:CUDA 开源 · Apache-2.0 · Python · Ant Research
4DAnyone 的处理流程。示意图依据工具参数表绘制。

参数表

代码许可证Apache-2.0 来源
平台CUDA 据作者描述 来源
显存24 GB 据作者描述 来源
语言Python 来源
代码最近更新2026-09-04 来源
仓库创建时间2026-08-10 来源
经常变化 — 数据截至 2026-09-09
GitHub 星标1259 来源
Fork 数90 来源

数值由程序自动从官方来源采集,并于 2026-09-09 核对。每个数值都附来源链接;取自开发者页面的数值还附有原文引用——将鼠标悬停在标注上即可查看。价格与版本为核对日期时的数据,变化最频繁——购买前请以官网为准。

相关阅读