KeyID 提出免微调的身份保持视频生成方法
arXiv 上发布了 KeyID 论文——一个 training-free 的 identity-preserving video generation 框架,它将视频动态的合成与身份特征的注入分离开来。作者提出先在不绑定具体人脸的情况下生成草稿视频,然后修正稀疏的关键帧,并在关键帧之间插值运动。该方法在 ACM Multimedia 2026 IPVG Grand Challenge 的 Track 2(Sequential Action)中获得了第二名。 arXiv
方法的工作原理。示意图根据这篇简讯绘制。
这意味着什么
KeyID 是一个研究框架,而不是可以直接使用的现成视频生成器。在我们的AI 视频指南中,没有以 identity-preserving video generation 为主要任务的工具。 类型上最接近的工具是开源的视频生成器:- LTX-Video——Lightricks 推出的开源 image-to-video 生成器。支持输入图像,但参数表中没有关于在长动作序列中保持角色身份的信息。
- CogVideoX(智谱 CogVideoX)——智谱 AI 推出的 text-to-video 生成器。也支持 image-to-video,但参数表中没有反映在复杂场景中保持同一人脸的任务。
- Pyramid Flow(快手 Pyramid Flow)——开源的 text-to-video 生成器。描述中没有提到参考图处理和身份保持。



