Perception-as-Control是阿里巴巴通义实验室推出的图像动画框架,能根据用户意图实现细粒度的运动控制。Perception-as-Control基于构建3D感知运动表示,将相机和物体运动转化为直观、一致的视觉变化,用感知结果作为运动控制信号,支持多种与运动相关的视频合成任务。Perception-as-Control框架基于U-Net架构的扩散模型,结合参考图像的外观信息和运动控制信号的运动信息,生成可控的图像动画。Perception-as-Control推出三阶段训练策略,平衡相机和物体运动控制,促进细粒度运动控制,在多种应用场景中展现出优越的性能。

Perception-baidu09as-baidu09Control – 阿里通义实验室推出的图像动画框架  第1张
(图片来源网络,侵删)
Perception-baidu09as-baidu09Control – 阿里通义实验室推出的图像动画框架  第2张
(图片来源网络,侵删)