ROAM:使用神经姿态描述符的鲁棒且对象感知的运动生成

💡 原文中文,约300字,阅读约需1分钟。
📝

内容提要

该研究提出了一种基于深度学习的无监督视频分解方法,可以将视频分解为三维几何、运动物体和它们的运动。通过训练深度网络来预测姿态和深度,最小化合成图像与真实图像之间的误差。该方法在KITTI和EPIC-Kitchens上表现出竞争力的性能。

🏷️

标签

➡️

继续阅读