CVPR2023新作:3D人体姿态估计

  1. Title: 3D Human Pose Estimation via Intuitive Physics

  2. Affiliation: Max Planck Institute for Intelligent Systems, Tübingen, Germany

  3. Authors: Shashank Tripathi, Lea Müller, Chun-Hao P. Huang, Omid Taheri, Michael J. Black, Dimitrios Tzionas

  4. Keywords: 3D human pose estimation, physics engine, intuitive-physics terms, pressure heatmap, stable configuration.

  5. Summary:

  • (1): 本文的研究背景是3D人体姿态的估计。

  • (2): 过去的方法忽略了人体与场景的交互,导致估计到的结果往往不够精准、不符合物理规律。本文提出了IPMAN,这一方法具有可解释性、易于实现、计算速度快、可由基于优化和回归的现有方法轻松调用等特点。

  • (3): 本文提出了一种直观物理学(IP)的思想,从3D SMPL Body与场景的交互中推断出身体上的压力热图、压力中心和SMPL Body的重心。并且根据这些信息,用IPMAN估计出色彩图像中的3D人体姿态,从而实现姿态在物理上的"稳定"。 本文的方法是通过于SMPL Body的物理学、以及把压力热图、压力中心、SMPL Body的重心考虑进去,这一具有鲜明特色的方法实现的。

  • (4): 本文在多个数据集上验证了IPMAN的性能,结果显示IPMAN的表现优于目前最先进的方法,并且在提高静态姿势准确率的同时也不会损害动态姿势的准确性。文章提供了IPMAN源代码和数据,同时发表在了CVPR会议上。

  1. Methods:
  • (1): 本文提出的方法是利用直观物理学(IP)的思想,从3D SMPL Body与场景的交互中推断出身体上的压力热图、压力中心和SMPL Body的重心。通过与SMPL Body的物理学、以及考虑压力热图、压力中心、SMPL Body的重心,得出一个具有鲜明特色的3D人体姿态估计方法IPMAN。

  • (2): 在IPMAN中,压力热图用于表示3D SMPL Body与场景之间的接触,压力中心表示场景施加的力影响着身体的哪些部位,而SMPL Body的重心(通过计算所有顶点的加权平均)有助于保持姿势的稳定性。

  • (3): IPMAN方法在预测3D人体姿态时,先利用现有的2D关键点检测器检测得到2D关键点,并根据这些关键点构建输入坐标图,这个输入坐标图可以被用于预测3D人体姿态。根据陆续输入的样本,模型可以自适应地学习更好的姿态估计。

  • (4): 为了证明IPMAN的优越性,本文的作者在几个数据集上进行了实验,结果显示IPMAN比现有方法更好地估计了3D人体姿态。注意到我们的方法不仅提高了静态姿势估计的准确性,而且在动态情况下同样有效。

  1. Conclusion:
  • (1): 本文提出了一种利用直观物理学来估计3D人体姿态的方法,能够更好地推断出身体的稳定姿态,提高静态姿态准确率的同时不会影响动态姿态的准确性。这项工作对于人体活动分析、运动医学和虚拟现实等领域具有重要意义。

  • (2): 创新点:本文利用直观物理学的思想,设计了一种新的3D人体姿态估计方法,通过压力热图、压力中心和SMPL Body的重心来推断身体的稳定姿态;

性能:本文的实验结果表明所提出的IPMAN方法在多个数据集上比现有方法表现更优,不仅提高了姿态准确性,还保持了计算速度快的特点;

工作量:文章提供了IPMAN方法的源代码和数据集,可以方便地应用于现有的优化和回归方法,具有易于实现的特点。

相关推荐
卧式纯绿17 分钟前
每日文献(八)——Part one
人工智能·yolo·目标检测·计算机视觉·目标跟踪·cnn
巷95523 分钟前
OpenCV图像形态学:原理、操作与应用详解
人工智能·opencv·计算机视觉
xiangzhihong81 小时前
Amodal3R ,南洋理工推出的 3D 生成模型
人工智能·深度学习·计算机视觉
阿linlin1 小时前
OpenCV--图像预处理学习01
opencv·学习·计算机视觉
狂奔solar1 小时前
diffusion-vas 提升遮挡区域的分割精度
人工智能·深度学习
程序员Linc3 小时前
边缘检测技术现状初探2:多尺度与形态学方法
计算机视觉·边缘检测·形态学
fantasy_arch5 小时前
深度学习--softmax回归
人工智能·深度学习·回归
Blossom.1185 小时前
量子计算与经典计算的融合与未来
人工智能·深度学习·机器学习·计算机视觉·量子计算
硅谷秋水6 小时前
MoLe-VLA:通过混合层实现的动态跳层视觉-语言-动作模型实现高效机器人操作
人工智能·深度学习·机器学习·计算机视觉·语言模型·机器人
2301_764441336 小时前
基于神经网络的肾脏疾病预测模型
人工智能·深度学习·神经网络