CVPR2023新作:3D人体姿态估计

  1. Title: 3D Human Pose Estimation via Intuitive Physics

  2. Affiliation: Max Planck Institute for Intelligent Systems, Tübingen, Germany

  3. Authors: Shashank Tripathi, Lea Müller, Chun-Hao P. Huang, Omid Taheri, Michael J. Black, Dimitrios Tzionas

  4. Keywords: 3D human pose estimation, physics engine, intuitive-physics terms, pressure heatmap, stable configuration.

  5. Summary:

  • (1): 本文的研究背景是3D人体姿态的估计。

  • (2): 过去的方法忽略了人体与场景的交互,导致估计到的结果往往不够精准、不符合物理规律。本文提出了IPMAN,这一方法具有可解释性、易于实现、计算速度快、可由基于优化和回归的现有方法轻松调用等特点。

  • (3): 本文提出了一种直观物理学(IP)的思想,从3D SMPL Body与场景的交互中推断出身体上的压力热图、压力中心和SMPL Body的重心。并且根据这些信息,用IPMAN估计出色彩图像中的3D人体姿态,从而实现姿态在物理上的"稳定"。 本文的方法是通过于SMPL Body的物理学、以及把压力热图、压力中心、SMPL Body的重心考虑进去,这一具有鲜明特色的方法实现的。

  • (4): 本文在多个数据集上验证了IPMAN的性能,结果显示IPMAN的表现优于目前最先进的方法,并且在提高静态姿势准确率的同时也不会损害动态姿势的准确性。文章提供了IPMAN源代码和数据,同时发表在了CVPR会议上。

  1. Methods:
  • (1): 本文提出的方法是利用直观物理学(IP)的思想,从3D SMPL Body与场景的交互中推断出身体上的压力热图、压力中心和SMPL Body的重心。通过与SMPL Body的物理学、以及考虑压力热图、压力中心、SMPL Body的重心,得出一个具有鲜明特色的3D人体姿态估计方法IPMAN。

  • (2): 在IPMAN中,压力热图用于表示3D SMPL Body与场景之间的接触,压力中心表示场景施加的力影响着身体的哪些部位,而SMPL Body的重心(通过计算所有顶点的加权平均)有助于保持姿势的稳定性。

  • (3): IPMAN方法在预测3D人体姿态时,先利用现有的2D关键点检测器检测得到2D关键点,并根据这些关键点构建输入坐标图,这个输入坐标图可以被用于预测3D人体姿态。根据陆续输入的样本,模型可以自适应地学习更好的姿态估计。

  • (4): 为了证明IPMAN的优越性,本文的作者在几个数据集上进行了实验,结果显示IPMAN比现有方法更好地估计了3D人体姿态。注意到我们的方法不仅提高了静态姿势估计的准确性,而且在动态情况下同样有效。

  1. Conclusion:
  • (1): 本文提出了一种利用直观物理学来估计3D人体姿态的方法,能够更好地推断出身体的稳定姿态,提高静态姿态准确率的同时不会影响动态姿态的准确性。这项工作对于人体活动分析、运动医学和虚拟现实等领域具有重要意义。

  • (2): 创新点:本文利用直观物理学的思想,设计了一种新的3D人体姿态估计方法,通过压力热图、压力中心和SMPL Body的重心来推断身体的稳定姿态;

性能:本文的实验结果表明所提出的IPMAN方法在多个数据集上比现有方法表现更优,不仅提高了姿态准确性,还保持了计算速度快的特点;

工作量:文章提供了IPMAN方法的源代码和数据集,可以方便地应用于现有的优化和回归方法,具有易于实现的特点。

相关推荐
AI极客菌2 小时前
Controlnet作者新作IC-light V2:基于FLUX训练,支持处理风格化图像,细节远高于SD1.5。
人工智能·计算机视觉·ai作画·stable diffusion·aigc·flux·人工智能作画
阿_旭2 小时前
一文读懂| 自注意力与交叉注意力机制在计算机视觉中作用与基本原理
人工智能·深度学习·计算机视觉·cross-attention·self-attention
王哈哈^_^2 小时前
【数据集】【YOLO】【目标检测】交通事故识别数据集 8939 张,YOLO道路事故目标检测实战训练教程!
前端·人工智能·深度学习·yolo·目标检测·计算机视觉·pyqt
Power20246663 小时前
NLP论文速读|LongReward:基于AI反馈来提升长上下文大语言模型
人工智能·深度学习·机器学习·自然语言处理·nlp
YRr YRr3 小时前
深度学习:循环神经网络(RNN)详解
人工智能·rnn·深度学习
sp_fyf_20244 小时前
计算机前沿技术-人工智能算法-大语言模型-最新研究进展-2024-11-01
人工智能·深度学习·神经网络·算法·机器学习·语言模型·数据挖掘
红客5974 小时前
Transformer和BERT的区别
深度学习·bert·transformer
多吃轻食4 小时前
大模型微调技术 --> 脉络
人工智能·深度学习·神经网络·自然语言处理·embedding
charles_vaez4 小时前
开源模型应用落地-glm模型小试-glm-4-9b-chat-快速体验(一)
深度学习·语言模型·自然语言处理
YRr YRr4 小时前
深度学习:Transformer Decoder详解
人工智能·深度学习·transformer