人体姿态估计动作识别系统:MediaPipe+时空Transformer方案
本文给出人体姿态估计动作识别系统:MediaPipe Pose 提取 33 关键点,3 层时空 Transformer 建模,5 类动作准确率 94.67%,参数量 1.20M、推理 4.2ms/帧,可边缘部署,附 AI Agent 与可复用 Skill。
本文给出人体姿态估计动作识别系统:MediaPipe Pose 提取 33 关键点,3 层时空 Transformer 建模,5 类动作准确率 94.67%,参数量 1.20M、推理 4.2ms/帧,可边缘部署,附 AI Agent 与可复用 Skill。