目录
脚本概述
该 Python 脚本处理视频文件,提取基于 COCO 格式的 17 个关键点的 2D 坐标,生成骨架数据,并将其保存为 .npy 文件,同时将对应的标签存储在 JSON 文件中。脚本设计用于批量处理多个视频,使用 YOLOv8-Pose 检测关键点,并为后续动作识别任务(如 ST-GCN 训练)组织数据。
脚本的主要功能包括:
-
加载视频和标签:从指定目录读取视频文件和对应的 JSON 标签文件,包含视频片段信息(起始帧、结束帧和标签)。
-
提取关键点:使用 YOLOv8-Pose 模型检测每帧的 17 个关键点,选择离画面中心最近的人。
-
处理片段:为指定的帧范围提取骨架数据,存储 x 和 y 坐标到四维数组中。
-
保存数据:将骨架数据保存为 .npy 文件,并将标签信息保存到 JSON 文件。
下面我们将逐部分拆解脚本,详细讲解代码、用途和关键点。
订阅专栏 解锁全文
&spm=1001.2101.3001.5002&articleId=149438240&d=1&t=3&u=519ddbfe8bd8497ca7d99a5e095d461f)
6881

被折叠的 条评论
为什么被折叠?



