zhouxzh/portable-hagridv2-mediapipe-hand
portable_hagridv2_mediapipe_hand 这是一个从 HaGRIDv2 派生出来的便携版 MediaPipe Hand 测试数据集,用于 palm detection 和 hand landmark 验证。 它是更大的 hagridv2_512px_mediapipe_hand 生成数据集的过滤子集,体量更小,方便随 ONNX / Ascend 310B 运行时验证工程一起迁移。 数据集包含两类 MediaPipe 风格的目标: palm_detection:单一 palm 类,包含 palm_bbox_xyxy 和 palm7_keypoints hand_landmark:同一只手的 full21_keypoints 数据集也保留了原始 HaGRIDv2 手势标签,作为辅助来源标签。这个手势标签不是 palm detector 的类别。 数据集概览 图片总数:9754 数据划分:train、valid、test 划分数量:train=7246,valid=845,test=1663… See the full description on the dataset page: https://huggingface.co/datasets/zhouxzh/portable-hagridv2-mediapipe-hand.
portablehagridv2mediapipe_hand
这是一个从 HaGRIDv2 派生出来的便携版 MediaPipe Hand 测试数据集,用于 palm detection 和 hand landmark 验证。 它是更大的 hagridv2_512px_mediapipe_hand 生成数据集的过滤子集,体量更小,方便随 ONNX / Ascend 310B 运行时验证工程一起迁移。
数据集包含两类 MediaPipe 风格的目标:
palm_detection:单一palm类,包含palm_bbox_xyxy和palm7_keypointshand_landmark:同一只手的full21_keypoints
数据集也保留了原始 HaGRIDv2 手势标签,作为辅助来源标签。这个手势标签不是 palm detector 的类别。
数据集概览
- 图片总数:
9754 - 数据划分:
train、valid、test - 划分数量:
train=7246,valid=845,test=1663 - 源数据集:HaGRIDv2 512px
- 生成流程:MediaPipe
0.10.14legacy hand graph - 质量过滤:一张图中每只手的
full21_l2 <= 0.001 - 存储格式:Parquet,图片以内嵌 JPEG bytes 的形式保存在 Hugging Face
Image列中 - 旁路图片文件:不包含
文件结构
train-00000.parquet
train-00001.parquet
valid-00000.parquet
test-00000.parquet
dataset.json
keypoints.json
summary.json字段说明
image:内嵌 JPEG 图片,类型为 Hugging Facedatasets.Imagefile_name:逻辑相对图片路径split、source_split、source_gesture、gesture_label、gesture_id、image_idsource_image:原始 HaGRIDv2 512px 布局中的相对路径width、height:导出图片尺寸hagridv2_labels:JSON 字符串,保存该图片的原始 HaGRIDv2 labelshagridv2_original:JSON 字符串,保存原始 HaGRIDv2 标注字段instances:JSON 字符串,保存每只手的 HaGRIDv2 与 MediaPipe 标注quality_filter:JSON 字符串,描述导出时使用的质量阈值
读取 JSON 字符串字段时可以使用 json.loads(row["instances"])。
单个手实例的目标
每个 hand instance 包含:
palm_bbox_xyxy:归一化[xmin, ymin, xmax, ymax]palm_bbox_cxcywh:归一化[center_x, center_y, width, height]palm7_keypoints:7 个 palm keypointsfull21_keypoints:21 个 hand landmarksmediapipe.palm_bbox_xyxy和mediapipe.palm7_keypoints:由 MediaPipepalm_detections生成的目标mediapipe.full21_keypoints:由 MediaPipemulti_hand_landmarks生成的目标hagridv2.*:保留的原始 HaGRIDv2 标注,用于对比和复现
所有坐标都使用导出图片坐标系下的归一化坐标。
读取示例
from datasets import load_dataset
ds = load_dataset("zhouxzh/portable-hagridv2-mediapipe-hand")
print(ds)
print(ds["train"][0]["image"])如果需要手动按 Parquet 读取:
from datasets import load_dataset
ds = load_dataset(
"parquet",
data_files={
"train": "train-*.parquet",
"valid": "valid-*.parquet",
"test": "test-*.parquet",
},
)许可证
本数据集派生自 HaGRIDv2,并遵循原始 HaGRIDv2 的 public license with attribution and conditions reserved。 HaGRIDv2 的许可证文本是基于 Creative Commons Attribution-ShareAlike 4.0 改写的,但它本身不是 Creative Commons 许可证。
使用者应引用原始 HaGRIDv2 数据集,并遵守其许可证条款:
- HaGRID 仓库:https://github.com/hukenovs/hagrid
- HaGRID 许可证 PDF:https://github.com/hukenovs/hagrid/blob/master/license/en_us.pdf
说明
- 这不是完整的 HaGRIDv2 MediaPipe Hand 生成数据集。
- 本数据集只包含通过更严格 portable 质量过滤的样本。
- HaGRIDv2 的
user_id和 demographicmeta字段没有复制到生成后的数据集元数据中。 - 本地的
visual_check_100/目录只是可视化质检产物,没有上传到 Hugging Face Hub 数据集。
