datasets
Training and evaluation data, with the modality, task and licence stated up front. Listed live from the Hugging Face Hub.
ViZDoom-Deathmatch-PPO-XLrg
ViZDoom Deathmatch with pretrained PPO agent playing over 15 episodes.
lerobot_new_1This dataset was created using LeRobot.
Dataset Structure
meta/info.json:
{
"codebase_version": "v3.0",
"fps": 30,
"features": {
"action": {
"dtype": "float32",
"shape": [
10
],
"names": [
"shoulder_pan.pos",
"shoulder_lift.pos",
"elbow_flex.pos",
"wrist_flex.pos",
"wrist_roll.pos",
"gripper.pos"… See the full description on the dataset page: https://huggingface.co/datasets/ppooar/lerobot_new_1.ppo-CartPole-v1
Dataset Card for "ppo-CartPole-v1"
More Information needed
lerobot_place_2This dataset was created using LeRobot.
Dataset Structure
meta/info.json:
{
"codebase_version": "v3.0",
"fps": 30,
"features": {
"action": {
"dtype": "float32",
"shape": [
10
],
"names": [
"shoulder_pan.pos",
"shoulder_lift.pos",
"elbow_flex.pos",
"wrist_flex.pos",
"wrist_roll.pos",
"gripper.pos"… See the full description on the dataset page: https://huggingface.co/datasets/ppooar/lerobot_place_2.ppo-Pendulum-v1
Dataset Card for "ppo-Pendulum-v1"
More Information needed
lerobot_arm_4This dataset was created using LeRobot.
Dataset Structure
meta/info.json:
{
"codebase_version": "v3.0",
"fps": 30,
"features": {
"action": {
"dtype": "float32",
"shape": [
10
],
"names": [
"shoulder_pan.pos",
"shoulder_lift.pos",
"elbow_flex.pos",
"wrist_flex.pos",
"wrist_roll.pos",
"gripper.pos"… See the full description on the dataset page: https://huggingface.co/datasets/ppooar/lerobot_arm_4.ppo-seals-CartPole-v0
Dataset Card for "ppo-seals-CartPole-v0"
More Information needed
lerobot_place_1This dataset was created using LeRobot.
Dataset Structure
meta/info.json:
{
"codebase_version": "v3.0",
"fps": 30,
"features": {
"action": {
"dtype": "float32",
"shape": [
10
],
"names": [
"shoulder_pan.pos",
"shoulder_lift.pos",
"elbow_flex.pos",
"wrist_flex.pos",
"wrist_roll.pos",
"gripper.pos"… See the full description on the dataset page: https://huggingface.co/datasets/ppooar/lerobot_place_1.lerobot_arm_3This dataset was created using LeRobot.
Dataset Structure
meta/info.json:
{
"codebase_version": "v3.0",
"fps": 30,
"features": {
"action": {
"dtype": "float32",
"shape": [
10
],
"names": [
"shoulder_pan.pos",
"shoulder_lift.pos",
"elbow_flex.pos",
"wrist_flex.pos",
"wrist_roll.pos",
"gripper.pos"… See the full description on the dataset page: https://huggingface.co/datasets/ppooar/lerobot_arm_3.eval_ep1000_seedNone_default_10000_ppo_circle_smallThis dataset was created using LeRobot.
Dataset Structure
meta/info.json:
{
"codebase_version": "v2.1",
"robot_type": "racecar",
"total_episodes": 20,
"total_frames": 5032,
"total_tasks": 1,
"total_videos": 20,
"total_chunks": 1,
"chunks_size": 1000,
"fps": 30,
"splits": {
"train": "0:20"
},
"data_path": "data/chunk-{episode_chunk:03d}/episode_{episode_index:06d}.parquet",
"video_path":… See the full description on the dataset page: https://huggingface.co/datasets/Lyrasilas/eval_ep1000_seedNone_default_10000_ppo_circle_small.lerobot_arm_2This dataset was created using LeRobot.
Dataset Structure
meta/info.json:
{
"codebase_version": "v3.0",
"fps": 30,
"features": {
"action": {
"dtype": "float32",
"shape": [
10
],
"names": [
"shoulder_pan.pos",
"shoulder_lift.pos",
"elbow_flex.pos",
"wrist_flex.pos",
"wrist_roll.pos",
"gripper.pos"… See the full description on the dataset page: https://huggingface.co/datasets/ppooar/lerobot_arm_2.wiki-lingua-ppovizdoom-ppo-dataseteval_ep1000_seedNone_circle_big_10000_ppo_circle_bigThis dataset was created using LeRobot.
Dataset Structure
meta/info.json:
{
"codebase_version": "v2.1",
"robot_type": "racecar",
"total_episodes": 20,
"total_frames": 8597,
"total_tasks": 1,
"total_videos": 20,
"total_chunks": 1,
"chunks_size": 1000,
"fps": 30,
"splits": {
"train": "0:20"
},
"data_path": "data/chunk-{episode_chunk:03d}/episode_{episode_index:06d}.parquet",
"video_path":… See the full description on the dataset page: https://huggingface.co/datasets/Lyrasilas/eval_ep1000_seedNone_circle_big_10000_ppo_circle_big.ppo_dataset
Dataset Card for "ppo_dataset"
More Information needed
cpcdata_ppoeval_ep100_seedNone_circle_big_car_less_zoom_10000_ppo_circle_bigThis dataset was created using LeRobot.
Dataset Structure
meta/info.json:
{
"codebase_version": "v2.1",
"robot_type": "racecar",
"total_episodes": 20,
"total_frames": 19667,
"total_tasks": 1,
"total_videos": 20,
"total_chunks": 1,
"chunks_size": 1000,
"fps": 30,
"splits": {
"train": "0:20"
},
"data_path": "data/chunk-{episode_chunk:03d}/episode_{episode_index:06d}.parquet",
"video_path":… See the full description on the dataset page: https://huggingface.co/datasets/Lyrasilas/eval_ep100_seedNone_circle_big_car_less_zoom_10000_ppo_circle_big.eval_data_hh_sft_dpo_ppoblock-q-sharp_ds-distilled-qwen-1.5b-ppo-kl-1e-4-ec-0.001-good-1_aime-24-with-labels-prmeval_ep1000_seedNone_default_car_less_zoom_20000_ppo_defaultThis dataset was created using LeRobot.
Dataset Structure
meta/info.json:
{
"codebase_version": "v2.1",
"robot_type": "racecar",
"total_episodes": 20,
"total_frames": 18015,
"total_tasks": 1,
"total_videos": 20,
"total_chunks": 1,
"chunks_size": 1000,
"fps": 30,
"splits": {
"train": "0:20"
},
"data_path": "data/chunk-{episode_chunk:03d}/episode_{episode_index:06d}.parquet",
"video_path":… See the full description on the dataset page: https://huggingface.co/datasets/Lyrasilas/eval_ep1000_seedNone_default_car_less_zoom_20000_ppo_default.eval_ep1000_seedNone_default_car_less_zoom_10000_ppo_circle_bigThis dataset was created using LeRobot.
Dataset Structure
meta/info.json:
{
"codebase_version": "v2.1",
"robot_type": "racecar",
"total_episodes": 20,
"total_frames": 16422,
"total_tasks": 1,
"total_videos": 20,
"total_chunks": 1,
"chunks_size": 1000,
"fps": 30,
"splits": {
"train": "0:20"
},
"data_path": "data/chunk-{episode_chunk:03d}/episode_{episode_index:06d}.parquet",
"video_path":… See the full description on the dataset page: https://huggingface.co/datasets/Lyrasilas/eval_ep1000_seedNone_default_car_less_zoom_10000_ppo_circle_big.6B_hh_sft_ppo_comparisonppo_ppl_thinkfinal_stage10
PPO Stage-10 Curriculum Dataset
本仓库提供基于 Atomheart-Father/ppo_pool_24000_ppl10_sys10_thinkfinal_toklen 的分阶段 PPO/DPO 训练数据。源数据来自 OpenR1 子集与 OT-114k 数学子集,保持 <think>...</think><final>...</final> 的答案格式,并用 query-only PPL 做难度分桶。
数据切分
stage0 … stage9:共 10 个训练阶段。每阶段目标 2000 条(脚本参数 STAGE_SIZE=2000,FIXED_RATIO=0.8),约 80% 来自同难度分桶(stage_role=fixed),20% 为其他难度的混合样本(stage_role=random)。
eval:从剩余样本中采样(脚本参数 EVAL_SIZE=500),stage_role=eval。
test:剩余部分,stage_role=test。
stage_id:0–9 对应阶段,-1 表示… See the full description on the dataset page: https://huggingface.co/datasets/Atomheart-Father/ppo_ppl_thinkfinal_stage10.eval_ep50_seed1_circle_small_car_less_zoom_30000_ppo_circle_bigThis dataset was created using LeRobot.
Dataset Structure
meta/info.json:
{
"codebase_version": "v2.1",
"robot_type": "racecar",
"total_episodes": 20,
"total_frames": 20000,
"total_tasks": 1,
"total_videos": 20,
"total_chunks": 1,
"chunks_size": 1000,
"fps": 30,
"splits": {
"train": "0:20"
},
"data_path": "data/chunk-{episode_chunk:03d}/episode_{episode_index:06d}.parquet",
"video_path":… See the full description on the dataset page: https://huggingface.co/datasets/Lyrasilas/eval_ep50_seed1_circle_small_car_less_zoom_30000_ppo_circle_big.eval_ep500_seed1_default_car_less_zoom_40000_ppo_circle_bigThis dataset was created using LeRobot.
Dataset Structure
meta/info.json:
{
"codebase_version": "v2.1",
"robot_type": "racecar",
"total_episodes": 20,
"total_frames": 6313,
"total_tasks": 1,
"total_videos": 20,
"total_chunks": 1,
"chunks_size": 1000,
"fps": 30,
"splits": {
"train": "0:20"
},
"data_path": "data/chunk-{episode_chunk:03d}/episode_{episode_index:06d}.parquet",
"video_path":… See the full description on the dataset page: https://huggingface.co/datasets/Lyrasilas/eval_ep500_seed1_default_car_less_zoom_40000_ppo_circle_big.openai_summarize_tldr_human_eval_ppo_result
Dataset Card for "openai_summarize_tldr_human_eval_ppo_result"
More Information needed
tldr-pponumia_prompt_ppoNES-SuperMarioBros_Level1-1_gray84-hudcrop-stack4-simple_ppo
SuperMarioBros-Nes-v0 Gameplay Dataset
Gameplay recordings (collected by: hf://tsilva/NES-SuperMarioBros_Level1-1_gray84-hudcrop-stack4-simple_ppo@c5de7c1623a05c7bc30cbafa97277975496ec639) from the Gymnasium environment SuperMarioBros-Nes-v0,
captured using gymrec.
Start here
This is one historical gymrec gameplay recording for SuperMarioBros-Nes-v0, not GradLab Checkpoint Monitoring or Acceptance evidence. The recording includes its own immutable collector… See the full description on the dataset page: https://huggingface.co/datasets/tsilva/NES-SuperMarioBros_Level1-1_gray84-hudcrop-stack4-simple_ppo.eval_ep500_seed1_circle_small_10000_ppo_circle_smallThis dataset was created using LeRobot.
Dataset Structure
meta/info.json:
{
"codebase_version": "v2.1",
"robot_type": "racecar",
"total_episodes": 20,
"total_frames": 8831,
"total_tasks": 1,
"total_videos": 20,
"total_chunks": 1,
"chunks_size": 1000,
"fps": 30,
"splits": {
"train": "0:20"
},
"data_path": "data/chunk-{episode_chunk:03d}/episode_{episode_index:06d}.parquet",
"video_path":… See the full description on the dataset page: https://huggingface.co/datasets/Lyrasilas/eval_ep500_seed1_circle_small_10000_ppo_circle_small.
