CoolFace
Modelpublic

css919/ppo-SnowballTarget

sourceHugging Faceupdated 4y agoView on Hugging Face
0likes29downloads
configuration.yaml76 linesDownload Raw Back to root
1default_settings: null2behaviors:3  SnowballTarget:4    trainer_type: ppo5    hyperparameters:6      batch_size: 1287      buffer_size: 20488      learning_rate: 0.00039      beta: 0.00510      epsilon: 0.211      lambd: 0.9512      num_epoch: 313      learning_rate_schedule: linear14      beta_schedule: linear15      epsilon_schedule: linear16    network_settings:17      normalize: false18      hidden_units: 25619      num_layers: 220      vis_encode_type: simple21      memory: null22      goal_conditioning_type: hyper23      deterministic: false24    reward_signals:25      extrinsic:26        gamma: 0.9927        strength: 1.028        network_settings:29          normalize: false30          hidden_units: 12831          num_layers: 232          vis_encode_type: simple33          memory: null34          goal_conditioning_type: hyper35          deterministic: false36    init_path: null37    keep_checkpoints: 1038    checkpoint_interval: 5000039    max_steps: 20000040    time_horizon: 6441    summary_freq: 1000042    threaded: true43    self_play: null44    behavioral_cloning: null45env_settings:46  env_path: ./training-envs-executables/linux/SnowballTarget/SnowballTarget47  env_args: null48  base_port: 500549  num_envs: 150  num_areas: 151  seed: -152  max_lifetime_restarts: 1053  restarts_rate_limit_n: 154  restarts_rate_limit_period_s: 6055engine_settings:56  width: 8457  height: 8458  quality_level: 559  time_scale: 2060  target_frame_rate: -161  capture_frame_rate: 6062  no_graphics: true63environment_parameters: null64checkpoint_settings:65  run_id: SnowballTarget166  initialize_from: null67  load_model: false68  resume: false69  force: false70  train_model: false71  inference: false72  results_dir: results73torch_settings:74  device: null75debug: false76