css919/ppo-SnowballTarget
029
1default_settings: null2behaviors:3 SnowballTarget:4 trainer_type: ppo5 hyperparameters:6 batch_size: 1287 buffer_size: 20488 learning_rate: 0.00039 beta: 0.00510 epsilon: 0.211 lambd: 0.9512 num_epoch: 313 learning_rate_schedule: linear14 beta_schedule: linear15 epsilon_schedule: linear16 network_settings:17 normalize: false18 hidden_units: 25619 num_layers: 220 vis_encode_type: simple21 memory: null22 goal_conditioning_type: hyper23 deterministic: false24 reward_signals:25 extrinsic:26 gamma: 0.9927 strength: 1.028 network_settings:29 normalize: false30 hidden_units: 12831 num_layers: 232 vis_encode_type: simple33 memory: null34 goal_conditioning_type: hyper35 deterministic: false36 init_path: null37 keep_checkpoints: 1038 checkpoint_interval: 5000039 max_steps: 20000040 time_horizon: 6441 summary_freq: 1000042 threaded: true43 self_play: null44 behavioral_cloning: null45env_settings:46 env_path: ./training-envs-executables/linux/SnowballTarget/SnowballTarget47 env_args: null48 base_port: 500549 num_envs: 150 num_areas: 151 seed: -152 max_lifetime_restarts: 1053 restarts_rate_limit_n: 154 restarts_rate_limit_period_s: 6055engine_settings:56 width: 8457 height: 8458 quality_level: 559 time_scale: 2060 target_frame_rate: -161 capture_frame_rate: 6062 no_graphics: true63environment_parameters: null64checkpoint_settings:65 run_id: SnowballTarget166 initialize_from: null67 load_model: false68 resume: false69 force: false70 train_model: false71 inference: false72 results_dir: results73torch_settings:74 device: null75debug: false76 