{ "experiment": "B", "trainenv": { "stop_on_collision": false, "safe_actions_collision_method": null, "abort_unsafe_collision_method": null }, "policy": { "learning_rate": 0.0003, "learning_rate_decay": 1.0, "clip_ratio": 0.2, "iterations_per_epoch": 100, "hidden_layer_size": 20, "n_hidden_layers": 2, "activation": 0, "option": 0 }, "value": { "learning_rate": 0.001, "iterations_per_epoch": 1000 }, "discriminator": { "learning_rate": 0.001, "weight_decay": 0.0001, "iterations_per_epoch": 100, "n_hidden_layers_element": 3, "n_hidden_layers_global": 1, "hidden_layer_size": 10, "activation": 0 }, "train_epochs": 2, "seed": 0 }