{ "discriminator": { "activation": 0, "hidden_layer_size": 10, "iterations_per_epoch": 100, "learning_rate": 0.001, "n_hidden_layers_element": 4, "n_hidden_layers_global": 1, "weight_decay": 0.0001 }, "experiment": "B", "policy": { "activation": 0, "clip_ratio": 0.2, "hidden_layer_size": 40, "iterations_per_epoch": 100, "learning_rate": 0.0003, "learning_rate_decay": 1.0, "n_hidden_layers": 2 }, "seed": 4, "train_epochs": 100, "trainenv": { "stop_on_collision": false, "use_idm": true }, "value": { "iterations_per_epoch": 1000, "learning_rate": 0.0001, "weight_decay": 0.001 } }