committing learned policies and summary files

This commit is contained in:
Arec Jamgochian
2022-08-29 01:30:11 -07:00
parent 779a0ea89f
commit 3aaf252dbe
68 changed files with 124 additions and 120 deletions

View File

@@ -1,31 +1,32 @@
{ {
"experiment": "A", "discriminator": {
"trainenv": { "activation": 0,
"stop_on_collision": false "hidden_layer_size": 10,
}, "iterations_per_epoch": 100,
"policy": { "learning_rate": 0.001,
"learning_rate": 0.0003, "n_hidden_layers_element": 4,
"learning_rate_decay": 1.0, "n_hidden_layers_global": 1,
"clip_ratio": 0.2, "weight_decay": 0.0001
"iterations_per_epoch": 100, },
"hidden_layer_size": 40, "experiment": "A",
"n_hidden_layers": 2, "policy": {
"activation": 0 "activation": 0,
}, "clip_ratio": 0.2,
"value": { "hidden_layer_size": 40,
"learning_rate": 0.0001, "iterations_per_epoch": 100,
"weight_decay": 0.001, "learning_rate": 0.0003,
"iterations_per_epoch": 1000 "learning_rate_decay": 1.0,
}, "n_hidden_layers": 2
"discriminator": { },
"learning_rate": 0.001, "seed": 5,
"weight_decay": 0.0001, "train_epochs": 100,
"iterations_per_epoch": 100, "trainenv": {
"n_hidden_layers_element": 4, "stop_on_collision": false,
"n_hidden_layers_global": 1, "use_idm": true
"hidden_layer_size": 10, },
"activation": 0 "value": {
}, "iterations_per_epoch": 1000,
"train_epochs": 100, "learning_rate": 0.0001,
"seed": 0 "weight_decay": 0.001
}
} }

View File

@@ -1,31 +1,32 @@
{ {
"experiment": "B", "discriminator": {
"trainenv": { "activation": 0,
"stop_on_collision": false "hidden_layer_size": 10,
}, "iterations_per_epoch": 100,
"policy": { "learning_rate": 0.001,
"learning_rate": 0.0003, "n_hidden_layers_element": 4,
"learning_rate_decay": 1.0, "n_hidden_layers_global": 1,
"clip_ratio": 0.2, "weight_decay": 0.0001
"iterations_per_epoch": 100, },
"hidden_layer_size": 40, "experiment": "B",
"n_hidden_layers": 2, "policy": {
"activation": 0 "activation": 0,
}, "clip_ratio": 0.2,
"value": { "hidden_layer_size": 40,
"learning_rate": 0.0001, "iterations_per_epoch": 100,
"weight_decay": 0.001, "learning_rate": 0.0003,
"iterations_per_epoch": 1000 "learning_rate_decay": 1.0,
}, "n_hidden_layers": 2
"discriminator": { },
"learning_rate": 0.001, "seed": 4,
"weight_decay": 0.0001, "train_epochs": 100,
"iterations_per_epoch": 100, "trainenv": {
"n_hidden_layers_element": 4, "stop_on_collision": false,
"n_hidden_layers_global": 1, "use_idm": true
"hidden_layer_size": 10, },
"activation": 0 "value": {
}, "iterations_per_epoch": 1000,
"train_epochs": 100, "learning_rate": 0.0001,
"seed": 0 "weight_decay": 0.001
}
} }

View File

@@ -1,33 +1,34 @@
{ {
"experiment": "A", "discriminator": {
"trainenv": { "activation": 0,
"stop_on_collision": false, "hidden_layer_size": 10,
"safe_actions_collision_method": "circle", "iterations_per_epoch": 100,
"abort_unsafe_collision_method": "circle" "learning_rate": 0.001,
}, "n_hidden_layers_element": 4,
"policy": { "n_hidden_layers_global": 1,
"learning_rate": 0.0003, "weight_decay": 0.0001
"learning_rate_decay": 1.0, },
"clip_ratio": 0.2, "experiment": "A",
"iterations_per_epoch": 100, "policy": {
"hidden_layer_size": 40, "activation": 0,
"n_hidden_layers": 2, "clip_ratio": 0.2,
"activation": 0, "hidden_layer_size": 40,
"option": 0 "iterations_per_epoch": 100,
}, "learning_rate": 0.0003,
"value": { "learning_rate_decay": 1.0,
"learning_rate": 0.001, "n_hidden_layers": 2,
"iterations_per_epoch": 1000 "option": 0
}, },
"discriminator": { "seed": 3,
"learning_rate": 0.001, "train_epochs": 90,
"weight_decay": 0.0001, "trainenv": {
"iterations_per_epoch": 100, "abort_unsafe_collision_method": "circle",
"n_hidden_layers_element": 4, "safe_actions_collision_method": "circle",
"n_hidden_layers_global": 1, "stop_on_collision": false,
"hidden_layer_size": 10, "use_idm": true
"activation": 0 },
}, "value": {
"train_epochs": 90, "iterations_per_epoch": 1000,
"seed": 0 "learning_rate": 0.001
}
} }

View File

@@ -1,33 +1,34 @@
{ {
"experiment": "B", "discriminator": {
"trainenv": { "activation": 0,
"stop_on_collision": false, "hidden_layer_size": 10,
"safe_actions_collision_method": "circle", "iterations_per_epoch": 100,
"abort_unsafe_collision_method": "circle" "learning_rate": 0.001,
}, "n_hidden_layers_element": 4,
"policy": { "n_hidden_layers_global": 2,
"learning_rate": 0.0003, "weight_decay": 0.0001
"learning_rate_decay": 1.0, },
"clip_ratio": 0.2, "experiment": "B",
"iterations_per_epoch": 100, "policy": {
"hidden_layer_size": 20, "activation": 0,
"n_hidden_layers": 2, "clip_ratio": 0.2,
"activation": 0, "hidden_layer_size": 20,
"option": 0 "iterations_per_epoch": 100,
}, "learning_rate": 0.0003,
"value": { "learning_rate_decay": 1.0,
"learning_rate": 0.001, "n_hidden_layers": 2,
"iterations_per_epoch": 1000 "option": 0
}, },
"discriminator": { "seed": 3,
"learning_rate": 0.001, "train_epochs": 85,
"weight_decay": 0.0001, "trainenv": {
"iterations_per_epoch": 100, "abort_unsafe_collision_method": "circle",
"n_hidden_layers_element": 4, "safe_actions_collision_method": "circle",
"n_hidden_layers_global": 2, "stop_on_collision": false,
"hidden_layer_size": 10, "use_idm": true
"activation": 0 },
}, "value": {
"train_epochs": 85, "iterations_per_epoch": 1000,
"seed": 0 "learning_rate": 0.001
}
} }