jakegrigsby commited on Apr 8

Commit

c5fc78c

verified ·

1 Parent(s): 85e30c8

Upload folder using huggingface_hub

Browse files

Files changed (22) hide show

medium-rl/ckpts/policy_weights/policy_epoch_0.pt +3 -0
medium-rl/ckpts/policy_weights/policy_epoch_10.pt +3 -0
medium-rl/ckpts/policy_weights/policy_epoch_12.pt +3 -0
medium-rl/ckpts/policy_weights/policy_epoch_14.pt +3 -0
medium-rl/ckpts/policy_weights/policy_epoch_16.pt +3 -0
medium-rl/ckpts/policy_weights/policy_epoch_18.pt +3 -0
medium-rl/ckpts/policy_weights/policy_epoch_2.pt +3 -0
medium-rl/ckpts/policy_weights/policy_epoch_20.pt +3 -0
medium-rl/ckpts/policy_weights/policy_epoch_22.pt +3 -0
medium-rl/ckpts/policy_weights/policy_epoch_24.pt +3 -0
medium-rl/ckpts/policy_weights/policy_epoch_26.pt +3 -0
medium-rl/ckpts/policy_weights/policy_epoch_28.pt +3 -0
medium-rl/ckpts/policy_weights/policy_epoch_30.pt +3 -0
medium-rl/ckpts/policy_weights/policy_epoch_32.pt +3 -0
medium-rl/ckpts/policy_weights/policy_epoch_34.pt +3 -0
medium-rl/ckpts/policy_weights/policy_epoch_36.pt +3 -0
medium-rl/ckpts/policy_weights/policy_epoch_38.pt +3 -0
medium-rl/ckpts/policy_weights/policy_epoch_4.pt +3 -0
medium-rl/ckpts/policy_weights/policy_epoch_40.pt +3 -0
medium-rl/ckpts/policy_weights/policy_epoch_6.pt +3 -0
medium-rl/ckpts/policy_weights/policy_epoch_8.pt +3 -0
medium-rl/config.txt +106 -0

medium-rl/ckpts/policy_weights/policy_epoch_0.pt ADDED Viewed

	@@ -0,0 +1,3 @@

+version https://git-lfs.github.com/spec/v1
+oid sha256:c10072282661fe0c6eec15a27ce403471ccb467e3c34c494ae7c6e750227051c
+size 202329850

medium-rl/ckpts/policy_weights/policy_epoch_10.pt ADDED Viewed

	@@ -0,0 +1,3 @@

+version https://git-lfs.github.com/spec/v1
+oid sha256:a6efcaf32c8f059a24b1d6157cbf499e1f823630e6c888087446fb008018df54
+size 202330106

medium-rl/ckpts/policy_weights/policy_epoch_12.pt ADDED Viewed

	@@ -0,0 +1,3 @@

+version https://git-lfs.github.com/spec/v1
+oid sha256:8b32b9907f3489109b273ec953dce48cdf52010a3bf5331bf7820703c661b683
+size 202330106

medium-rl/ckpts/policy_weights/policy_epoch_14.pt ADDED Viewed

	@@ -0,0 +1,3 @@

+version https://git-lfs.github.com/spec/v1
+oid sha256:99cf3058caabacdf17ba3716685f03c0ed63f422c27732ace022cc50f715f344
+size 202330106

medium-rl/ckpts/policy_weights/policy_epoch_16.pt ADDED Viewed

	@@ -0,0 +1,3 @@

+version https://git-lfs.github.com/spec/v1
+oid sha256:406a61a1d8205f5bae4e6dcd3f3a1ee8fe4145ee04191886410d7e10ab19a979
+size 202330106

medium-rl/ckpts/policy_weights/policy_epoch_18.pt ADDED Viewed

	@@ -0,0 +1,3 @@

+version https://git-lfs.github.com/spec/v1
+oid sha256:8f6a2efa0013e8a2d40067b5dd06ccfd42caa4dc091706cebe47ade24fac8360
+size 202330106

medium-rl/ckpts/policy_weights/policy_epoch_2.pt ADDED Viewed

	@@ -0,0 +1,3 @@

+version https://git-lfs.github.com/spec/v1
+oid sha256:e11d87a4ee340e3bc108ead69a65e1825c65337e98f69dc90bfa173378f20449
+size 202329850

medium-rl/ckpts/policy_weights/policy_epoch_20.pt ADDED Viewed

	@@ -0,0 +1,3 @@

+version https://git-lfs.github.com/spec/v1
+oid sha256:19bc268277278fe2a0e33c7a9c9b430503ff6f493b67c40954e1e92067b63296
+size 202330106

medium-rl/ckpts/policy_weights/policy_epoch_22.pt ADDED Viewed

	@@ -0,0 +1,3 @@

+version https://git-lfs.github.com/spec/v1
+oid sha256:f5798184456573a313309fb2f923956fc25484d4f875100ba9a1c1c7d1ff8c39
+size 202330106

medium-rl/ckpts/policy_weights/policy_epoch_24.pt ADDED Viewed

	@@ -0,0 +1,3 @@

+version https://git-lfs.github.com/spec/v1
+oid sha256:1982103993f6e9f3d3776e2bbd55497df1e538adc1d8de33a63a1622c90b5ab3
+size 202330106

medium-rl/ckpts/policy_weights/policy_epoch_26.pt ADDED Viewed

	@@ -0,0 +1,3 @@

+version https://git-lfs.github.com/spec/v1
+oid sha256:e7e2ce980bd8776e1ee99cc77509b7f18c5465a5c740151fc688a90081c99c0a
+size 202330106

medium-rl/ckpts/policy_weights/policy_epoch_28.pt ADDED Viewed

	@@ -0,0 +1,3 @@

+version https://git-lfs.github.com/spec/v1
+oid sha256:1be98389b8e6c205881b0260d140a4c9fabd9372eb690a4b292d2ae6e4e24b6d
+size 202330106

medium-rl/ckpts/policy_weights/policy_epoch_30.pt ADDED Viewed

	@@ -0,0 +1,3 @@

+version https://git-lfs.github.com/spec/v1
+oid sha256:852467d7beff870f9de9d0f34e2dd291b9d7a29778e9c506e8110d29dd946700
+size 202330106

medium-rl/ckpts/policy_weights/policy_epoch_32.pt ADDED Viewed

	@@ -0,0 +1,3 @@

+version https://git-lfs.github.com/spec/v1
+oid sha256:46af35118f9164f565a442eba505b61140b103e64f9aa20322bf2d4223a025d6
+size 202330106

medium-rl/ckpts/policy_weights/policy_epoch_34.pt ADDED Viewed

	@@ -0,0 +1,3 @@

+version https://git-lfs.github.com/spec/v1
+oid sha256:14a432838c49d335fb3db6415a3b38427be411f4e629c1ced655bc268f9bb233
+size 202330106

medium-rl/ckpts/policy_weights/policy_epoch_36.pt ADDED Viewed

	@@ -0,0 +1,3 @@

+version https://git-lfs.github.com/spec/v1
+oid sha256:495d32ea50962aa3ee251f7232a3fd2f86307490260d479f1a6db2b94babb1ec
+size 202330106

medium-rl/ckpts/policy_weights/policy_epoch_38.pt ADDED Viewed

	@@ -0,0 +1,3 @@

+version https://git-lfs.github.com/spec/v1
+oid sha256:3b6ccb0fcabeb075082454773c483c8b595923683690e39a30ab5ef9f648bbb8
+size 202330106

medium-rl/ckpts/policy_weights/policy_epoch_4.pt ADDED Viewed

	@@ -0,0 +1,3 @@

+version https://git-lfs.github.com/spec/v1
+oid sha256:960e4716b1a07b2083828a0ac3a5d0d51c26782514d8f05917d5358e9a98a2e1
+size 202329850

medium-rl/ckpts/policy_weights/policy_epoch_40.pt ADDED Viewed

	@@ -0,0 +1,3 @@

+version https://git-lfs.github.com/spec/v1
+oid sha256:38d92771a49896787bb08a54133456dc548243132dc17ca4308fb061c1aaae54
+size 202330106

medium-rl/ckpts/policy_weights/policy_epoch_6.pt ADDED Viewed

	@@ -0,0 +1,3 @@

+version https://git-lfs.github.com/spec/v1
+oid sha256:b1a19a1f1ffc6e7188c64d5985ca1b88230dda82e5b4cfa799726022372a227c
+size 202329850

medium-rl/ckpts/policy_weights/policy_epoch_8.pt ADDED Viewed

	@@ -0,0 +1,3 @@

+version https://git-lfs.github.com/spec/v1
+oid sha256:4b78532a0a788b1b4dece44aad3fe636321c7b58222638225516949f494f37f9
+size 202329850

medium-rl/config.txt ADDED Viewed

	@@ -0,0 +1,106 @@

+# Parameters for Actor:
+# ==============================================================================
+Actor.activation = 'leaky_relu'
+Actor.cont_dist_kind = 'normal'
+Actor.d_hidden = 400
+Actor.dropout_p = 0.0
+Actor.gmm_modes = 5
+Actor.log_std_high = 2.0
+Actor.log_std_low = -5.0
+Actor.n_layers = 2
+# Parameters for Agent:
+# ==============================================================================
+Agent.fake_filter = False
+Agent.gamma = 0.999
+Agent.num_critics = 4
+Agent.num_critics_td = 2
+Agent.offline_coeff = 1.0
+Agent.online_coeff = 0.0
+Agent.popart = True
+Agent.reward_multiplier = 10.0
+Agent.tau = 0.003
+Agent.use_multigamma = True
+Agent.use_target_actor = True
+# Parameters for Experiment:
+# ==============================================================================
+Experiment.batches_per_update = 1
+Experiment.critic_loss_weight = 10.0
+Experiment.env_mode = 'async'
+Experiment.force_reset_train_envs_every = None
+Experiment.grad_clip = 1.0
+Experiment.has_replay_buffer_rights = True
+Experiment.l2_coeff = 0.001
+Experiment.learning_rate = 0.0001
+Experiment.local_time_optimizer = False
+Experiment.lr_warmup_steps = 500
+Experiment.mixed_precision = 'no'
+Experiment.padded_sampling = 'none'
+Experiment.save_trajs_as = 'npz'
+Experiment.stagger_traj_file_lengths = True
+Experiment.wandb_group_name = None
+# Parameters for FlashAttention:
+# ==============================================================================
+FlashAttention.window_size = (-1, -1)
+# Parameters for MetamonTstepEncoder:
+# ==============================================================================
+MetamonTstepEncoder.d_model = 100
+MetamonTstepEncoder.extra_emb_dim = 18
+MetamonTstepEncoder.n_heads = 5
+MetamonTstepEncoder.n_layers = 3
+MetamonTstepEncoder.scratch_tokens = 6
+MetamonTstepEncoder.token_mask_aug = False
+# Parameters for Multigammas:
+# ==============================================================================
+Multigammas.continuous = [0.1, 0.9, 0.95, 0.97, 0.99, 0.995]
+Multigammas.discrete = [0.1, 0.9, 0.95, 0.97, 0.99, 0.995]
+# Parameters for MultiModalEmbedding:
+# ==============================================================================
+MultiModalEmbedding.dropout = 0.05
+MultiModalEmbedding.numerical_tokens = 6
+# Parameters for NCritics:
+# ==============================================================================
+NCritics.activation = 'leaky_relu'
+NCritics.d_hidden = 400
+NCritics.dropout_p = 0.0
+NCritics.n_layers = 2
+# Parameters for PopArtLayer:
+# ==============================================================================
+PopArtLayer.beta = 0.0005
+PopArtLayer.init_nu = 100.0
+# Parameters for TformerTrajEncoder:
+# ==============================================================================
+TformerTrajEncoder.activation = 'leaky_relu'
+TformerTrajEncoder.causal = True
+TformerTrajEncoder.d_ff = 3072
+TformerTrajEncoder.d_model = 768
+TformerTrajEncoder.dropout_attn = 0.0
+TformerTrajEncoder.dropout_emb = 0.05
+TformerTrajEncoder.dropout_ff = 0.05
+TformerTrajEncoder.dropout_qkv = 0.0
+TformerTrajEncoder.head_scaling = True
+TformerTrajEncoder.n_heads = 8
+TformerTrajEncoder.n_layers = 6
+TformerTrajEncoder.norm = 'layer'
+TformerTrajEncoder.normformer_norms = True
+TformerTrajEncoder.sigma_reparam = True
+# Parameters for TimestepTransformer:
+# ==============================================================================
+# None.
+# Parameters for TokenEmbedding:
+# ==============================================================================
+# None.
+# Parameters for TransformerTurnEmbedding:
+# ==============================================================================
+TransformerTurnEmbedding.dropout = 0.05