Hugging Face
Models
Datasets
Spaces
Buckets
new
Docs
Enterprise
Pricing
Website
Tasks
HuggingChat
Collections
Languages
Organizations
Community
Blog
Posts
Daily Papers
Hardware
Learn
Discord
Forum
GitHub
Solutions
Team & Enterprise
Hugging Face PRO
Enterprise Support
Inference Providers
Inference Endpoints
Storage Buckets
Log In
Sign Up
pre63
/
entropy-trpo-weights
Like
1
Reinforcement Learning
entropy-trpo
trpo
policy-optimization
mujoco
cartpole
arxiv:
2110.13373
License:
mit
Model card
Files
Files and versions
xet
Community
Copy to bucket
new
main
entropy-trpo-weights
113 MB
Ctrl+K
Ctrl+K
1 contributor
History:
16352 commits
pre63
Update model card and training summary
ea67f99
verified
3 months ago
CartPole-v1
CartPole-v1/trpo/seed_2/latest checkpoint epoch 1953
3 months ago
Humanoid-v5
Humanoid-v5/ppo/seed_2/latest checkpoint epoch 1953
3 months ago
HumanoidStandup-v5
HumanoidStandup-v5/ppo/seed_1/latest checkpoint epoch 1953
3 months ago
benchmark_e3_1_3m
benchmark_e3_1_3m/CartPole-v1/trpo/seed_8/latest checkpoint epoch 3240
3 months ago
benchmark_e3_1m
benchmark_e3_1m/CartPole-v1/constant_erc_trpo/seed_2/latest checkpoint epoch 2000
3 months ago
benchmark_e3_3_xu_repro
benchmark_e3_3_xu_repro/CartPole-v1/erc_trpo/latest checkpoint epoch 6000
3 months ago
benchmark_e3_3m
benchmark_e3_3m/CartPole-v1/erc_trpo/seed_0/latest checkpoint epoch 1350
3 months ago
benchmark_e3_4_env
benchmark_e3_4_env/CartPole-v1/erc_trpo/latest checkpoint epoch 6000
3 months ago
benchmark_e4_cartpole
benchmark_e4_cartpole/CartPole-v1/random_ero_trpo/seed_2/latest checkpoint epoch 100
3 months ago
benchmark_e5_xu_elim
benchmark_e5_xu_elim/CartPole-v1/erc_trpo/seed_0/latest checkpoint epoch 4700
3 months ago
results
Update model card and training summary
3 months ago
.gitattributes
Safe
1.52 kB
initial commit
4 months ago
README.md
14.6 kB
Update model card and training summary
3 months ago