File size: 700 Bytes
46be305
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
2
3
4
5
6
7
8
9
10
11
12
13
14
15
16
17
18
19
20
21
22
23
24
25
26
27
28
29
30
31
32
---
tags:
- PandaReachDense
- PandaReachDense-v3
- panda-gym
- deep-rl-course
- a2c
- reinforcement-learning
- stable-baselines3
library_name: stable-baselines3
pipeline_tag: reinforcement-learning
model-index:
- name: a2c-PandaReachDense
  results:
  - task:
      name: reinforcement-learning
      type: reinforcement-learning
    dataset:
      name: PandaReachDense
      type: PandaReachDense
    metrics:
    - name: mean_reward
      type: mean_reward
      value: -0.45 +/- 0.12
---

# A2C Agent playing PandaReachDense
This is a trained model of an A2C agent playing PandaReachDense using stable-baselines3 and panda-gym.

- **Mean Reward**: -0.45 +/- 0.12
- **Result (mean - std)**: -0.57