| --- |
| tags: |
| - Pixelcopter-PLE-v0 |
| - reinforce |
| - reinforcement-learning |
| - custom-implementation |
| - deep-rl-class |
| model-index: |
| - name: Pixelcopter2 |
| results: |
| - task: |
| type: reinforcement-learning |
| name: reinforcement-learning |
| dataset: |
| name: Pixelcopter-PLE-v0 |
| type: Pixelcopter-PLE-v0 |
| metrics: |
| - type: mean_reward |
| value: 83.00 +/- 54.60 |
| name: mean_reward |
| verified: false |
| --- |
| |
| # **Reinforce** Agent playing **Pixelcopter-PLE-v0** |
| This is a trained model of a **Reinforce** agent playing **Pixelcopter-PLE-v0** . |
|
|
| This model didn't complete training but was still far better than the first one trained with fewer timesteps. |