a2c-PandaReachDense / README.md
Learnix-AI-Lab's picture
Upload README.md with huggingface_hub
46be305 verified
|
Raw History Blame Contribute Delete
700 Bytes
metadata
tags:
  - PandaReachDense
  - PandaReachDense-v3
  - panda-gym
  - deep-rl-course
  - a2c
  - reinforcement-learning
  - stable-baselines3
library_name: stable-baselines3
pipeline_tag: reinforcement-learning
model-index:
  - name: a2c-PandaReachDense
    results:
      - task:
          name: reinforcement-learning
          type: reinforcement-learning
        dataset:
          name: PandaReachDense
          type: PandaReachDense
        metrics:
          - name: mean_reward
            type: mean_reward
            value: '-0.45 +/- 0.12'

A2C Agent playing PandaReachDense

This is a trained model of an A2C agent playing PandaReachDense using stable-baselines3 and panda-gym.

  • Mean Reward: -0.45 +/- 0.12
  • Result (mean - std): -0.57