Team Ai
Modelpublic

yDiffraction/Reinforcement-Learning

sourceHugging Faceupdated 2mo agoView on Hugging Face
5likes1downloads
README.md38 linesDownload Raw Back to root
1---2library_name: stable-baselines33tags:4- LunarLander-v35- deep-reinforcement-learning6- reinforcement-learning7- stable-baselines38model-index:9- name: PPO10  results:11  - task:12      type: reinforcement-learning13      name: reinforcement-learning14    dataset:15      name: LunarLander-v316      type: LunarLander-v317    metrics:18    - type: mean_reward19      value: 266.85 +/- 16.1220      name: mean_reward21      verified: false22---23 24# **PPO** Agent playing **LunarLander-v3**25This is a trained model of a **PPO** agent playing **LunarLander-v3**26using the [stable-baselines3 library](https://github.com/DLR-RM/stable-baselines3).27 28## Usage (with Stable-baselines3)29TODO: Add your code30 31 32```python33from stable_baselines3 import ...34from huggingface_sb3 import load_from_hub35 36...37```38