Team Ai
Modelpublic

LalithKumarRaju/MLAgents-Pyramids

sourceHugging Faceupdated 11d agoView on Hugging Face
0likes52downloads
Model Card

PPO Agent playing ML-Agents-Pyramids

This model was trained as part of the ๐Ÿค— Hugging Face Deep Reinforcement Learning Course by Lalith Kumar Raju (LalithKumarRaju).

Evaluation Results

  • โ€”Environment: ML-Agents-Pyramids
  • โ€”Mean Reward: 1.80 +/- 0.20
  • โ€”Baseline Requirement: $\ge -100$

Description

This repository contains the trained weights, configuration files, and evaluation metadata for Unit 5 P2.