Team Ai
Modelpublic

envsetup-rl-dl4c/shellcheck-reward-checkpoint

sourceHugging Faceapache-2.0updated 1y agoView on Hugging Face
0likes22downloads
Model Card

Reinforcement Fine-Tuned Qwen3-8B

This model is fine-tuned on the Qwen3-8B model using reinforcement learning for environment setup task. It's trained on zeroshot prompts from the EnvBench dataset.