mohan1201/gemma-code-explainer
07
1---2library_name: peft3license: gemma4base_model: google/gemma-2b-it5tags:6- base_model:adapter:google/gemma-2b-it7- lora8- transformers9pipeline_tag: text-generation10model-index:11- name: gemma-code-explainer12 results: []13---14 15<!-- This model card has been generated automatically according to the information the Trainer had access to. You16should probably proofread and complete it, then remove this comment. -->17 18# gemma-code-explainer19 20This model is a fine-tuned version of [google/gemma-2b-it](https://huggingface.co/google/gemma-2b-it) on an unknown dataset.21 22## Model description23 24More information needed25 26## Intended uses & limitations27 28More information needed29 30## Training and evaluation data31 32More information needed33 34## Training procedure35 36### Training hyperparameters37 38The following hyperparameters were used during training:39- learning_rate: 0.000240- train_batch_size: 441- eval_batch_size: 1642- seed: 4243- gradient_accumulation_steps: 444- total_train_batch_size: 1645- optimizer: Use OptimizerNames.PAGED_ADAMW_8BIT with betas=(0.9,0.999) and epsilon=1e-08 and optimizer_args=No additional optimizer arguments46- lr_scheduler_type: linear47- training_steps: 15048- mixed_precision_training: Native AMP49 50### Training results51 52 53 54### Framework versions55 56- PEFT 0.17.057- Transformers 4.55.258- Pytorch 2.6.0+cu12459- Datasets 4.0.060- Tokenizers 0.21.2