Team Ai
Datasetpublic

ysn-rfd/text-dataset-tiny-code-script-py-format

USED of tahamajs/medicine_ds_persian for .parquet file USED of Alijafarixcs2/persian-it-llama2-2k for .parquet file USED of Abirate/english_quotes for .jsonl file NEW FILES (05/12/2025) NEW FILES (12/26/2025) NEW FILES (02/15/2026)

sourceHugging Faceapache-2.0updated 4mo agoView on Hugging Face
3likes1.7kdownloads
Untitled2.ipynb79 linesDownload Raw Back to opencv_test
1{2 "cells": [3  {4   "cell_type": "code",5   "execution_count": null,6   "id": "f8a34a5c-7d7b-4c3f-ac3b-72fb8361d148",7   "metadata": {8    "scrolled": true9   },10   "outputs": [],11   "source": [12    "import gradio as gr\n",13    "from transformers import AutoTokenizer, AutoModelForCausalLM\n",14    "import torch\n",15    "\n",16    "# بارگذاری مدل و توکنایزر\n",17    "tokenizer = AutoTokenizer.from_pretrained(\"HooshvareLab/gpt2-fa\")\n",18    "model = AutoModelForCausalLM.from_pretrained(\"HooshvareLab/gpt2-fa\")\n",19    "\n",20    "# تابع تولید متن با تنظیمات دقیق\n",21    "def generate_text(prompt):\n",22    "    input_ids = tokenizer.encode(prompt, return_tensors=\"pt\")\n",23    "    output = model.generate(\n",24    "        input_ids,\n",25    "        max_new_tokens=256,\n",26    "        do_sample=True,\n",27    "        temperature=0.7,\n",28    "        top_k=50,\n",29    "        top_p=0.92,\n",30    "        repetition_penalty=1.3,\n",31    "        no_repeat_ngram_size=3,\n",32    "        pad_token_id=tokenizer.eos_token_id,\n",33    "        eos_token_id=tokenizer.eos_token_id\n",34    "    )\n",35    "    return tokenizer.decode(output[0], skip_special_tokens=True)\n",36    "\n",37    "# ساخت رابط گرافیکی با Gradio\n",38    "gr.Interface(\n",39    "    fn=generate_text,\n",40    "    inputs=gr.Textbox(label=\"📝 متن ورودی (پرامپت)\", placeholder=\"مثلاً: در یک روز بهاری،\", lines=3),\n",41    "    outputs=gr.Textbox(label=\"📄 متن تولید شده\"),\n",42    "    title=\"💬 تولید متن فارسی دقیق با GPT2\",\n",43    "    description=\"این ابزار از مدل bolbolzaban/gpt2-persian استفاده می‌کند و متن روان و طبیعی به زبان فارسی تولید می‌کند.\",\n",44    "    theme=\"soft\"\n",45    ").launch()\n"46   ]47  },48  {49   "cell_type": "code",50   "execution_count": null,51   "id": "33b7f00a-888b-4e51-9453-3c9b7f2e82c0",52   "metadata": {},53   "outputs": [],54   "source": []55  }56 ],57 "metadata": {58  "kernelspec": {59   "display_name": "Python [conda env:base] *",60   "language": "python",61   "name": "conda-base-py"62  },63  "language_info": {64   "codemirror_mode": {65    "name": "ipython",66    "version": 367   },68   "file_extension": ".py",69   "mimetype": "text/x-python",70   "name": "python",71   "nbconvert_exporter": "python",72   "pygments_lexer": "ipython3",73   "version": "3.12.7"74  }75 },76 "nbformat": 4,77 "nbformat_minor": 578}79