Team Ai
Apppublic

noodcon/AI-hub

sourceHugging Faceapache-2.0updated 12d agoView on Hugging Face
0likes
App README

🧰 Mondk Hub — 5 Models Collection (Gradio + ZeroGPU)

Space tổng hợp 5 model của mondk:

#ModelGGUFGốcTác vụ
1mondk/Prompt-Guardprompt-guard-Q6_K.gguf 469MB / Q8_0 604MB (llama.cpp)RyanStudio/Mezzo-Prompt-Guard-v2-Large (XLM-R Large, 24L, 1024h)Binary safe/unsafe — chặn jailbreak / prompt-injection
2mondk/Greetings-model—mondk/Greetings-model MoE 2000 experts, vocab 90 char, 1 layer, ~2M paramsChào hỏi / small-talk (hi)
3mondk/Msh-Tiny-14M-GGUFmodel-f16.gguf 28MB / q4km 11MB / q2k 9.6MBmondk/Msh-Tiny-14M (GPT-2, n_embd 384, 6L, vocab 8192)Chat `<user> / <assistant> / <end>`
4mondk/Msh-Tiny-47M-GGUFmodel-f16.gguf 95MB / f32 189MB / q8_0 51MBmondk/Msh-Tiny-47M (GPT-2, n_embd 640, 8L, vocab 12000)Chat (train 15 datasets)
5mondk/my-chess-engine-test—chess_model.pt 35MB + uci_engine.py (ChessNet CNN policy 4096 + value)UCI Chess Engine

Space hardware: ZeroGPU (Free) ✅

Space này dùng Gradio + ZeroGPU (@spaces.GPU). Theo ảnh bạn gửi: khi tạo Space chọn SDK Gradio → template Blank → hardware ZeroGPU (Free). CPU Basic đã khóa với Free tier, ZeroGPU là lựa chọn duy nhất.

Nếu bạn tạo từ API gặp 402 Payment Required (cpu-basic đòi PRO), hãy tạo bằng UI: New Space → Gradio → Blank → ZeroGPU Free hoặc đổi hardware trong Settings → Hardware → ZeroGPU.

Cấu trúc Space

  • —app.py : 5 tabs Gradio (Prompt-Guard, Greetings, Msh-14M, Msh-47M, Chess) — mỗi tab gọi model gốc tương ứng, có @spaces.GPU cho ZeroGPU.
  • —requirements.txt : gradio, spaces, torch, transformers, accelerate, python-chess, ...

Lưu ý kỹ thuật

  • —Prompt-Guard GGUF không load trực tiếp bằng transformers được (chỉ có .gguf). Space load base model RyanStudio/Mezzo-Prompt-Guard-v2-Large để có safe/unsafe pipeline chuẩn. Link GGUF vẫn hiển thị để dùng với llama.cpp.
  • —GGUF của Msh-Tiny được chạy qua bản safetensors gốc (cùng weights, khác quant) để tương thích transformers + ZeroGPU. Bảng so sánh size GGUF vẫn show trong tab.
  • —Tất cả model to("cuda") ở module level (theo khuyến nghị ZeroGPU).

Chạy local

bash
pip install -r requirements.txt
python app.py