wiesio111/kitsune-qwen-coder
0
Kitsune — Qwen2.5-Coder-3B-Instruct (GGUF) na HF Space
OpenAI-compatible API (/v1/chat/completions) dla modelu alphaduriendur/Qwen2.5-Coder-3B-Instruct-Q4_0-GGUF (~1.82 GB Q4_0, CPU).
Deploy (konto wiesio111)
python deploy/huggingface/qwen_coder_inference/deploy.pyPodłączenie w Kitsune
./deploy/huggingface/qwen_coder_inference/connect_kitsune.sh "https://wiesio111-kitsune-qwen-coder.hf.space"Pierwsze uruchomienie Space trwa kilka–kilkanaście minut (build llama.cpp + pobranie GGUF).
