Team Ai
Modelpublic

DuoNeural/Qwen2.5-Coder-3B-SFT-StructuredOutput-GGUF

sourceHugging Faceapache-2.0updated 5mo agoView on Hugging Face
0likes223downloads
Model Card

Qwen2.5-Coder-3B-SFT-StructuredOutput — GGUF

GGUF quantizations of DuoNeural/Qwen2.5-Coder-3B-SFT-StructuredOutput.

Multi-task SFT on SQL (7,560) + JSON (3,568) + WebCode (1,107) = 12,235 examples combined. GSM8K flexible +20.5% over base Qwen2.5-Coder-3B (0.582→0.701). ARC stable.

Eval vs Baseline

MetricBaselineMultitask SFTDelta
GSM8K flexible0.58230.7013+20.5%
GSM8K strict0.69370.6907-0.4%
ARC-acc0.45560.4522-0.7%
ARC-norm0.48980.4949+1.0%

Available Quants

FileSizeUse case
*-Q2_K.gguf~1.5 GBMinimum size, CPU inference
*-Q3_K_M.gguf~1.9 GBSmall with decent quality
*-Q4_K_M.gguf~2.2 GBRecommended — best size/quality
*-Q5_K_M.gguf~2.5 GBHigh quality
*-Q6_K.gguf~2.9 GBVery high quality
*-Q8_0.gguf~3.7 GBNear-lossless

Usage (llama.cpp)

bash
llama-cli -m Qwen2.5-Coder-3B-SFT-StructuredOutput-Q4_K_M.gguf \
  -p "Write a SQL query to find all users who signed up in the last 30 days" \
  -n 256

DuoNeural

DuoNeural is an open AI research lab — human + AI in collaboration.

PlatformLink
HuggingFacehuggingface.co/DuoNeural
Websiteduoneural.com
GitHubgithub.com/DuoNeural
X / Twitter@DuoNeural

Subscribe: [duoneural.beehiiv.com](https://duoneural.beehiiv.com)