tinyopsec/Qwen3.8-4B-Empero-AI-FullStack-GGUF
02.4k
Qwen3.8-4B-Empero-AI-FullStack โ GGUF Quantizations
This repository contains GGUF quantizations of iBotIA/Qwen3.8-4B-Empero-AI-FullStack.
๐ฆ Available Quantizations
IQ quants (IQ4_XS, etc.) coming soon โ require imatrix calibration.
๐ Usage
llama.cpp
./llama-cli -m model_q4_k_m.gguf -p "Your prompt here" -n 512LM Studio
Download any .gguf file and load it directly in LM Studio.
Ollama
ollama run hf.co/tinyopsec/Qwen3.8-4B-Empero-AI-FullStack-GGUF:Q4_K_MPython (llama-cpp-python)
from llama_cpp import Llama
llm = Llama.from_pretrained(
repo_id="tinyopsec/Qwen3.8-4B-Empero-AI-FullStack-GGUF",
filename="model_q4_k_m.gguf",
)
output = llm("Your prompt here", max_tokens=512)
print(output["choices"][0]["text"])๐ง Quantization Details
- Source model: iBotIA/Qwen3.8-4B-Empero-AI-FullStack
- Tool: llama.cpp
- Base format: F16 GGUF
- IQ calibration data: groups_merged.txt by kalomaze
๐ก Which quant should I use?
๐ License
Refer to the original model license.
