Team Ai
Apppublic

ai-engineering-at/llama-cpp-turboquant-guide

sourceHugging Facecc-by-4.0updated 6mo agoView on Hugging Face
15likes
9 commits on main
740999f6mo ago

docs: overhaul README — architecture diagram, fixed anchors, VRAM visualization, bilingual

AI Engineering Lab
a99aedc6mo ago

results: RTX 3090 consolidated — 4 runs, 15 measurements, avg -7.5% TPS

AI Engineering Lab
bf29ad16mo ago

results: consolidate 4070 Laptop — 2 independent sessions, avg -4.6% TPS

AI Engineering Lab
78e199b6mo ago

results: add verified RTX 4070 Laptop benchmark + cross-GPU comparison table

AI Engineering Lab
3e856b16mo ago

results: add RTX 4070 Laptop 8GB benchmark (Llama-3.1 8B)

AI Engineering Lab, Claude Sonnet 4.6
f0318bb6mo ago

fix: add GitHub repo link prominently in HF Space README

AI Engineering Lab
22804ce6mo ago

Add HuggingFace Space frontmatter

AI Engineering Lab
571e9fb6mo ago

results: add v2 verification run — confirms v1 within measurement variance

AI Engineering Lab
87efc666mo ago

Initial release: TurboQuant practical guide for consumer hardware

AI Engineering Lab