magiccodingman/Jasper-Token-Compression-600M-ONNX-INT8
022
Jasper Token Compression 600M — ONNX INT-8
ONNX export of infgrad/Jasper-Token-Compression-600M.
Precision: INT8 (Dynamic) Quantization: Dynamic INT8 Model size: 583.56 MiB
Dynamic INT8 ONNX export optimized for fast CPU inference. This is a text embedding model.
Benchmarks
Fidelity
Median cosine similarity versus FP32: ~0.988–0.992.
Attribution
Original model: infgrad/Jasper-Token-Compression-600M
