Q4

AI Model Quantization Precision & Memory Lab

Presets:
01 Quantization Configuration
INT4 Asymmetric
Clipping Percentile 99.5%
Dynamic Range Limit Full
02 FP32 Weight Tensor (4x4 Matrix)
Activation Vector x (4x1)
03 Weight Distribution & Grid Quantiles
04 Computed Scaling Parameters
Scale Factor (α)
0.0245
Step Resolution
Zero Point (z)
7
Asym Shift
Weight MSE Error
0.00142
SNR: 24.2 dB
VRAM Footprint
-87.5%
64B → 8B
05 Quantized Grid & Dequantized Reconstruction
06 Activation Drift (W · x vs W_dequant · x)
Proof & Verification State
FP32 Baseline MatMul matches Target INT4 Dequantized error bound
Enjoy this tool? Build your own with Super