Model quantization¶
Quantize your trained model to use integer math instead of floating point math for efficient on-device deployment. The DeepGate SDK currently supports int8 weight and activation quantization via two paths:
- Post-training quantization (PTQ) – calibrate on representative data
- Quantization-aware training (QAT) – fine-tune with quantization