A quantization format that stores model weights as 8-bit integers instead of full-precision numbers, significantly reducing memory usage while maintaining reasonable accuracy.