A lightweight neural network design that prioritizes speed and efficiency by using fewer parameters than larger models, making it faster and less resource-intensive.