A training approach that uses a discriminator model to detect replaced tokens, making pre-training more efficient than traditional masked language modeling.