Examines neural premise selection, proof generation, autoformalization, reinforcement-guided search, and language-model assistance. Learners evaluate generated steps with a trusted checker and identify failure modes such as invalid translation, hidden assumptions, and benchmark leakage.