2 papers
cs.CL2026
When Should LLMs Search? Counterfactual Supervision for Search Routing
Minho Kim
Search-augmented language models can use external evidence to compensate for limitations in parametric knowledge, but search is not uniformly beneficial: models may call search for…
cs.CY2026
When VLMs 'Fix' Students: Identifying and Penalizing Over-Correction in the Evaluation of Multi-line Handwritten Math OCR
Jin Seong, Wencke Liermann, Minho Kim +2
Accurate transcription of handwritten mathematics is crucial for educational AI systems, yet current benchmarks fail to evaluate this capability properly. Most prior studies focus…