Showing 2026Show all
2 papers · 1 filter
cs.CL2026
Residual Skill Optimization for Text-to-SQL Ensembles
Jiongli Zhu, Haoquan Guan, Parjanya Prajakta Prashant +8
Text-to-SQL ensembles improve over single-candidate generation by drawing multiple SQL candidates and selecting one, but their effectiveness is bounded by Pass@K, the probability t…
cs.LG2026
Fine-Tuning Without Forgetting via Loss-Adaptive Learning Rates
Parjanya Prajakta Prashant, Jiongli Zhu, Aldan Creo +1
Fine-tuning large language models on new data improves task performance but degrades capabilities learned during pretraining, a phenomenon known as catastrophic forgetting. Existin…