Showing cs.CLShow all
2 papers · 1 filter
cs.CL2025
Curriculum-Guided Layer Scaling for Language Model Pretraining
Karanpartap Singh, Neil Band, Ehsan Adeli
As the cost of pretraining large language models grows, there is continued interest in strategies to improve learning efficiency during this core training stage. Motivated by cogni…
cs.CL2023
New Evaluation Metrics Capture Quality Degradation due to LLM Watermarking
Karanpartap Singh, James Zou
With the increasing use of large-language models (LLMs) like ChatGPT, watermarking has emerged as a promising approach for tracing machine-generated content. However, research on L…