2 papers
cs.CL2025
STEP: Staged Parameter-Efficient Pre-training for Large Language Models
Kazuki Yano, Takumi Ito, Jun Suzuki
Pre-training large language models (LLMs) faces significant memory challenges due to the large size of model parameters. We introduce STaged parameter-Efficient Pre-training (STEP)…
cs.CL2025
Reference-free Evaluation Metrics for Text Generation: A Survey
Takumi Ito, Kees van Deemter, Jun Suzuki
A number of automatic evaluation metrics have been proposed for natural language generation systems. The most common approach to automatic evaluation is the use of a reference-base…