2 papers
cs.LG2026
Breaking Feedback-Blindness: Utility-Augmented Transformer for Sequential Decision Making
Yuyang Shen, Shan Dai, Daimin Chen
Sequential decision making in non-stationary and partially observable environments requires rapid adaptation to latent regime changes. However, existing Transformer decision models…
cs.LG2026
Understanding and Guiding Layer Placement in Parameter-Efficient Fine-Tuning of Large Language Models
Yichen Xu, Yuyang Liang, Shan Dai +3
As large language models (LLMs) continue to grow, the cost of full-parameter fine-tuning has made parameter-efficient fine-tuning (PEFT) the default strategy for downstream adaptat…