2 papers
cs.LG2026
Dr. Post-Training: A Data Regularization Perspective on LLM Post-Training
Pingbang Hu, Xueshen Liu, Z. Morley Mao +1
Data selection methods address a critical challenge in LLM post-training: effectively leveraging scarce, high-fidelity target data alongside abundant but imperfectly aligned genera…
cs.RO2025
Token Expand-Merge: Training-Free Token Compression for Vision-Language-Action Models
Yifan Ye, Jiaqi Ma, Jun Cen +1
Vision-Language-Action (VLA) models pretrained on large-scale multimodal datasets have emerged as powerful foundations for robotic perception and control. However, their massive sc…