2 papers
cs.CV2025
RePIC: Reinforced Post-Training for Personalizing Multi-Modal Language Models
Yeongtak Oh, Dohyun Chung, Juhyeon Shin +4
Recent multi-modal large language models (MLLMs) often struggle to generate personalized image captions, even when trained on high-quality captions. In this work, we observe that s…
cs.LG2024
Introducing Spectral Attention for Long-Range Dependency in Time Series Forecasting
Bong Gyun Kang, Dongjun Lee, HyunGi Kim +2
Sequence modeling faces challenges in capturing long-range dependencies across diverse tasks. Recent linear and transformer-based forecasters have shown superior performance in tim…