2 papers
cs.CV2026
Towards Mitigating Modality Bias in Vision-Language Models for Temporal Action Localization
Jiaqi Li, Guangming Wang, Shuntian Zheng +4
Temporal Action Localization (TAL) requires identifying both the boundaries and categories of actions in untrimmed videos. While vision-language models (VLMs) offer rich semantics…
cs.HC2026
Person Parametric Physics-informed Representation for mmWave-based Human Pose Estimation
Shuntian Zheng, Jiaqi Li, Guangming Wang +4
Millimeter-wave (mmWave) radar enables privacy-preserving, illumination-invariant Human Pose Estimation (HPE). However, current mmWave-based HPE systems face a signal-noise dilemma…