3 papers
cs.AI2026
Offline Policy Optimization with Posterior Sampling
Hongqiang Lin, Dongxu Zhang, Yiding Sun +3
A fundamental challenge in model-based offline reinforcement learning (RL) lies in the trade-off between generalization and robustness against exploitation errors in out-of-distrib…
cs.CR2026
Membership Inference Attacks on Vision-Language-Action Models
Yuefeng Peng, Mingzhe Li, Kejing Xia +2
Membership inference attacks (MIAs) have been extensively studied in large language models (LLMs) and vision-language models (VLMs), yet their implications for vision-language-acti…
cs.SE2025
EmbedGenius: Towards Automated Software Development for Generic Embedded IoT Systems
Huanqi Yang, Mingzhe Li, Mingda Han +2
Embedded IoT system development is crucial for enabling seamless connectivity and functionality across a wide range of applications. However, such a complex process requires cross-…