Showing cs.AIShow all
2 papers · 1 filter
cs.AI2025
DevPiolt: Operation Recommendation for IoT Devices at Xiaomi Home
Yuxiang Wang, Siwen Wang, Haowei Han +10
Operation recommendation for IoT devices refers to generating personalized device operations for users based on their context, such as historical operations, environment informatio…
cs.AI2025
ACPO: Adaptive Curriculum Policy Optimization for Aligning Vision-Language Models in Complex Reasoning
Yunhao Wang, Ziting Li, Shuai Chen +6
Aligning large-scale vision-language models (VLMs) for complex reasoning via reinforcement learning is often hampered by the limitations of existing policy optimization algorithms,…