3 papers
cs.CV2025
A Chain-of-Thought Subspace Meta-Learning for Few-shot Image Captioning with Large Vision and Language Models
Hao Huang, Shuaihang Yuan, Yu Hao +2
A large-scale vision and language model that has been pretrained on massive data encodes visual and linguistic prior, which makes it easier to generate images and language that are…
cs.RO2025
Integrating Retrospective Framework in Multi-Robot Collaboration
Jiazhao Liang, Hao Huang, Yu Hao +4
Recent advancements in Large Language Models (LLMs) have demonstrated substantial capabilities in enhancing communication and coordination in multi-robot systems. However, existing…
cs.CV2024
Curvature Diversity-Driven Deformation and Domain Alignment for Point Cloud
Mengxi Wu, Hao Huang, Yi Fang +1
Unsupervised Domain Adaptation (UDA) is crucial for reducing the need for extensive manual data annotation when training deep networks on point cloud data. A significant challenge…