2 papers
cs.CV2024
MVLLaVA: An Intelligent Agent for Unified and Flexible Novel View Synthesis
Hanyu Jiang, Jian Xue, Xing Lan +2
This paper introduces MVLLaVA, an intelligent agent designed for novel view synthesis tasks. MVLLaVA integrates multiple multi-view diffusion models with a large multimodal model,…
cs.CV2024
ExpLLM: Towards Chain of Thought for Facial Expression Recognition
Xing Lan, Jian Xue, Ji Qi +3
Facial expression recognition (FER) is a critical task in multimedia with significant implications across various domains. However, analyzing the causes of facial expressions is es…