3 papers
cs.LG2024
Enhance Modality Robustness in Text-Centric Multimodal Alignment with Adversarial Prompting
Yun-Da Tsai, Ting-Yu Yen, Keng-Te Liao +1
Converting different modalities into generalized text, which then serves as input prompts for large language models (LLMs), is a common approach for aligning multimodal models, par…
cs.CL2024
Enhance the Robustness of Text-Centric Multimodal Alignments
Ting-Yu Yen, Yun-Da Tsai, Keng-Te Liao +1
Converting different modalities into general text, serving as input prompts for large language models (LLMs), is a common method to align multimodal models when there is limited pa…
cs.LG2024
Text-centric Alignment for Multi-Modality Learning
Yun-Da Tsai, Ting-Yu Yen, Pei-Fu Guo +2
This research paper addresses the challenge of modality mismatch in multimodal learning, where the modalities available during inference differ from those available at training. We…