3 papers
cs.CL2024
DialCLIP: Empowering CLIP as Multi-Modal Dialog Retriever
Zhichao Yin, Binyuan Hui, Min Yang +2
Recently, substantial advancements in pre-trained vision-language models have greatly enhanced the capabilities of multi-modal dialog systems. These models have demonstrated signif…
cs.CL2024
Unifying Structured Data as Graph for Data-to-Text Pre-Training
Shujie Li, Liang Li, Ruiying Geng +8
Data-to-text (D2T) generation aims to transform structured data into natural language text. Data-to-text pre-training has proved to be powerful in enhancing D2T generation and yiel…
cs.CL2023
One-Shot Learning as Instruction Data Prospector for Large Language Models
Yunshui Li, Binyuan Hui, Xiaobo Xia +9
Contemporary practices in instruction tuning often hinge on enlarging data scaling without a clear strategy for ensuring data quality, inadvertently introducing noise that may comp…