3 papers
cs.CV2025
CONCORD: Concept-Informed Diffusion for Dataset Distillation
Jianyang Gu, Haonan Wang, Ruoxi Jia +4
Dataset distillation (DD) has witnessed significant progress in creating small datasets that encapsulate rich information from large original ones. Particularly, methods based on g…
cs.CL2024
SLED: Self Logits Evolution Decoding for Improving Factuality in Large Language Models
Jianyi Zhang, Da-Cheng Juan, Cyrus Rashtchian +3
Large language models (LLMs) have demonstrated remarkable capabilities, but their outputs can sometimes be unreliable or factually incorrect. To address this, we introduce Self Log…
cs.LG2024
Dataset Distillation from First Principles: Integrating Core Information Extraction and Purposeful Learning
Vyacheslav Kungurtsev, Yuanfang Peng, Jianyang Gu +4
Dataset distillation (DD) is an increasingly important technique that focuses on constructing a synthetic dataset capable of capturing the core information in training data to achi…