2 papers
cs.LG2026
PrivFusion: A Privacy-preserving Multi-Agent Framework for Harmonizing Distributed Datasets
Anisa Halimi, Liubov Nedoshivina, Kieran Fraser +1
The growing availability of clinical data has increased the use of machine learning, yet centralized data aggregation is often infeasible for sensitive health information. Federate…
cs.LG2026
In-Context Bias Propagation in LLM-Based Tabular Data Generation
Pol G. Recasens, Alberto Gutierrez, Jordi Torres +4
Large Language Models (LLMs) are increasingly used for synthetic tabular data generation through in-context learning (ICL), offering a practical solution for data augmentation in d…