1 paper
Tejas Anvekar, Junha Park, Aparna Garimella +1
Evaluating the quality of tables generated by large language models (LLMs) remains an open challenge: existing metrics either flatten tables into text, ignoring structure, or rely…