Showing cs.CLShow all
2 papers · 1 filter
cs.CL2026
EntSQL: A Benchmark for Grounding Text-to-SQL in Long-Context Enterprise Knowledge
Chengxi Liao, Tao Xu, Zulong Chen +7
Text-to-SQL enables natural language access to databases, and recent LLMs have substantially advanced its capabilities. Existing benchmarks such as Spider, BIRD, and Spider~2.0 eva…
cs.CL2026
Multi-domain Multi-modal Document Classification Benchmark with a Multi-level Taxonomy
Denghao Ma, Qing Liu, Zulong Chen +5
Document classification forms the backbone of modern enterprise content management, yet existing benchmarks remain trapped in oversimplified paradigms -- single domain settings wit…