activity
20232025
most citedInterleaving Pre-Trained Language Models and Large Language Models for Zero-Shot NL2SQL Generation

7 citations · 8 across the 5 of their papers we have counts for

collaborators
Showing cs.DBShow all

5 papers · 1 filter

cs.DB2025

A Unified Model for Cardinality Estimation by Learning from Data and Queries via Sum-Product Networks

Jiawei Liu, Ju Fan, Tongyu Liu +5

Cardinality estimation is a fundamental component in database systems, crucial for generating efficient execution plans. Despite advancements in learning-based cardinality estimati…

cs.DB2025

Automatic Database Configuration Debugging using Retrieval-Augmented Language Models

Sibei Chen, Ju Fan, Bin Wu +8

Database management system (DBMS) configuration debugging, e.g., diagnosing poorly configured DBMS knobs and generating troubleshooting recommendations, is crucial in optimizing DB…

cs.DB2023

SEED: Domain-Specific Data Curation With Large Language Models

Zui Chen, Lei Cao, Sam Madden +7

Data curation tasks that prepare data for analytics are critical for turning data into actionable insights. However, due to the diverse requirements of applications in different do…

cs.DB2023

VerifAI: Verified Generative AI

Nan Tang, Chenyu Yang, Ju Fan +3

Generative AI has made significant strides, yet concerns about the accuracy and reliability of its outputs continue to grow. Such inaccuracies can have serious consequences such as…

cs.DB20231 cited

ChatPipe: Orchestrating Data Preparation Program by Optimizing Human-ChatGPT Interactions

Sibei Chen, Hanbing Liu, Weiting Jin +5

Orchestrating a high-quality data preparation program is essential for successful machine learning (ML), but it is known to be time and effort consuming. Despite the impressive cap…