papers

Publications (64)

cs.CL2020

How Far are We from Effective Context Modeling? An Exploratory Study on Semantic Parsing in Context

Qian Liu, Bei Chen, Jiaqi Guo +3

cs.HC2019

Text-to-Viz: Automatic Generation of Infographics from Proportion-Related Natural Language Statements

Weiwei Cui, Xiaoyu Zhang, Yun Wang +6

cs.AI2018

Learning-to-Ask: Knowledge Acquisition via 20 Questions

Yihong Chen, Bei Chen, Xuguang Duan +4

cs.LG2023

Does Deep Learning Learn to Abstract? A Systematic Probing Framework

Shengnan An, Zeqi Lin, Bei Chen +3

cs.AI2025

Understanding DeepResearch via Reports

Tianyu Fan, Xinyao Niu, Yuxiang Zheng +5

cs.CV2025

ProBench: Judging Multimodal Foundation Models on Open-ended Multi-domain Expert Tasks

Yan Yang, Dongxu Li, Haoning Wu +4

cs.CL2022

DFM: Dialogue Foundation Model for Universal Large-Scale Dialogue-Oriented Task Learning

Zhi Chen, Jijia Bao, Lu Chen +10

cs.CL2022

UniDU: Towards A Unified Generative Dialogue Understanding Framework

Zhi Chen, Lu Chen, Bei Chen +5

cs.SE2023

Private-Library-Oriented Code Generation with Large Language Models

Daoguang Zan, Bei Chen, Yongshun Gong +6

cs.CL2022

Input-Tuning: Adapting Unfamiliar Inputs to Frozen Pretrained Models

Shengnan An, Yifei Li, Zeqi Lin +6

physics.ao-ph2020

Statistical and machine learning ensemble modelling to forecast sea surface temperature

Stefan Wolff, Fearghal O'Donncha, Bei Chen

cs.AI2026

Safactory: A Scalable Agentic Infrastructure for Training Trustworthy Autonomous Intelligence

Xinquan Chen, Zhenyun Yin, Shan He +38

cs.CV2025

Generative Frame Sampler for Long Video Understanding

Linli Yao, Haoning Wu, Kun Ouyang +5

cs.SE2023

Large Language Models Meet NL2Code: A Survey

Daoguang Zan, Bei Chen, Fengji Zhang +5

cs.CL2019

FANDA: A Novel Approach to Perform Follow-up Query Analysis

Qian Liu, Bei Chen, Jian-Guang Lou +2

cs.LG2016

Max-Margin Nonparametric Latent Feature Models for Link Prediction

Jun Zhu, Jiaming Song, Bei Chen

cs.CL2026

DRIP-R: A Benchmark for Decision-Making and Reasoning Under Real-World Policy Ambiguity in the Retail Domain

Hsuvas Borkakoty, Sebastian Pohl, Cheng Wang +2

eess.SY2017

Energy Trading between microgrids Individual Cost Minimization and Social Welfare Maximization

Zhenyu Qiao, Bo Yang, Qimin Xu +4

cs.CL2015

Jointly Modeling Topics and Intents with Global Order Structure

Bei Chen, Jun Zhu, Nan Yang +3

cs.CL2023

Can Programming Languages Boost Each Other via Instruction Tuning?

Daoguang Zan, Ailun Yu, Bo Shen +8

cs.CL2022

Reasoning Like Program Executors

Xinyu Pi, Qian Liu, Bei Chen +6

cs.CL2023

Making Large Language Models Better Reasoners with Step-Aware Verifier

Yifei Li, Zeqi Lin, Shizhuo Zhang +4

cs.CL2022

CodeT: Code Generation with Generated Tests

Bei Chen, Fengji Zhang, Anh Nguyen +4

cs.CL2023

How Do In-Context Examples Affect Compositional Generalization?

Shengnan An, Zeqi Lin, Qiang Fu +4

cs.LG2020

Discovering Traveling Companions using Autoencoders

Xiaochang Li, Bei Chen, Xuesong Lu

cs.LG2015

Discriminative Nonparametric Latent Feature Relational Models with Data Augmentation

Bei Chen, Ning Chen, Jun Zhu +2

cs.CV2024

LongVideoBench: A Benchmark for Long-context Interleaved Video-Language Understanding

Haoning Wu, Dongxu Li, Bei Chen +1

cs.CL2023

Question Answering as Programming for Solving Time-Sensitive Questions

Xinyu Zhu, Cheng Yang, Bei Chen +3

cs.CL2020

Incomplete Utterance Rewriting as Semantic Segmentation

Qian Liu, Bei Chen, Jian-Guang Lou +2

cs.LG2021

AutoAI-TS: AutoAI for Time Series Forecasting

Syed Yousaf Shah, Dhaval Patel, Long Vu +10

physics.ao-ph2020

Ensemble model aggregation using a computationally lightweight machine-learning model to forecast ocean waves

Fearghal O'Donncha, Yushan Zhang, Bei Chen +1

cs.PL2022

When Language Model Meets Private Library

Daoguang Zan, Bei Chen, Zeqi Lin +3

cs.SE2023

SoTaNa: The Open-Source Software Development Assistant

Ensheng Shi, Fengji Zhang, Yanlin Wang +6

cs.CL2020

"What Do You Mean by That?" A Parser-Independent Interactive Approach for Enhancing Text-to-SQL

Yuntao Li, Bei Chen, Qian Liu +4

cs.CL2020

Revisiting Iterative Back-Translation from the Perspective of Compositional Generalization

Yinuo Guo, Hualei Zhu, Zeqi Lin +3

cs.LG2019

LambdaOpt: Learn to Regularize Recommender Models in Finer Levels

Yihong Chen, Bei Chen, Xiangnan He +4

cs.CL2019

A Split-and-Recombine Approach for Follow-up Query Analysis

Qian Liu, Bei Chen, Haoyan Liu +4

cs.DB2017

One button machine for automating feature engineering in relational databases

Hoang Thanh Lam, Johann-Michael Thiebaut, Mathieu Sinn +3

cs.CL2021

Learning Algebraic Recombination for Compositional Generalization

Chenyao Liu, Shengnan An, Zeqi Lin +6

cs.CL2023

RepoCoder: Repository-Level Code Completion Through Iterative Retrieval and Generation

Fengji Zhang, Bei Chen, Yue Zhang +6

cs.CL2025

Yi-Lightning Technical Report

Alan Wake, Bei Chen, C. X. Lv +41

cs.CL2025

Yi: Open Foundation Models by 01.AI

01. AI, :, Alex Young +30

cs.AI2025

PIN: A Knowledge-Intensive Dataset for Paired and Interleaved Multimodal Documents

Junjie Wang, Yuxiang Zhang, Minghao Liu +19

cs.CL2026

DeepInnovator: Triggering the Innovative Capabilities of LLMs

Tianyu Fan, Fengji Zhang, Yuxiang Zheng +5

cs.CV2025

Aria: An Open Multimodal Native Mixture-of-Experts Model

Dongxu Li, Yudong Liu, Haoning Wu +17

cs.MA2026

Towards Self-Improving Error Diagnosis in Multi-Agent Systems

Jiazheng Li, Emine Yilmaz, Bei Chen +1

cs.CL2022

LEMON: Language-Based Environment Manipulation via Execution-Guided Pre-training

Qi Shi, Qian Liu, Bei Chen +3

cs.SE2022

CERT: Continual Pre-Training on Sketches for Library-Oriented Code Generation

Daoguang Zan, Bei Chen, Dejian Yang +6

cs.CL2024

Efficient Performance Tracking: Leveraging Large Language Models for Automated Construction of Scientific Leaderboards

Furkan Şahinuç, Thy Thy Tran, Yulia Grishina +3

physics.optics2025

A Fully Reconfigurable All-Optical Integrated Nonlinear Activator

Bei Chen, Xiaowen Xiong, Renheng Zhang +6

cs.CL2023

Skill-Based Few-Shot Selection for In-Context Learning

Shengnan An, Bo Zhou, Zeqi Lin +5

cs.SI2020

Client Network: An Interactive Model for Predicting New Clients

Massimiliano Mattetti, Akihiro Kishimoto, Adi Botea +4

cs.LG2026

To Answer or to Abstain: Mitigating Search-Agent Hallucinations via Abstention-Aware Reinforcement Learning

Fengji Zhang, Tianyu Fan, Yuxiang Zheng +4

cs.CL2025

ASearch: Ambiguity-Aware Question Answering with Reinforcement Learning

Fengji Zhang, Xinyao Niu, Chengyang Ying +7

cs.LG2026

Steering Large Reasoning Models towards Concise Reasoning via Flow Matching

Yawei Li, Benjamin Bergner, Yinghan Zhao +3

cs.SE2023

Explainable Automated Debugging via Large Language Model-driven Scientific Debugging

Sungmin Kang, Bei Chen, Shin Yoo +1

cs.AI2020

Compositional Generalization by Learning Analytical Expressions

Qian Liu, Shengnan An, Jian-Guang Lou +6

cs.CV2025

HumanEval-V: Benchmarking High-Level Visual Reasoning with Complex Diagrams in Coding Tasks

Fengji Zhang, Linquan Wu, Huiyu Bai +6

stat.CO2019

Castor: Contextual IoT Time Series Data and Model Management at Scale

Bei Chen, Bradley Eck, Francesco Fusco +4

cs.CL2022

TAPEX: Table Pre-training via Learning a Neural SQL Executor

Qian Liu, Bei Chen, Jiaqi Guo +4

cs.HC2025

Aria-UI: Visual Grounding for GUI Instructions

Yuhao Yang, Yue Wang, Dongxu Li +4

stat.ML2015

(Blue) Taxi Destination and Trip Time Prediction from Partial Trajectories

Hoang Thanh Lam, Ernesto Diaz-Aviles, Alessandra Pascale +2

cs.CL2020

You Impress Me: Dialogue Generation via Mutual Persona Perception

Qian Liu, Yihong Chen, Bei Chen +4

cs.CL2024

CMMMU: A Chinese Massive Multi-discipline Multimodal Understanding Benchmark

Ge Zhang, Xinrun Du, Bei Chen +19