NewEvery arXiv paper, its researchers & institutions — mapped.
papers

Publications (74)

cs.CL2025

IW-Bench: Evaluating Large Multimodal Models for Converting Image-to-Web

Hongcheng Guo, Wei Zhang, Junhao Chen +9

cs.SE2026

Evaluating and Achieving Controllable Code Completion in Code LLM

Jiajun Zhang, Zeyu Cui, Lei Zhang +7

cs.CV2024

Multi-view Deep Subspace Clustering Networks

Pengfei Zhu, Xinjie Yao, Yu Wang +3

cs.CL2023

Qwen Technical Report

Jinze Bai, Shuai Bai, Yunfei Chu +45

cs.AI2026

BIRD-INTERACT: Re-imagining Text-to-SQL Evaluation for Large Language Models via Lens of Dynamic Interactions

Nan Huo, Xiaohan Xu, Jinyang Li +21

cs.CL2025

START: Self-taught Reasoner with Tools

Chengpeng Li, Mingfeng Xue, Zhenru Zhang +7

cs.CL2025

IFEvalCode: Controlled Code Generation

Jian Yang, Wei Zhang, Shukai Liu +9

cs.CL2024

ExecRepoBench: Multi-level Executable Code Completion Evaluation

Jian Yang, Jiajun Zhang, Jiaxi Yang +9

cs.LG2026

Qwen-CUA: Native Computer Use for (almost) Everything

Dunjie Lu, Shuai Bai, Tianyi Bai +42

cs.CL2022

Linking-Enhanced Pre-Training for Table Semantic Parsing

Bowen Qin, Lihan Wang, Binyuan Hui +5

cs.CL2025

WorldPM: Scaling Human Preference Modeling

Binghai Wang, Runji Lin, Keming Lu +17

cs.CL2024

One-Shot Learning as Instruction Data Prospector for Large Language Models

Yunshui Li, Binyuan Hui, Xiaobo Xia +9

cs.CL2024

Prompting Large Language Models to Tackle the Full Software Development Lifecycle: A Case Study

Bowen Li, Wenhan Wu, Ziwei Tang +13

cs.CL2023

VDialogUE: A Unified Evaluation Benchmark for Visually-grounded Dialogue

Yunshui Li, Binyuan Hui, Zhaochao Yin +6

cs.CL2022

SUN: Exploring Intrinsic Uncertainties in Text-to-SQL Parsers

Bowen Qin, Lihan Wang, Binyuan Hui +7

cs.CL2022

SPACE-2: Tree-Structured Semi-Supervised Contrastive Pre-training for Task-Oriented Dialog Understanding

Wanwei He, Yinpei Dai, Binyuan Hui +6

cs.DB2026

SWE-SQL: Illuminating LLM Pathways to Solve User SQL Issues in Real-World Applications

Jinyang Li, Xiaolong Li, Ge Qu +17

cs.CL2023

Large Language Models are Versatile Decomposers: Decompose Evidence and Questions for Table-based Reasoning

Yunhu Ye, Binyuan Hui, Min Yang +3

cs.CL2024

OctoPack: Instruction Tuning Code Large Language Models

Niklas Muennighoff, Qian Liu, Armel Zebaze +7

cs.SE2025

SWE-smith: Scaling Data for Software Engineering Agents

John Yang, Kilian Lieret, Carlos E. Jimenez +7

cs.CL2024

DialCLIP: Empowering CLIP as Multi-Modal Dialog Retriever

Zhichao Yin, Binyuan Hui, Min Yang +2

cs.CL2026

Scaling Agentic Verifier for Competitive Coding

Zeyao Ma, Jing Zhang, Xiaokang Zhang +9

cs.CV2025

Qwen3-VL Technical Report

Shuai Bai, Yuxuan Cai, Ruizhe Chen +61

cs.CL2024

Out-of-Domain Intent Detection Considering Multi-Turn Dialogue Contexts

Hao Lang, Yinhe Zheng, Binyuan Hui +2

cs.CL2022

S$^2$SQL: Injecting Syntax to Question-Schema Interaction Graph Encoder for Text-to-SQL Parsers

Binyuan Hui, Ruiying Geng, Lihan Wang +4

cs.LG2022

Latent Heterogeneous Graph Network for Incomplete Multi-View Learning

Pengfei Zhu, Xinjie Yao, Yu Wang +4

cs.CL2025

OLMoE: Open Mixture-of-Experts Language Models

Niklas Muennighoff, Luca Soldaini, Dirk Groeneveld +21

cs.CL2023

SPRING: Situated Conversation Agent Pretrained with Multimodal Questions from Incremental Layout Graph

Yuxing Long, Binyuan Hui, Fulong Ye +5

cs.SE2025

BigCodeArena: Unveiling More Reliable Human Preferences in Code Generation via Execution

Terry Yue Zhuo, Xiaolong Jin, Hange Liu +37

cs.CL2025

Teaching LLM to Reason: Reinforcement Learning from Algorithmic Problems without Code

Keqin Bao, Nuo Chen, Xiaoyuan Li +5

cs.CL2023

An Investigation of LLMs' Inefficacy in Understanding Converse Relations

Chengwen Qi, Bowen Li, Binyuan Hui +4

cs.SD2023

TransAudio: Towards the Transferable Adversarial Audio Attack via Learning Contextualized Perturbations

Qi Gege, Yuefeng Chen, Xiaofeng Mao +5

cs.CL2023

Can LLM Already Serve as A Database Interface? A BIg Bench for Large-Scale Database Grounded Text-to-SQLs

Jinyang Li, Binyuan Hui, Ge Qu +15

cs.CL2026

Qwen3-Coder-Next Technical Report

Ruisheng Cao, Mouxiang Chen, Jiawei Chen +17

cs.CL2025

CodeElo: Benchmarking Competition-level Code Generation of LLMs with Human-comparable Elo Ratings

Shanghaoran Quan, Jiaxi Yang, Bowen Yu +14

cs.CL2022

STAR: SQL Guided Pre-Training for Context-dependent Text-to-SQL Parsing

Zefeng Cai, Xiangyu Li, Binyuan Hui +8

cs.DC2026

MegaFlow: Large-Scale Distributed Orchestration System for the Agentic Era

Lei Zhang, Mouxiang Chen, Ruisheng Cao +16

cs.DB2025

A Survey of LLM $\times$ DATA

Xuanhe Zhou, Junxuan He, Wei Zhou +14

cs.CL2024

Synthesizing Text-to-SQL Data from Weak and Strong LLMs

Jiaxi Yang, Binyuan Hui, Min Yang +3

cs.CL2023

Graphix-T5: Mixing Pre-Trained Transformers with Graph-Aware Layers for Text-to-SQL Parsing

Jinyang Li, Binyuan Hui, Reynold Cheng +7

cs.SE2024

StarCoder 2 and The Stack v2: The Next Generation

Anton Lozhkov, Raymond Li, Loubna Ben Allal +63

cs.IR2023

Multimodal Recommendation Dialog with Subjective Preference: A New Challenge and Benchmark

Yuxing Long, Binyuan Hui, Caixia Yuan1 +3

cs.SE2025

OpenHands: An Open Platform for AI Software Developers as Generalist Agents

Xingyao Wang, Boxuan Li, Yufan Song +21

cs.CL2023

PaCE: Unified Multi-modal Dialogue Pre-training with Progressive and Compositional Experts

Yunshui Li, Binyuan Hui, ZhiChao Yin +3

cs.LG2025

Parallel Scaling Law for Language Models

Mouxiang Chen, Binyuan Hui, Zeyu Cui +5

cs.CL2026

PlotCraft: Pushing the Limits of LLMs for Complex and Interactive Data Visualization

Jiajun Zhang, Jianke Zhang, Zeyu Cui +7

cs.CL2025

Qwen3 Technical Report

An Yang, Anfeng Li, Baosong Yang +57

cs.CL2024

Lemur: Harmonizing Natural Language and Code for Language Agents

Yiheng Xu, Hongjin Su, Chen Xing +13

cs.CL2024

Qwen2.5-Coder Technical Report

Binyuan Hui, Jian Yang, Zeyu Cui +21

cs.SE2025

Towards Better Correctness and Efficiency in Code Generation

Yunlong Feng, Yang Xu, Xiao Xu +2

cs.CL2025

Large Language Models Meet Symbolic Provers for Logical Reasoning Evaluation

Chengwen Qi, Ren Ma, Bowen Li +5

cs.GR2020

Geometry-guided Dense Perspective Network for Speech-Driven Facial Animation

Jingying Liu, Binyuan Hui, Kun Li +5

cs.CL2025

Qwen2.5 Technical Report

Qwen, :, An Yang +41

cs.CL2021

Improving Text-to-SQL with Schema Dependency Learning

Binyuan Hui, Xiang Shi, Ruiying Geng +4

cs.CL2022

A Survey on Text-to-SQL Parsing: Concepts, Methods, and Future Directions

Bowen Qin, Binyuan Hui, Lihan Wang +9

cs.CL2023

History Semantic Graph Enhanced Conversational KBQA with Temporal Information Modeling

Hao Sun, Yang Li, Liwei Deng +6

cs.CL2024

A Preliminary Study of the Intrinsic Relationship between Complexity and Alignment

Yingxiu Zhao, Bowen Yu, Binyuan Hui +4

cs.CL2023

PolyLM: An Open Source Polyglot Large Language Model

Xiangpeng Wei, Haoran Wei, Huan Lin +15

cs.CL2025

SWE-Flow: Synthesizing Software Engineering Data in a Test-Driven Manner

Lei Zhang, Jiaxi Yang, Min Yang +6

cs.CL2025

SWE-RM: Execution-free Feedback For Software Engineering Agents

KaShun Shum, Binyuan Hui, Jiawei Chen +6

cs.CL2024

Iterative Forward Tuning Boosts In-Context Learning in Language Models

Jiaxi Yang, Binyuan Hui, Min Yang +5

cs.CV2023

Model Inversion Attack via Dynamic Memory Learning

Gege Qi, YueFeng Chen, Xiaofeng Mao +4

cs.CV2025

DEEM: Diffusion Models Serve as the Eyes of Large Language Models for Image Perception

Run Luo, Yunshui Li, Longze Chen +9

cs.CL2022

Proton: Probing Schema Linking Information from Pre-trained Language Models for Text-to-SQL Parsing

Lihan Wang, Bowen Qin, Binyuan Hui +7

cs.SE2025

BigCodeBench: Benchmarking Code Generation with Diverse Function Calls and Complex Instructions

Terry Yue Zhuo, Minh Chien Vu, Jenny Chim +30

cs.SE2026

From Completion to Editing: Unlocking Context-Aware Code Infilling via Search-and-Replace Instruction Tuning

Jiajun Zhang, Zeyu Cui, Jiaxi Yang +9

cs.CL2021

Dynamic Hybrid Relation Network for Cross-Domain Context-Dependent Semantic Parsing

Binyuan Hui, Ruiying Geng, Qiyu Ren +7

cs.CL2025

VideoAgentTrek: Computer Use Pretraining from Unlabeled Videos

Dunjie Lu, Yiheng Xu, Junli Wang +12

cs.SE2025

Turning the Tide: Repository-based Code Reflection

Wei Zhang, Jian Yang, Jiaxi Yang +5

cs.CL2024

Evaluating and Aligning CodeLLMs on Human Preference

Jian Yang, Jiaxi Yang, Ke Jin +7

cs.CL2024

Qwen2 Technical Report

An Yang, Baosong Yang, Binyuan Hui +59

cs.CL2024

Qwen2.5-Math Technical Report: Toward Mathematical Expert Model via Self-Improvement

An Yang, Beichen Zhang, Binyuan Hui +13

cs.CL2025

Multi-Agent Collaboration for Multilingual Code Instruction Tuning

Jian Yang, Wei Zhang, Jiaxi Yang +9

cs.SE2026

SWE-Universe: Scale Real-World Verifiable Environments to Millions

Mouxiang Chen, Lei Zhang, Yunlong Feng +15