Publications (74)
IW-Bench: Evaluating Large Multimodal Models for Converting Image-to-Web
Hongcheng Guo, Wei Zhang, Junhao Chen +9
Evaluating and Achieving Controllable Code Completion in Code LLM
Jiajun Zhang, Zeyu Cui, Lei Zhang +7
Multi-view Deep Subspace Clustering Networks
Pengfei Zhu, Xinjie Yao, Yu Wang +3
Qwen Technical Report
Jinze Bai, Shuai Bai, Yunfei Chu +45
BIRD-INTERACT: Re-imagining Text-to-SQL Evaluation for Large Language Models via Lens of Dynamic Interactions
Nan Huo, Xiaohan Xu, Jinyang Li +21
START: Self-taught Reasoner with Tools
Chengpeng Li, Mingfeng Xue, Zhenru Zhang +7
IFEvalCode: Controlled Code Generation
Jian Yang, Wei Zhang, Shukai Liu +9
ExecRepoBench: Multi-level Executable Code Completion Evaluation
Jian Yang, Jiajun Zhang, Jiaxi Yang +9
Qwen-CUA: Native Computer Use for (almost) Everything
Dunjie Lu, Shuai Bai, Tianyi Bai +42
Linking-Enhanced Pre-Training for Table Semantic Parsing
Bowen Qin, Lihan Wang, Binyuan Hui +5
WorldPM: Scaling Human Preference Modeling
Binghai Wang, Runji Lin, Keming Lu +17
One-Shot Learning as Instruction Data Prospector for Large Language Models
Yunshui Li, Binyuan Hui, Xiaobo Xia +9
Prompting Large Language Models to Tackle the Full Software Development Lifecycle: A Case Study
Bowen Li, Wenhan Wu, Ziwei Tang +13
VDialogUE: A Unified Evaluation Benchmark for Visually-grounded Dialogue
Yunshui Li, Binyuan Hui, Zhaochao Yin +6
SUN: Exploring Intrinsic Uncertainties in Text-to-SQL Parsers
Bowen Qin, Lihan Wang, Binyuan Hui +7
SPACE-2: Tree-Structured Semi-Supervised Contrastive Pre-training for Task-Oriented Dialog Understanding
Wanwei He, Yinpei Dai, Binyuan Hui +6
SWE-SQL: Illuminating LLM Pathways to Solve User SQL Issues in Real-World Applications
Jinyang Li, Xiaolong Li, Ge Qu +17
Large Language Models are Versatile Decomposers: Decompose Evidence and Questions for Table-based Reasoning
Yunhu Ye, Binyuan Hui, Min Yang +3
OctoPack: Instruction Tuning Code Large Language Models
Niklas Muennighoff, Qian Liu, Armel Zebaze +7
SWE-smith: Scaling Data for Software Engineering Agents
John Yang, Kilian Lieret, Carlos E. Jimenez +7
DialCLIP: Empowering CLIP as Multi-Modal Dialog Retriever
Zhichao Yin, Binyuan Hui, Min Yang +2
Scaling Agentic Verifier for Competitive Coding
Zeyao Ma, Jing Zhang, Xiaokang Zhang +9
Qwen3-VL Technical Report
Shuai Bai, Yuxuan Cai, Ruizhe Chen +61
Out-of-Domain Intent Detection Considering Multi-Turn Dialogue Contexts
Hao Lang, Yinhe Zheng, Binyuan Hui +2
S$^2$SQL: Injecting Syntax to Question-Schema Interaction Graph Encoder for Text-to-SQL Parsers
Binyuan Hui, Ruiying Geng, Lihan Wang +4
Latent Heterogeneous Graph Network for Incomplete Multi-View Learning
Pengfei Zhu, Xinjie Yao, Yu Wang +4
OLMoE: Open Mixture-of-Experts Language Models
Niklas Muennighoff, Luca Soldaini, Dirk Groeneveld +21
SPRING: Situated Conversation Agent Pretrained with Multimodal Questions from Incremental Layout Graph
Yuxing Long, Binyuan Hui, Fulong Ye +5
BigCodeArena: Unveiling More Reliable Human Preferences in Code Generation via Execution
Terry Yue Zhuo, Xiaolong Jin, Hange Liu +37
Teaching LLM to Reason: Reinforcement Learning from Algorithmic Problems without Code
Keqin Bao, Nuo Chen, Xiaoyuan Li +5
An Investigation of LLMs' Inefficacy in Understanding Converse Relations
Chengwen Qi, Bowen Li, Binyuan Hui +4
TransAudio: Towards the Transferable Adversarial Audio Attack via Learning Contextualized Perturbations
Qi Gege, Yuefeng Chen, Xiaofeng Mao +5
Can LLM Already Serve as A Database Interface? A BIg Bench for Large-Scale Database Grounded Text-to-SQLs
Jinyang Li, Binyuan Hui, Ge Qu +15
Qwen3-Coder-Next Technical Report
Ruisheng Cao, Mouxiang Chen, Jiawei Chen +17
CodeElo: Benchmarking Competition-level Code Generation of LLMs with Human-comparable Elo Ratings
Shanghaoran Quan, Jiaxi Yang, Bowen Yu +14
STAR: SQL Guided Pre-Training for Context-dependent Text-to-SQL Parsing
Zefeng Cai, Xiangyu Li, Binyuan Hui +8
MegaFlow: Large-Scale Distributed Orchestration System for the Agentic Era
Lei Zhang, Mouxiang Chen, Ruisheng Cao +16
A Survey of LLM $\times$ DATA
Xuanhe Zhou, Junxuan He, Wei Zhou +14
Synthesizing Text-to-SQL Data from Weak and Strong LLMs
Jiaxi Yang, Binyuan Hui, Min Yang +3
Graphix-T5: Mixing Pre-Trained Transformers with Graph-Aware Layers for Text-to-SQL Parsing
Jinyang Li, Binyuan Hui, Reynold Cheng +7
StarCoder 2 and The Stack v2: The Next Generation
Anton Lozhkov, Raymond Li, Loubna Ben Allal +63
Multimodal Recommendation Dialog with Subjective Preference: A New Challenge and Benchmark
Yuxing Long, Binyuan Hui, Caixia Yuan1 +3
OpenHands: An Open Platform for AI Software Developers as Generalist Agents
Xingyao Wang, Boxuan Li, Yufan Song +21
PaCE: Unified Multi-modal Dialogue Pre-training with Progressive and Compositional Experts
Yunshui Li, Binyuan Hui, ZhiChao Yin +3
Parallel Scaling Law for Language Models
Mouxiang Chen, Binyuan Hui, Zeyu Cui +5
PlotCraft: Pushing the Limits of LLMs for Complex and Interactive Data Visualization
Jiajun Zhang, Jianke Zhang, Zeyu Cui +7
Qwen3 Technical Report
An Yang, Anfeng Li, Baosong Yang +57
Lemur: Harmonizing Natural Language and Code for Language Agents
Yiheng Xu, Hongjin Su, Chen Xing +13
Qwen2.5-Coder Technical Report
Binyuan Hui, Jian Yang, Zeyu Cui +21
Towards Better Correctness and Efficiency in Code Generation
Yunlong Feng, Yang Xu, Xiao Xu +2
Large Language Models Meet Symbolic Provers for Logical Reasoning Evaluation
Chengwen Qi, Ren Ma, Bowen Li +5
Geometry-guided Dense Perspective Network for Speech-Driven Facial Animation
Jingying Liu, Binyuan Hui, Kun Li +5
Qwen2.5 Technical Report
Qwen, :, An Yang +41
Improving Text-to-SQL with Schema Dependency Learning
Binyuan Hui, Xiang Shi, Ruiying Geng +4
A Survey on Text-to-SQL Parsing: Concepts, Methods, and Future Directions
Bowen Qin, Binyuan Hui, Lihan Wang +9
History Semantic Graph Enhanced Conversational KBQA with Temporal Information Modeling
Hao Sun, Yang Li, Liwei Deng +6
A Preliminary Study of the Intrinsic Relationship between Complexity and Alignment
Yingxiu Zhao, Bowen Yu, Binyuan Hui +4
PolyLM: An Open Source Polyglot Large Language Model
Xiangpeng Wei, Haoran Wei, Huan Lin +15
SWE-Flow: Synthesizing Software Engineering Data in a Test-Driven Manner
Lei Zhang, Jiaxi Yang, Min Yang +6
SWE-RM: Execution-free Feedback For Software Engineering Agents
KaShun Shum, Binyuan Hui, Jiawei Chen +6
Iterative Forward Tuning Boosts In-Context Learning in Language Models
Jiaxi Yang, Binyuan Hui, Min Yang +5
Model Inversion Attack via Dynamic Memory Learning
Gege Qi, YueFeng Chen, Xiaofeng Mao +4
DEEM: Diffusion Models Serve as the Eyes of Large Language Models for Image Perception
Run Luo, Yunshui Li, Longze Chen +9
Proton: Probing Schema Linking Information from Pre-trained Language Models for Text-to-SQL Parsing
Lihan Wang, Bowen Qin, Binyuan Hui +7
BigCodeBench: Benchmarking Code Generation with Diverse Function Calls and Complex Instructions
Terry Yue Zhuo, Minh Chien Vu, Jenny Chim +30
From Completion to Editing: Unlocking Context-Aware Code Infilling via Search-and-Replace Instruction Tuning
Jiajun Zhang, Zeyu Cui, Jiaxi Yang +9
Dynamic Hybrid Relation Network for Cross-Domain Context-Dependent Semantic Parsing
Binyuan Hui, Ruiying Geng, Qiyu Ren +7
VideoAgentTrek: Computer Use Pretraining from Unlabeled Videos
Dunjie Lu, Yiheng Xu, Junli Wang +12
Turning the Tide: Repository-based Code Reflection
Wei Zhang, Jian Yang, Jiaxi Yang +5
Evaluating and Aligning CodeLLMs on Human Preference
Jian Yang, Jiaxi Yang, Ke Jin +7
Qwen2 Technical Report
An Yang, Baosong Yang, Binyuan Hui +59
Qwen2.5-Math Technical Report: Toward Mathematical Expert Model via Self-Improvement
An Yang, Beichen Zhang, Binyuan Hui +13
Multi-Agent Collaboration for Multilingual Code Instruction Tuning
Jian Yang, Wei Zhang, Jiaxi Yang +9
SWE-Universe: Scale Real-World Verifiable Environments to Millions
Mouxiang Chen, Lei Zhang, Yunlong Feng +15