Publications (63)
Copiloting the Copilots: Fusing Large Language Models with Completion Engines for Automated Program Repair
Yuxiang Wei, Chunqiu Steven Xia, Lingming Zhang
Evaluating Language Models for Efficient Code Generation
Jiawei Liu, Songrun Xie, Junhao Wang +3
Agentless: Demystifying LLM-based Software Engineering Agents
Chunqiu Steven Xia, Yinlin Deng, Soren Dunn +1
Weaver: Fuzzing JavaScript Engines at the JavaScript-WebAssembly Boundary
Lingming Zhang, Binbin Zhao, Puzhuo Liu +4
Large Language Models are Zero-Shot Fuzzers: Fuzzing Deep-Learning Libraries via Large Language Models
Yinlin Deng, Chunqiu Steven Xia, Haoran Peng +2
KernelGPT: Enhanced Kernel Fuzzing via Large Language Models
Chenyuan Yang, Zijie Zhao, Lingming Zhang
SWE-Replay: Efficient Test-Time Scaling for Software Engineering Agents
Yifeng Ding, Lingming Zhang
NNSmith: Generating Diverse and Valid Test Cases for Deep Learning Compilers
Jiawei Liu, Jinkun Lin, Fabian Ruffy +4
Self-Boosted Automated Program Repair
Samuel Benton, Mengshi Zhang, Xia Li +1
Beyond Isolation: A Unified Benchmark for General-Purpose Navigation
Samson Sun, Tianyi Yang, Tengyue Wang +6
When Automated Program Repair Meets Regression Testing -- An Extensive Study on 2 Million Patches
Yiling Lou, Jun Yang, Samuel Benton +5
Fuzzing Deep-Learning Libraries via Automated Relational API Inference
Yinlin Deng, Chenyuan Yang, Anjiang Wei +1
Program Repair: Automated vs. Manual
Quanjun Zhang, Yuan Zhao, Weisong Sun +3
DeepRoad: GAN-based Metamorphic Autonomous Driving System Testing
Mengshi Zhang, Yuqun Zhang, Lingming Zhang +2
Keep the Conversation Going: Fixing 162 out of 337 bugs for $0.42 each using ChatGPT
Chunqiu Steven Xia, Lingming Zhang
Free Lunch for Testing: Fuzzing Deep-Learning Libraries from Open Source
Anjiang Wei, Yinlin Deng, Chenyuan Yang +1
InfiniteVGGT: Visual Geometry Grounded Transformer for Endless Streams
Shuai Yuan, Yantai Yang, Xiaotian Yang +4
Conversational Automated Program Repair
Chunqiu Steven Xia, Lingming Zhang
How Do Static and Dynamic Test Case Prioritization Techniques Perform on Modern Software Systems? An Extensive Study on GitHub Projects
Qi Luo, Kevin Moran, Lingming Zhang +1
Agentic Vulnerability Reasoning on COTS Binaries
Hwiwon Lee, Jongseong Kim, Lingming Zhang
The paper introduces SLYP, a REACT-style pipeline that enables large language model agents to discover and validate vulnerabilities directly in commercial off‑the‑shelf (COTS) Wind…
Attention: Not Just Another Dataset for Patch-Correctness Checking
Jun Yang, Yuehan Wang, Yiling Lou +2
Fast and Precise On-the-fly Patch Validation for All
Lingchao Chen, Lingming Zhang
SelfCodeAlign: Self-Alignment for Code Generation
Yuxiang Wei, Federico Cassano, Jiawei Liu +7
Productively Deploying Emerging Models on Emerging Platforms: A Top-Down Approach for Testing and Debugging
Siyuan Feng, Jiawei Liu, Ruihang Lai +4
Two-Stream Graph Convolutional Network for Intra-oral Scanner Image Segmentation
Yue Zhao, Lingming Zhang, Yang Liu +6
Fuzz4All: Universal Fuzzing with Large Language Models
Chunqiu Steven Xia, Matteo Paltenghi, Jia Le Tian +2
RepoQA: Evaluating Long Context Code Understanding
Jiawei Liu, Jia Le Tian, Vijay Daita +5
SWE-RL: Advancing LLM Reasoning via Reinforcement Learning on Open Software Evolution
Yuxiang Wei, Olivier Duchenne, Jade Copet +6
PurpCode: Reasoning for Safer Code Generation
Jiawei Liu, Nirav Diwan, Zhe Wang +11
Code as Agent Harness
Xuying Ning, Katherine Tieu, Dongqi Fu +39
Top Leaderboard Ranking = Top Coding Proficiency, Always? EvoEval: Evolving Coding Benchmarks via LLM
Chunqiu Steven Xia, Yinlin Deng, Lingming Zhang
XFT: Unlocking the Power of Code Instruction Tuning by Simply Merging Upcycled Mixture-of-Experts
Yifeng Ding, Jiawei Liu, Yuxiang Wei +2
TSGCNet: Discriminative Geometric Feature Learning with Two-Stream GraphConvolutional Network for 3D Dental Model Segmentation
Lingming Zhang, Yue Zhao, Deyu Meng +5
Live-SWE-agent: Can Software Engineering Agents Self-Evolve on the Fly?
Chunqiu Steven Xia, Zhe Wang, Yan Yang +2
Less Training, More Repairing Please: Revisiting Automated Program Repair via Zero-shot Learning
Chunqiu Steven Xia, Lingming Zhang
Coverage-Guided Tensor Compiler Fuzzing with Joint IR-Pass Mutation
Jiawei Liu, Yuxiang Wei, Sen Yang +2
CAPTCHA Solving for Native GUI Agents: Automated Reasoning-Action Data Generation and Self-Corrective Training
Yuxi Chen, Haoyu Zhai, Chenkai Wang +4
CWM: An Open-Weights LLM for Research on Code Generation with World Models
FAIR CodeGen team, Jade Copet, Quentin Carbonneaux +48
Large Language Models are Edge-Case Fuzzers: Testing Deep Learning Libraries via FuzzGPT
Yinlin Deng, Chunqiu Steven Xia, Chenyuan Yang +3
Toward Training Superintelligent Software Agents through Self-Play SWE-RL
Yuxiang Wei, Zhiqing Sun, Emily McMilin +6
StarCoder 2 and The Stack v2: The Next Generation
Anton Lozhkov, Raymond Li, Loubna Ben Allal +63
AnyPoC: Universal Proof-of-Concept Test Generation for Scalable LLM-Based Bug Detection
Zijie Zhao, Chenyuan Yang, Weidong Wang +3
DeepBillboard: Systematic Physical-World Testing of Autonomous Driving Systems
Husheng Zhou, Wei Li, Yuankun Zhu +4
KNighter: Transforming Static Analysis with LLM-Synthesized Checkers
Chenyuan Yang, Zijie Zhao, Zichen Xie +2
UniDebugger: Hierarchical Multi-Agent Framework for Unified Software Debugging
Cheryl Lee, Chunqiu Steven Xia, Longji Yang +4
Can Automated Program Repair Refine Fault Localization?
Yiling Lou, Ali Ghanbari, Xia Li +3
Practical Program Repair in the Era of Large Pre-trained Language Models
Chunqiu Steven Xia, Yuxiang Wei, Lingming Zhang
NeuRI: Diversifying DNN Generation via Inductive Rule Inference
Jiawei Liu, Jinjun Peng, Yuyao Wang +1
WhiteFox: White-Box Compiler Fuzzing Empowered by Large Language Models
Chenyuan Yang, Yinlin Deng, Runyu Lu +4
Fuzzing Automatic Differentiation in Deep-Learning Libraries
Chenyuan Yang, Yinlin Deng, Jiayi Yao +3
Magicoder: Empowering Code Generation with OSS-Instruct
Yuxiang Wei, Zhe Wang, Jiawei Liu +2
SEC-bench Pro: Can Language Models Solve Long-Horizon Software Security Tasks?
Hwiwon Lee, Jiawei Liu, Dongjun Kim +4
Revisiting the Plastic Surgery Hypothesis via Large Language Models
Chunqiu Steven Xia, Yifeng Ding, Lingming Zhang
A Survey of LLM-based Automated Program Repair: Taxonomies, Design Paradigms, and Applications
Boyang Yang, Zijian Cai, Fengling Liu +5
Mutation Testing for Ethereum Smart Contract
Haoran Wu, Xingya Wang, Jiehui Xu +3
Minimizing False Positives in Static Bug Detection via LLM-Enhanced Path Feasibility Analysis
Xueying Du, Kai Yu, Chong Wang +6
Characterizing and Detecting CUDA Program Bugs
Mingyuan Wu, Husheng Zhou, Lingming Zhang +2
SwarmResearch: Orchestrating Coding Agents for Open-Ended Discovery
Yuvraj Virk, Zack Edds, Chunqiu Steven Xia +1
SEC-bench: Automated Benchmarking of LLM Agents on Real-World Software Security Tasks
Hwiwon Lee, Ziqi Zhang, Hanxiao Lu +1
Practical Program Repair via Bytecode Mutation
Ali Ghanbari, Lingming Zhang
Large Language Model-Based Agents for Software Engineering: A Survey
Junwei Liu, Kaixin Wang, Yixuan Chen +4
TESTEVAL: Benchmarking Large Language Models for Test Case Generation
Wenhan Wang, Chenyuan Yang, Zhijie Wang +6
Is Your Code Generated by ChatGPT Really Correct? Rigorous Evaluation of Large Language Models for Code Generation
Jiawei Liu, Chunqiu Steven Xia, Yuyao Wang +1