NewEvery arXiv paper, its researchers & institutions — mapped.
papers

Publications (63)

cs.SE2023

Copiloting the Copilots: Fusing Large Language Models with Completion Engines for Automated Program Repair

Yuxiang Wei, Chunqiu Steven Xia, Lingming Zhang

cs.SE2024

Evaluating Language Models for Efficient Code Generation

Jiawei Liu, Songrun Xie, Junhao Wang +3

cs.SE2024

Agentless: Demystifying LLM-based Software Engineering Agents

Chunqiu Steven Xia, Yinlin Deng, Soren Dunn +1

cs.CR2026

Weaver: Fuzzing JavaScript Engines at the JavaScript-WebAssembly Boundary

Lingming Zhang, Binbin Zhao, Puzhuo Liu +4

cs.SE2023

Large Language Models are Zero-Shot Fuzzers: Fuzzing Deep-Learning Libraries via Large Language Models

Yinlin Deng, Chunqiu Steven Xia, Haoran Peng +2

cs.CR2025

KernelGPT: Enhanced Kernel Fuzzing via Large Language Models

Chenyuan Yang, Zijie Zhao, Lingming Zhang

cs.SE2026

SWE-Replay: Efficient Test-Time Scaling for Software Engineering Agents

Yifeng Ding, Lingming Zhang

cs.LG2022

NNSmith: Generating Diverse and Valid Test Cases for Deep Learning Compilers

Jiawei Liu, Jinkun Lin, Fabian Ruffy +4

cs.SE2021

Self-Boosted Automated Program Repair

Samuel Benton, Mengshi Zhang, Xia Li +1

cs.RO2026

Beyond Isolation: A Unified Benchmark for General-Purpose Navigation

Samson Sun, Tianyi Yang, Tengyue Wang +6

cs.SE2024

When Automated Program Repair Meets Regression Testing -- An Extensive Study on 2 Million Patches

Yiling Lou, Jun Yang, Samuel Benton +5

cs.SE2022

Fuzzing Deep-Learning Libraries via Automated Relational API Inference

Yinlin Deng, Chenyuan Yang, Anjiang Wei +1

cs.SE2022

Program Repair: Automated vs. Manual

Quanjun Zhang, Yuan Zhao, Weisong Sun +3

cs.SE2018

DeepRoad: GAN-based Metamorphic Autonomous Driving System Testing

Mengshi Zhang, Yuqun Zhang, Lingming Zhang +2

cs.SE2024

Keep the Conversation Going: Fixing 162 out of 337 bugs for $0.42 each using ChatGPT

Chunqiu Steven Xia, Lingming Zhang

cs.SE2022

Free Lunch for Testing: Fuzzing Deep-Learning Libraries from Open Source

Anjiang Wei, Yinlin Deng, Chenyuan Yang +1

cs.CV2026

InfiniteVGGT: Visual Geometry Grounded Transformer for Endless Streams

Shuai Yuan, Yantai Yang, Xiaotian Yang +4

cs.SE2023

Conversational Automated Program Repair

Chunqiu Steven Xia, Lingming Zhang

cs.SE2018

How Do Static and Dynamic Test Case Prioritization Techniques Perform on Modern Software Systems? An Extensive Study on GitHub Projects

Qi Luo, Kevin Moran, Lingming Zhang +1

cs.CR2026

Agentic Vulnerability Reasoning on COTS Binaries

Hwiwon Lee, Jongseong Kim, Lingming Zhang

The paper introduces SLYP, a REACT-style pipeline that enables large language model agents to discover and validate vulnerabilities directly in commercial off‑the‑shelf (COTS) Wind…

#vulnerability analysis#binary reverse engineering#large language model agents#dynamic debugging
cs.SE2023

Attention: Not Just Another Dataset for Patch-Correctness Checking

Jun Yang, Yuehan Wang, Yiling Lou +2

cs.SE2020

Fast and Precise On-the-fly Patch Validation for All

Lingchao Chen, Lingming Zhang

cs.CL2024

SelfCodeAlign: Self-Alignment for Code Generation

Yuxiang Wei, Federico Cassano, Jiawei Liu +7

cs.SE2025

Productively Deploying Emerging Models on Emerging Platforms: A Top-Down Approach for Testing and Debugging

Siyuan Feng, Jiawei Liu, Ruihang Lai +4

eess.IV2022

Two-Stream Graph Convolutional Network for Intra-oral Scanner Image Segmentation

Yue Zhao, Lingming Zhang, Yang Liu +6

cs.SE2024

Fuzz4All: Universal Fuzzing with Large Language Models

Chunqiu Steven Xia, Matteo Paltenghi, Jia Le Tian +2

cs.SE2024

RepoQA: Evaluating Long Context Code Understanding

Jiawei Liu, Jia Le Tian, Vijay Daita +5

cs.SE2025

SWE-RL: Advancing LLM Reasoning via Reinforcement Learning on Open Software Evolution

Yuxiang Wei, Olivier Duchenne, Jade Copet +6

cs.CR2025

PurpCode: Reasoning for Safer Code Generation

Jiawei Liu, Nirav Diwan, Zhe Wang +11

cs.CL2026

Code as Agent Harness

Xuying Ning, Katherine Tieu, Dongqi Fu +39

cs.SE2024

Top Leaderboard Ranking = Top Coding Proficiency, Always? EvoEval: Evolving Coding Benchmarks via LLM

Chunqiu Steven Xia, Yinlin Deng, Lingming Zhang

cs.CL2024

XFT: Unlocking the Power of Code Instruction Tuning by Simply Merging Upcycled Mixture-of-Experts

Yifeng Ding, Jiawei Liu, Yuxiang Wei +2

cs.CV2020

TSGCNet: Discriminative Geometric Feature Learning with Two-Stream GraphConvolutional Network for 3D Dental Model Segmentation

Lingming Zhang, Yue Zhao, Deyu Meng +5

cs.SE2025

Live-SWE-agent: Can Software Engineering Agents Self-Evolve on the Fly?

Chunqiu Steven Xia, Zhe Wang, Yan Yang +2

cs.SE2024

Less Training, More Repairing Please: Revisiting Automated Program Repair via Zero-shot Learning

Chunqiu Steven Xia, Lingming Zhang

cs.SE2022

Coverage-Guided Tensor Compiler Fuzzing with Joint IR-Pass Mutation

Jiawei Liu, Yuxiang Wei, Sen Yang +2

cs.CR2026

CAPTCHA Solving for Native GUI Agents: Automated Reasoning-Action Data Generation and Self-Corrective Training

Yuxi Chen, Haoyu Zhai, Chenkai Wang +4

cs.SE2025

CWM: An Open-Weights LLM for Research on Code Generation with World Models

FAIR CodeGen team, Jade Copet, Quentin Carbonneaux +48

cs.SE2023

Large Language Models are Edge-Case Fuzzers: Testing Deep Learning Libraries via FuzzGPT

Yinlin Deng, Chunqiu Steven Xia, Chenyuan Yang +3

cs.SE2026

Toward Training Superintelligent Software Agents through Self-Play SWE-RL

Yuxiang Wei, Zhiqing Sun, Emily McMilin +6

cs.SE2024

StarCoder 2 and The Stack v2: The Next Generation

Anton Lozhkov, Raymond Li, Loubna Ben Allal +63

cs.SE2026

AnyPoC: Universal Proof-of-Concept Test Generation for Scalable LLM-Based Bug Detection

Zijie Zhao, Chenyuan Yang, Weidong Wang +3

cs.CV2018

DeepBillboard: Systematic Physical-World Testing of Autonomous Driving Systems

Husheng Zhou, Wei Li, Yuankun Zhu +4

cs.SE2025

KNighter: Transforming Static Analysis with LLM-Synthesized Checkers

Chenyuan Yang, Zijie Zhao, Zichen Xie +2

cs.SE2025

UniDebugger: Hierarchical Multi-Agent Framework for Unified Software Debugging

Cheryl Lee, Chunqiu Steven Xia, Longji Yang +4

cs.SE2019

Can Automated Program Repair Refine Fault Localization?

Yiling Lou, Ali Ghanbari, Xia Li +3

cs.SE2024

Practical Program Repair in the Era of Large Pre-trained Language Models

Chunqiu Steven Xia, Yuxiang Wei, Lingming Zhang

cs.SE2023

NeuRI: Diversifying DNN Generation via Inductive Rule Inference

Jiawei Liu, Jinjun Peng, Yuyao Wang +1

cs.SE2024

WhiteFox: White-Box Compiler Fuzzing Empowered by Large Language Models

Chenyuan Yang, Yinlin Deng, Runyu Lu +4

cs.SE2023

Fuzzing Automatic Differentiation in Deep-Learning Libraries

Chenyuan Yang, Yinlin Deng, Jiayi Yao +3

cs.CL2024

Magicoder: Empowering Code Generation with OSS-Instruct

Yuxiang Wei, Zhe Wang, Jiawei Liu +2

cs.CR2026

SEC-bench Pro: Can Language Models Solve Long-Horizon Software Security Tasks?

Hwiwon Lee, Jiawei Liu, Dongjun Kim +4

cs.SE2024

Revisiting the Plastic Surgery Hypothesis via Large Language Models

Chunqiu Steven Xia, Yifeng Ding, Lingming Zhang

cs.SE2025

A Survey of LLM-based Automated Program Repair: Taxonomies, Design Paradigms, and Applications

Boyang Yang, Zijian Cai, Fengling Liu +5

cs.SE2019

Mutation Testing for Ethereum Smart Contract

Haoran Wu, Xingya Wang, Jiehui Xu +3

cs.SE2025

Minimizing False Positives in Static Bug Detection via LLM-Enhanced Path Feasibility Analysis

Xueying Du, Kai Yu, Chong Wang +6

cs.SE2019

Characterizing and Detecting CUDA Program Bugs

Mingyuan Wu, Husheng Zhou, Lingming Zhang +2

cs.AI2026

SwarmResearch: Orchestrating Coding Agents for Open-Ended Discovery

Yuvraj Virk, Zack Edds, Chunqiu Steven Xia +1

cs.LG2025

SEC-bench: Automated Benchmarking of LLM Agents on Real-World Software Security Tasks

Hwiwon Lee, Ziqi Zhang, Hanxiao Lu +1

cs.SE2018

Practical Program Repair via Bytecode Mutation

Ali Ghanbari, Lingming Zhang

cs.SE2025

Large Language Model-Based Agents for Software Engineering: A Survey

Junwei Liu, Kaixin Wang, Yixuan Chen +4

cs.SE2025

TESTEVAL: Benchmarking Large Language Models for Test Case Generation

Wenhan Wang, Chenyuan Yang, Zhijie Wang +6

cs.SE2023

Is Your Code Generated by ChatGPT Really Correct? Rigorous Evaluation of Large Language Models for Code Generation

Jiawei Liu, Chunqiu Steven Xia, Yuyao Wang +1