Publications (40)
SmartSnap: Proactive Evidence Seeking for Self-Verifying Agents
Shaofei Cai, Yulei Qin, Haojia Lin +10
Phase I analysis of hidden operating status for wind turbine
Yuchen Shi, Nan Chen
Youtu-Agent: Scaling Agent Productivity with Automated Generation and Hybrid Policy Optimization
Yuchen Shi, Yuzheng Cai, Siqi Cai +15
LTD-Bench: Evaluating Large Language Models by Letting Them Draw
Liuhao Lin, Ke Li, Zihan Xu +5
Tencent WorkBuddy Bench: A Multi-Domain Coding-Agent Benchmark with Contamination-Resistant Task Construction
Tencent WorkBuddy Bench Team, Siqi Cai, Shaopeng Chen +35
Towards Fault Tolerance in Multi-Agent Reinforcement Learning
Yuchen Shi, Huaxin Pei, Liang Feng +2
FedGMI: Generative Model-Driven Federated Learning for Probabilistic Mixture Inference
Qijun Hou, Yuchen Shi, Pingyi Fan +1
LUCY: Linguistic Understanding and Control Yielding Early Stage of Her
Heting Gao, Hang Shao, Xiong Wang +12
Conditional Kernel Density Estimation Considering Autocorrelation for Renewable Energy Probabilistic Modeling
Yuchen Shi, Nan Chen
CoopASD: Cooperative Machine Anomalous Sound Detection with Privacy Concerns
Anbai Jiang, Yuchen Shi, Pingyi Fan +2
CSC: Turning the Adversary's Poison against Itself
Yuchen Shi, Xin Guo, Huajie Chen +3
Incentivizing Reasoning for Advanced Instruction-Following of Large Language Models
Yulei Qin, Gang Li, Zongyi Li +6
ToNER: Type-oriented Named Entity Recognition with Generative Language Model
Guochao Jiang, Ziqin Luo, Yuchen Shi +3
Asymptotic Compatibility of the Approximate-Ball Finite Element Method for 2D Nonlocal Poisson Problem with Neumann Boundary Conditions
Yuchen Shi, Jihong Wang, Jiwei Zhang
CARSS: Cooperative Attention-guided Reinforcement Subpath Synthesis for Solving Traveling Salesman Problem
Yuchen Shi, Congying Han, Tiande Guo
Dynamic Deep Factor Graph for Multi-Agent Reinforcement Learning
Yuchen Shi, Shihong Duan, Cheng Xu +3
CUARewardBench: A Benchmark for Evaluating Reward Models on Computer-using Agent
Haojia Lin, Xiaoyu Tan, Yulei Qin +9
Federated Client Selection under Partial Visibility: A POMDP Approach with Spatio-Temporal Attention
Qijun Hou, Yuchen Shi, Pingyi Fan +1
Exploring Critical Testing Scenarios for Decision-Making Policies: An LLM Approach
Weichao Xu, Huaxin Pei, Jingxuan Yang +3
Osmosis Distillation: Model Hijacking with the Fewest Samples
Yuchen Shi, Huajie Chen, Heng Xu +6
Learn the Ropes, Then Trust the Wins: Self-imitation with Progressive Exploration for Agentic Reinforcement Learning
Yulei Qin, Xiaoyu Tan, Zhengbao He +13
Leveraging Open Knowledge for Advancing Task Expertise in Large Language Models
Yuncheng Yang, Yulei Qin, Tong Wu +9
ISFL: Federated Learning for Non-i.i.d. Data with Local Importance Sampling
Zheqi Zhu, Yuchen Shi, Pingyi Fan +2
Training-Free Group Relative Policy Optimization
Yuzheng Cai, Siqi Cai, Yuchen Shi +10
Physics-Informed Modeling and Control of Emergent Behaviors in Robot Swarms
Zixuan Jin, Wenzhuo Zhang, Shuxian Quan +4
FedNC: A Secure and Efficient Federated Learning Method with Network Coding
Yuchen Shi, Zheqi Zhu, Pingyi Fan +2
Improving Information Cascade Modeling by Social Topology and Dual Role User Dependency
Baichuan Liu, Deqing Yang, Yueyi Wang +1
Subgoal-based Hierarchical Reinforcement Learning for Multi-Agent Collaboration
Cheng Xu, Changtian Zhang, Yuchen Shi +4
P-ICL: Point In-Context Learning for Named Entity Recognition with Large Language Models
Guochao Jiang, Zepeng Ding, Yuchen Shi +1
Unleashing the Power of Data Tsunami: A Comprehensive Survey on Data Assessment and Selection for Instruction Tuning of Language Models
Yulei Qin, Yuncheng Yang, Pengcheng Guo +7
Adversarial Joint Training with Self-Attention Mechanism for Robust End-to-End Speech Recognition
Lujun Li, Yikai Kang, Yuchen Shi +3
EdgeFLow: Serverless Federated Learning via Sequential Model Migration in Edge Networks
Yuchen Shi, Qijun Hou, Pingyi Fan +1
RoRecomp: Enhancing Reasoning Efficiency via Rollout Response Recomposition in Reinforcement Learning
Gang Li, Yulei Qin, Xiaoyu Tan +6
Fault-Tolerant MARL for CAVs under Observation Perturbations for Highway On-Ramp Merging
Yuchen Shi, Huaxin Pei, Yi Zhang +1
FlowAgent: Achieving Compliance and Flexibility for Workflow Agents
Yuchen Shi, Siqi Cai, Zihan Xu +7
FedLP: Layer-wise Pruning Mechanism for Communication-Computation Efficient Federated Learning
Zheqi Zhu, Yuchen Shi, Jiajun Luo +4
Negation Triplet Extraction with Syntactic Dependency and Semantic Consistency
Yuchen Shi, Deqing Yang, Jingping Liu +3
AgentRE: An Agent-Based Framework for Navigating Complex Information Landscapes in Relation Extraction
Yuchen Shi, Guochao Jiang, Tian Qiu +1
Intelligent Resilience Testing for Decision-Making Agents with Dual-Mode Surrogate Adaptation
Jingxuan Yang, Weichao Xu, Yuchen Shi +3
NeuroPrim: An Attention-based Model for Solving NP-hard Spanning Tree Problems
Yuchen Shi, Congying Han, Tiande Guo