papers

Publications (161)

cs.CV2025

VisR-Bench: An Empirical Study on Visual Retrieval-Augmented Generation for Multilingual Long Document Understanding

Jian Chen, Ming Li, Jihyung Kil +6

cs.AI2025

Towards Improving Long-Tail Entity Predictions in Temporal Knowledge Graphs through Global Similarity and Weighted Sampling

Mehrnoosh Mirtaheri, Ryan A. Rossi, Sungchul Kim +4

cs.AI2024

Yuan 2.0-M32: Mixture of Experts with Attention Router

Shaohua Wu, Jiangang Luo, Xi Chen +12

cs.CV2023

Weakly Supervised Temporal Convolutional Networks for Fine-grained Surgical Activity Recognition

Sanat Ramesh, Diego Dall'Alba, Cristians Gonzalez +6

cs.AI2026

ThinkRouter: Efficient Reasoning via Routing Thinking between Latent and Discrete Spaces

Xin Xu, Tong Yu, Xiang Chen +3

cs.IR2025

A Survey of Foundation Model-Powered Recommender Systems: From Feature-Based, Generative to Agentic Paradigms

Chengkai Huang, Hongtao Huang, Tong Yu +6

cs.CL2025

Diversify-verify-adapt: Efficient and Robust Retrieval-Augmented Ambiguous Question Answering

Yeonjun In, Sungchul Kim, Ryan A. Rossi +4

cs.HC2024

Survey of User Interface Design and Interaction Techniques in Generative AI Applications

Reuben Luera, Ryan A. Rossi, Alexa Siu +10

cs.CL2026

Explainable Chain-of-Thought Reasoning: An Empirical Analysis on State-Aware Reasoning Dynamics

Sheldon Yu, Yuxin Xiong, Junda Wu +6

cs.LG2025

Causal Discovery-Driven Change Point Detection in Time Series

Shanyun Gao, Raghavendra Addanki, Tong Yu +2

cs.IR2025

Interactive Visualization Recommendation with Hier-SUCB

Songwen Hu, Ryan A. Rossi, Tong Yu +4

cs.LG2026

AMPS: Adaptive Modality Preference Steering via Functional Entropy

Zihan Huang, Xintong Li, Rohan Surana +5

cs.LG2020

Learning from a tiny dataset of manual annotations: a teacher/student approach for surgical phase recognition

Tong Yu, Didier Mutter, Jacques Marescaux +1

cs.CL2025

A Personalized Conversational Benchmark: Towards Simulating Personalized Conversations

Li Li, Peilin Cai, Ryan A. Rossi +21

cs.CL2024

A Survey of Small Language Models

Chien Van Nguyen, Xuan Shen, Ryan Aponte +25

eess.IV2021

Comparative Validation of Machine Learning Algorithms for Surgical Workflow and Skill Analysis with the HeiChole Benchmark

Martin Wagner, Beat-Peter Müller-Stich, Anna Kisilenko +38

cs.IR2024

Foundation Models for Recommender Systems: A Survey and New Perspectives

Chengkai Huang, Tong Yu, Kaige Xie +3

cs.CL2025

Beyond Chain-of-Thought: A Survey of Chain-of-X Paradigms for LLMs

Yu Xia, Rui Wang, Xu Liu +5

cs.HC2025

Understanding How Paper Writers Use AI-Generated Captions in Figure Caption Writing

Ho Yin, Ng, Ting-Yao Hsu +6

cs.DC2025

Cache-Craft: Managing Chunk-Caches for Efficient Retrieval-Augmented Generation

Shubham Agarwal, Sai Sundaresan, Subrata Mitra +6

cs.LG2026

F-GRPO: Factorized Group-Relative Policy Optimization for Unified Candidate Generation and Ranking

Rohan Surana, Gagan Mundada, Junda Wu +9

cond-mat.supr-con2018

Superconductivity in Li6P electride

Ziyuan Zhao, Shoutao Zhang, Tong Yu +3

cs.CV2022

Rendezvous: Attention Mechanisms for the Recognition of Surgical Action Triplets in Endoscopic Videos

Chinedu Innocent Nwoye, Tong Yu, Cristians Gonzalez +5

cs.LG2023

ChordMixer: A Scalable Neural Attention Model for Sequences with Different Lengths

Ruslan Khalitov, Tong Yu, Lei Cheng +1

cs.OS2026

ActPlane: Programmable OS-Level Policy Enforcement for Agent Harnesses

Yusheng Zheng, Tianyuan Wu, Quanzhi Fu +6

cs.CL2026

Filesystem-Based Memory for LLM Agents: Organization, Evolution, and Sustainability

Sizhe Zhou, Sheldon Yu, Hui Wei +8

The paper systematically investigates how large language model agents can use a filesystem of markdown files as long‑term memory, examining different organization strategies, tools…

#llm agents#filesystem memory#memory organization#retrieval efficiency
cs.IR2022

Bundle MCR: Towards Conversational Bundle Recommendation

Zhankui He, Handong Zhao, Tong Yu +3

cs.LG2022

Federated Online Clustering of Bandits

Xutong Liu, Haoru Zhao, Tong Yu +2

eess.SY2021

Dynamic Exploitation Gaussian Bare-Bones Bat Algorithm for Optimal Reactive Power Dispatch to Improve the Safety and Stability of Power System

Zhaoyang Qu, Yunchang Dong, Sylvère Mugemanyi +6

cs.CV2026

DocArena: Turning Raw Documents into Controllable Training Environments for Document Search Agents

Jiamian Wang, Ruiyi Zhang, Tong Yu +5

cs.CL2025

Mitigating Forgetting Between Supervised and Reinforcement Learning Yields Stronger Reasoners

Xiangchi Yuan, Xiang Chen, Tong Yu +4

cs.OS2023

bpftime: userspace eBPF Runtime for Uprobe, Syscall and Kernel-User Interactions

Yusheng Zheng, Tong Yu, Yiwei Yang +3

cs.CR2025

DrunkAgent: Stealthy Memory Corruption in LLM-Powered Recommender Agents

Shiyi Yang, Zhibo Hu, Xinshu Li +5

cs.AI2026

How Hard Does It Think? Analyzing Step-Aware Reasoning Energy in LLM Chain-of-Thought Trajectories

Hui Wei, Junda Wu, Sheldon Yu +8

cs.AI2026

Can We Break LLMs Out of Self-Loops? Fine-Grained Reasoning Control with Activation Steering

Sheldon Yu, Tong Yu, Xunyi Jiang +6

cs.CV2025

Yuan-TecSwin: A text conditioned Diffusion model with Swin-transformer blocks

Shaohua Wu, Tong Yu, Shenling Wang +1

cs.CL2025

CodeLutra: Boosting LLM Code Generation via Preference-Guided Refinement

Leitian Tao, Xiang Chen, Tong Yu +4

cs.CL2025

Federated Retrieval Augmented Generation for Multi-Product Question Answering

Parshin Shojaee, Sai Sree Harsha, Dan Luo +3

math.CO2021

Several transformation formulas involving bilateral basic hypergeometric series

Chuanan Wei, Tong Yu

cs.LG2024

Which LLM to Play? Convergence-Aware Online Model Selection with Time-Increasing Bandits

Yu Xia, Fang Kong, Tong Yu +4

cs.LG2023

Fairness-Aware Graph Neural Networks: A Survey

April Chen, Ryan A. Rossi, Namyong Park +6

cs.LG2026

Skill-CMIB: Multimodal Agent Skill for Consistent Action via Conditional Multimodal Information Bottleneck

Zihan Huang, Junda Wu, Tong Yu +6

cs.LG2024

OCEAN: Offline Chain-of-thought Evaluation and Alignment in Large Language Models

Junda Wu, Xintong Li, Ruoyu Wang +9

cs.LG2022

Reinforced Approximate Exploratory Data Analysis

Shaddy Garg, Subrata Mitra, Tong Yu +2

cs.LG2022

Classification of Long Sequential Data using Circular Dilated Convolutional Neural Networks

Lei Cheng, Ruslan Khalitov, Tong Yu +1

cs.LG2023

Label-Retrieval-Augmented Diffusion Models for Learning from Noisy Labels

Jian Chen, Ruiyi Zhang, Tong Yu +4

cs.IR2022

Comparison-based Conversational Recommender System with Relative Bandit Feedback

Zhihui Xie, Tong Yu, Canzhe Zhao +1

cs.CV2025

SV-RAG: LoRA-Contextualizing Adaptation of MLLMs for Long Document Understanding

Jian Chen, Ruiyi Zhang, Yufan Zhou +6

cs.CL2025

VipAct: Visual-Perception Enhancement via Specialized VLM Agent Collaboration and Tool-use

Zhehao Zhang, Ryan Rossi, Tong Yu +7

cs.LG2026

Generate, Filter, Control, Replay: A Comprehensive Survey of Rollout Strategies for LLM Reinforcement Learning

Rohan Surana, Gagan Mundada, Xunyi Jiang +19

cs.CV2024

ARTIST: Improving the Generation of Text-rich Images with Disentangled Diffusion Models and Large Language Models

Jianyi Zhang, Yufan Zhou, Jiuxiang Gu +5

cs.AI2026

Precise Attribute Intensity Control in Large Language Models via Targeted Representation Editing

Rongzhi Zhang, Liqin Ye, Yuzhao Heng +5

cs.OS2025

AgentSight: System-Level Observability for AI Agents Using eBPF

Yusheng Zheng, Yanpeng Hu, Tong Yu +1

cs.IR2025

Listwise Preference Diffusion Optimization for User Behavior Trajectories Prediction

Hongtao Huang, Chengkai Huang, Junda Wu +3

cs.CL2026

Five Years of SciCap: What We Learned and Future Directions for Scientific Figure Captioning

Ting-Hao 'Kenneth' Huang, Ryan A. Rossi, Sungchul Kim +5

cs.CV2020

Encode the Unseen: Predictive Video Hashing for Scalable Mid-Stream Retrieval

Tong Yu, Nicolas Padoy

cs.AI2025

GUI Agents: A Survey

Dang Nguyen, Jian Chen, Yu Wang +27

cs.AI2025

Towards Agentic Recommender Systems in the Era of Multimodal Large Language Models

Chengkai Huang, Junda Wu, Yu Xia +9

cs.LG2025

Offline-to-Online Reinforcement Learning with Classifier-Free Diffusion Generation

Xiao Huang, Xu Liu, Enze Zhang +2

cs.CL2023

The Closeness of In-Context Learning and Weight Shifting for Softmax Regression

Shuai Li, Zhao Song, Yu Xia +2

cs.CV2025

Segmentation-Aware Generative Reinforcement Network (GRN) for Tissue Layer Segmentation in 3-D Ultrasound Images for Chronic Low-back Pain (cLBP) Assessment

Zixue Zeng, Xiaoyan Zhao, Matthew Cartier +14

eess.IV2025

WaterFlow: Learning Fast & Robust Watermarks using Stable Diffusion

Vinay Shukla, Prachee Sharma, Ryan Rossi +3

cs.AI2025

Benchmarking Reasoning Robustness in Large Language Models

Tong Yu, Yongcheng Jing, Xikun Zhang +6

cs.LG2026

RRPO: Reference-Relative Policy Optimization with Stratified Conditional Rollouts

Yuxin Xiong, Xunyi Jiang, Rohan Surana +8

cs.LG2025

From Selection to Generation: A Survey of LLM-based Active Learning

Yu Xia, Subhojyoti Mukherjee, Zhouhang Xie +31

cs.LG2018

Semi-Supervised Convolutional Neural Networks for Human Activity Recognition

Ming Zeng, Tong Yu, Xiao Wang +3

cs.OS2024

Wasm-bpf: Streamlining eBPF Deployment in Cloud Environments with WebAssembly

Yusheng Zheng, Tong Yu, Yiwei Yang +1

cs.CL2024

Augment before You Try: Knowledge-Enhanced Table Question Answering via Table Expansion

Yujian Liu, Jiabao Ji, Tong Yu +6

cs.CV2025

Representation Calibration and Uncertainty Guidance for Class-Incremental Learning based on Vision Language Model

Jiantao Tan, Peixian Ma, Tong Yu +2

cs.LG2025

Federated In-Context Learning: Iterative Refinement for Improved Answer Quality

Ruhan Wang, Zhiyong Wang, Chengkai Huang +5

cs.AI2026

Yuan3.0 Flash: An Open Multimodal Large Language Model for Enterprise Applications

YuanLab. ai, :, Shawn Wu +24

cs.LG2022

Direct Embedding of Temporal Network Edges via Time-Decayed Line Graphs

Sudhanshu Chanpuriya, Ryan A. Rossi, Sungchul Kim +5

eess.IV2026

Promise and challenges of heart chamber segmentation from non-contrast CT scans using contrastive unpaired image translation: a feasibility study

Jing Wang, Tong Yu, Hao-En Lu +5

cs.LG2023

Online Corrupted User Detection and Regret Minimization

Zhiyong Wang, Jize Xie, Tong Yu +2

cs.LG2024

Visual Prompting in Multimodal Large Language Models: A Survey

Junda Wu, Zhehao Zhang, Yu Xia +12

cs.CL2023

InfoPrompt: Information-Theoretic Soft Prompt Tuning for Natural Language Understanding

Junda Wu, Tong Yu, Rui Wang +6

cs.HC2024

Optimizing Data Delivery: Insights from User Preferences on Visuals, Tables, and Text

Reuben Luera, Ryan Rossi, Franck Dernoncourt +9

cs.LG2025

Active Learning for Direct Preference Optimization

Branislav Kveton, Xintong Li, Julian McAuley +4

cs.CV2024

Personalized Multimodal Large Language Models: A Survey

Junda Wu, Hanjia Lyu, Yu Xia +24

cs.CL2025

LaMP-Cap: Personalized Figure Caption Generation With Multimodal Figure Profiles

Ho Yin 'Sam' Ng, Ting-Yao Hsu, Aashish Anantha Ramakrishnan +8

cs.CL2026

Multi-Agent Collaborative Filtering: Orchestrating Users and Items for Agentic Recommendations

Yu Xia, Sungchul Kim, Tong Yu +2

eess.IV2020

Recognition of Instrument-Tissue Interactions in Endoscopic Videos via Action Triplets

Chinedu Innocent Nwoye, Cristians Gonzalez, Tong Yu +4

cs.CV2025

Weakly-supervised VLM-guided Partial Contrastive Learning for Visual Language Navigation

Ruoyu Wang, Tong Yu, Junda Wu +3

cs.CL2025

Large Language Models and Causal Inference in Collaboration: A Survey

Xiaoyu Liu, Paiheng Xu, Junda Wu +10

cs.CL2024

Learning to Reduce: Optimal Representations of Structured Data in Prompting Large Language Models

Younghun Lee, Sungchul Kim, Tong Yu +2

cs.LG2020

Influence Diagram Bandits: Variational Thompson Sampling for Structured Bandit Problems

Tong Yu, Branislav Kveton, Zheng Wen +2

cs.LG2026

WS-GRPO: Weakly-Supervised Group-Relative Policy Optimization for Rollout-Efficient Reasoning

Gagan Mundada, Zihan Huang, Rohan Surana +8

cs.CL2023

YUAN 2.0: A Large Language Model with Localized Filtering-based Attention

Shaohua Wu, Xudong Zhao, Shenling Wang +9

cs.LG2018

Understanding and Improving Recurrent Networks for Human Activity Recognition by Continuous Attention

Ming Zeng, Haoxiang Gao, Tong Yu +4

cs.LG2025

Diffusion Policies for Risk-Averse Behavior Modeling in Offline Reinforcement Learning

Xiaocong Chen, Siyu Wang, Tong Yu +1

cs.LG2026

Mitigating Visual Knowledge Forgetting in MLLM Instruction-tuning via Modality-decoupled Gradient Descent

Junda Wu, Yuxin Xiong, Xintong Li +9

cs.CL2024

Embedding-Informed Adaptive Retrieval-Augmented Generation of Large Language Models

Chengkai Huang, Yu Xia, Rui Wang +4

cs.CL2025

Personalization of Large Language Models: A Survey

Zhehao Zhang, Ryan A. Rossi, Branislav Kveton +18

cs.IR2025

From Documents to Dialogue: Building KG-RAG Enhanced AI Assistants

Manisha Mukherjee, Sungchul Kim, Xiang Chen +3

cs.AR2025

HetGPU: The pursuit of making binary compatibility towards GPUs

Yiwei Yang, Yusheng Zheng, Tong Yu +1

cs.HC2024

SciCapenter: Supporting Caption Composition for Scientific Figures with Machine-Generated Captions and Ratings

Ting-Yao Hsu, Chieh-Yang Huang, Shih-Hong Huang +5

cs.LG2026

Skill-R1: Agent Skill Evolution via Reinforcement Learning

Yash Vishe, Rohan Surana, Xunyi Jiang +8

eess.IV2023

Live Laparoscopic Video Retrieval with Compressed Uncertainty

Tong Yu, Pietro Mascagni, Juan Verde +3

cs.CV2021

Multi-Task Temporal Convolutional Networks for Joint Recognition of Surgical Phases and Steps in Gastric Bypass Procedures

Sanat Ramesh, Diego Dall'Alba, Cristians Gonzalez +6

cs.CL2021

Yuan 1.0: Large-Scale Pre-trained Language Model in Zero-Shot and Few-Shot Learning

Shaohua Wu, Xudong Zhao, Tong Yu +8