Publications (161)
VisR-Bench: An Empirical Study on Visual Retrieval-Augmented Generation for Multilingual Long Document Understanding
Jian Chen, Ming Li, Jihyung Kil +6
Towards Improving Long-Tail Entity Predictions in Temporal Knowledge Graphs through Global Similarity and Weighted Sampling
Mehrnoosh Mirtaheri, Ryan A. Rossi, Sungchul Kim +4
Yuan 2.0-M32: Mixture of Experts with Attention Router
Shaohua Wu, Jiangang Luo, Xi Chen +12
Weakly Supervised Temporal Convolutional Networks for Fine-grained Surgical Activity Recognition
Sanat Ramesh, Diego Dall'Alba, Cristians Gonzalez +6
ThinkRouter: Efficient Reasoning via Routing Thinking between Latent and Discrete Spaces
Xin Xu, Tong Yu, Xiang Chen +3
A Survey of Foundation Model-Powered Recommender Systems: From Feature-Based, Generative to Agentic Paradigms
Chengkai Huang, Hongtao Huang, Tong Yu +6
Diversify-verify-adapt: Efficient and Robust Retrieval-Augmented Ambiguous Question Answering
Yeonjun In, Sungchul Kim, Ryan A. Rossi +4
Survey of User Interface Design and Interaction Techniques in Generative AI Applications
Reuben Luera, Ryan A. Rossi, Alexa Siu +10
Explainable Chain-of-Thought Reasoning: An Empirical Analysis on State-Aware Reasoning Dynamics
Sheldon Yu, Yuxin Xiong, Junda Wu +6
Causal Discovery-Driven Change Point Detection in Time Series
Shanyun Gao, Raghavendra Addanki, Tong Yu +2
Interactive Visualization Recommendation with Hier-SUCB
Songwen Hu, Ryan A. Rossi, Tong Yu +4
AMPS: Adaptive Modality Preference Steering via Functional Entropy
Zihan Huang, Xintong Li, Rohan Surana +5
Learning from a tiny dataset of manual annotations: a teacher/student approach for surgical phase recognition
Tong Yu, Didier Mutter, Jacques Marescaux +1
A Personalized Conversational Benchmark: Towards Simulating Personalized Conversations
Li Li, Peilin Cai, Ryan A. Rossi +21
A Survey of Small Language Models
Chien Van Nguyen, Xuan Shen, Ryan Aponte +25
Comparative Validation of Machine Learning Algorithms for Surgical Workflow and Skill Analysis with the HeiChole Benchmark
Martin Wagner, Beat-Peter Müller-Stich, Anna Kisilenko +38
Foundation Models for Recommender Systems: A Survey and New Perspectives
Chengkai Huang, Tong Yu, Kaige Xie +3
Beyond Chain-of-Thought: A Survey of Chain-of-X Paradigms for LLMs
Yu Xia, Rui Wang, Xu Liu +5
Understanding How Paper Writers Use AI-Generated Captions in Figure Caption Writing
Ho Yin, Ng, Ting-Yao Hsu +6
Cache-Craft: Managing Chunk-Caches for Efficient Retrieval-Augmented Generation
Shubham Agarwal, Sai Sundaresan, Subrata Mitra +6
F-GRPO: Factorized Group-Relative Policy Optimization for Unified Candidate Generation and Ranking
Rohan Surana, Gagan Mundada, Junda Wu +9
Superconductivity in Li6P electride
Ziyuan Zhao, Shoutao Zhang, Tong Yu +3
Rendezvous: Attention Mechanisms for the Recognition of Surgical Action Triplets in Endoscopic Videos
Chinedu Innocent Nwoye, Tong Yu, Cristians Gonzalez +5
ChordMixer: A Scalable Neural Attention Model for Sequences with Different Lengths
Ruslan Khalitov, Tong Yu, Lei Cheng +1
ActPlane: Programmable OS-Level Policy Enforcement for Agent Harnesses
Yusheng Zheng, Tianyuan Wu, Quanzhi Fu +6
Filesystem-Based Memory for LLM Agents: Organization, Evolution, and Sustainability
Sizhe Zhou, Sheldon Yu, Hui Wei +8
The paper systematically investigates how large language model agents can use a filesystem of markdown files as long‑term memory, examining different organization strategies, tools…
Bundle MCR: Towards Conversational Bundle Recommendation
Zhankui He, Handong Zhao, Tong Yu +3
Federated Online Clustering of Bandits
Xutong Liu, Haoru Zhao, Tong Yu +2
Dynamic Exploitation Gaussian Bare-Bones Bat Algorithm for Optimal Reactive Power Dispatch to Improve the Safety and Stability of Power System
Zhaoyang Qu, Yunchang Dong, Sylvère Mugemanyi +6
DocArena: Turning Raw Documents into Controllable Training Environments for Document Search Agents
Jiamian Wang, Ruiyi Zhang, Tong Yu +5
Mitigating Forgetting Between Supervised and Reinforcement Learning Yields Stronger Reasoners
Xiangchi Yuan, Xiang Chen, Tong Yu +4
bpftime: userspace eBPF Runtime for Uprobe, Syscall and Kernel-User Interactions
Yusheng Zheng, Tong Yu, Yiwei Yang +3
DrunkAgent: Stealthy Memory Corruption in LLM-Powered Recommender Agents
Shiyi Yang, Zhibo Hu, Xinshu Li +5
How Hard Does It Think? Analyzing Step-Aware Reasoning Energy in LLM Chain-of-Thought Trajectories
Hui Wei, Junda Wu, Sheldon Yu +8
Can We Break LLMs Out of Self-Loops? Fine-Grained Reasoning Control with Activation Steering
Sheldon Yu, Tong Yu, Xunyi Jiang +6
Yuan-TecSwin: A text conditioned Diffusion model with Swin-transformer blocks
Shaohua Wu, Tong Yu, Shenling Wang +1
CodeLutra: Boosting LLM Code Generation via Preference-Guided Refinement
Leitian Tao, Xiang Chen, Tong Yu +4
Federated Retrieval Augmented Generation for Multi-Product Question Answering
Parshin Shojaee, Sai Sree Harsha, Dan Luo +3
Several transformation formulas involving bilateral basic hypergeometric series
Chuanan Wei, Tong Yu
Which LLM to Play? Convergence-Aware Online Model Selection with Time-Increasing Bandits
Yu Xia, Fang Kong, Tong Yu +4
Fairness-Aware Graph Neural Networks: A Survey
April Chen, Ryan A. Rossi, Namyong Park +6
Skill-CMIB: Multimodal Agent Skill for Consistent Action via Conditional Multimodal Information Bottleneck
Zihan Huang, Junda Wu, Tong Yu +6
OCEAN: Offline Chain-of-thought Evaluation and Alignment in Large Language Models
Junda Wu, Xintong Li, Ruoyu Wang +9
Reinforced Approximate Exploratory Data Analysis
Shaddy Garg, Subrata Mitra, Tong Yu +2
Classification of Long Sequential Data using Circular Dilated Convolutional Neural Networks
Lei Cheng, Ruslan Khalitov, Tong Yu +1
Label-Retrieval-Augmented Diffusion Models for Learning from Noisy Labels
Jian Chen, Ruiyi Zhang, Tong Yu +4
Comparison-based Conversational Recommender System with Relative Bandit Feedback
Zhihui Xie, Tong Yu, Canzhe Zhao +1
SV-RAG: LoRA-Contextualizing Adaptation of MLLMs for Long Document Understanding
Jian Chen, Ruiyi Zhang, Yufan Zhou +6
VipAct: Visual-Perception Enhancement via Specialized VLM Agent Collaboration and Tool-use
Zhehao Zhang, Ryan Rossi, Tong Yu +7
Generate, Filter, Control, Replay: A Comprehensive Survey of Rollout Strategies for LLM Reinforcement Learning
Rohan Surana, Gagan Mundada, Xunyi Jiang +19
ARTIST: Improving the Generation of Text-rich Images with Disentangled Diffusion Models and Large Language Models
Jianyi Zhang, Yufan Zhou, Jiuxiang Gu +5
Precise Attribute Intensity Control in Large Language Models via Targeted Representation Editing
Rongzhi Zhang, Liqin Ye, Yuzhao Heng +5
AgentSight: System-Level Observability for AI Agents Using eBPF
Yusheng Zheng, Yanpeng Hu, Tong Yu +1
Listwise Preference Diffusion Optimization for User Behavior Trajectories Prediction
Hongtao Huang, Chengkai Huang, Junda Wu +3
Five Years of SciCap: What We Learned and Future Directions for Scientific Figure Captioning
Ting-Hao 'Kenneth' Huang, Ryan A. Rossi, Sungchul Kim +5
Encode the Unseen: Predictive Video Hashing for Scalable Mid-Stream Retrieval
Tong Yu, Nicolas Padoy
GUI Agents: A Survey
Dang Nguyen, Jian Chen, Yu Wang +27
Towards Agentic Recommender Systems in the Era of Multimodal Large Language Models
Chengkai Huang, Junda Wu, Yu Xia +9
Offline-to-Online Reinforcement Learning with Classifier-Free Diffusion Generation
Xiao Huang, Xu Liu, Enze Zhang +2
The Closeness of In-Context Learning and Weight Shifting for Softmax Regression
Shuai Li, Zhao Song, Yu Xia +2
Segmentation-Aware Generative Reinforcement Network (GRN) for Tissue Layer Segmentation in 3-D Ultrasound Images for Chronic Low-back Pain (cLBP) Assessment
Zixue Zeng, Xiaoyan Zhao, Matthew Cartier +14
WaterFlow: Learning Fast & Robust Watermarks using Stable Diffusion
Vinay Shukla, Prachee Sharma, Ryan Rossi +3
Benchmarking Reasoning Robustness in Large Language Models
Tong Yu, Yongcheng Jing, Xikun Zhang +6
RRPO: Reference-Relative Policy Optimization with Stratified Conditional Rollouts
Yuxin Xiong, Xunyi Jiang, Rohan Surana +8
From Selection to Generation: A Survey of LLM-based Active Learning
Yu Xia, Subhojyoti Mukherjee, Zhouhang Xie +31
Semi-Supervised Convolutional Neural Networks for Human Activity Recognition
Ming Zeng, Tong Yu, Xiao Wang +3
Wasm-bpf: Streamlining eBPF Deployment in Cloud Environments with WebAssembly
Yusheng Zheng, Tong Yu, Yiwei Yang +1
Augment before You Try: Knowledge-Enhanced Table Question Answering via Table Expansion
Yujian Liu, Jiabao Ji, Tong Yu +6
Representation Calibration and Uncertainty Guidance for Class-Incremental Learning based on Vision Language Model
Jiantao Tan, Peixian Ma, Tong Yu +2
Federated In-Context Learning: Iterative Refinement for Improved Answer Quality
Ruhan Wang, Zhiyong Wang, Chengkai Huang +5
Yuan3.0 Flash: An Open Multimodal Large Language Model for Enterprise Applications
YuanLab. ai, :, Shawn Wu +24
Direct Embedding of Temporal Network Edges via Time-Decayed Line Graphs
Sudhanshu Chanpuriya, Ryan A. Rossi, Sungchul Kim +5
Promise and challenges of heart chamber segmentation from non-contrast CT scans using contrastive unpaired image translation: a feasibility study
Jing Wang, Tong Yu, Hao-En Lu +5
Online Corrupted User Detection and Regret Minimization
Zhiyong Wang, Jize Xie, Tong Yu +2
Visual Prompting in Multimodal Large Language Models: A Survey
Junda Wu, Zhehao Zhang, Yu Xia +12
InfoPrompt: Information-Theoretic Soft Prompt Tuning for Natural Language Understanding
Junda Wu, Tong Yu, Rui Wang +6
Optimizing Data Delivery: Insights from User Preferences on Visuals, Tables, and Text
Reuben Luera, Ryan Rossi, Franck Dernoncourt +9
Active Learning for Direct Preference Optimization
Branislav Kveton, Xintong Li, Julian McAuley +4
Personalized Multimodal Large Language Models: A Survey
Junda Wu, Hanjia Lyu, Yu Xia +24
LaMP-Cap: Personalized Figure Caption Generation With Multimodal Figure Profiles
Ho Yin 'Sam' Ng, Ting-Yao Hsu, Aashish Anantha Ramakrishnan +8
Multi-Agent Collaborative Filtering: Orchestrating Users and Items for Agentic Recommendations
Yu Xia, Sungchul Kim, Tong Yu +2
Recognition of Instrument-Tissue Interactions in Endoscopic Videos via Action Triplets
Chinedu Innocent Nwoye, Cristians Gonzalez, Tong Yu +4
Weakly-supervised VLM-guided Partial Contrastive Learning for Visual Language Navigation
Ruoyu Wang, Tong Yu, Junda Wu +3
Large Language Models and Causal Inference in Collaboration: A Survey
Xiaoyu Liu, Paiheng Xu, Junda Wu +10
Learning to Reduce: Optimal Representations of Structured Data in Prompting Large Language Models
Younghun Lee, Sungchul Kim, Tong Yu +2
Influence Diagram Bandits: Variational Thompson Sampling for Structured Bandit Problems
Tong Yu, Branislav Kveton, Zheng Wen +2
WS-GRPO: Weakly-Supervised Group-Relative Policy Optimization for Rollout-Efficient Reasoning
Gagan Mundada, Zihan Huang, Rohan Surana +8
YUAN 2.0: A Large Language Model with Localized Filtering-based Attention
Shaohua Wu, Xudong Zhao, Shenling Wang +9
Understanding and Improving Recurrent Networks for Human Activity Recognition by Continuous Attention
Ming Zeng, Haoxiang Gao, Tong Yu +4
Diffusion Policies for Risk-Averse Behavior Modeling in Offline Reinforcement Learning
Xiaocong Chen, Siyu Wang, Tong Yu +1
Mitigating Visual Knowledge Forgetting in MLLM Instruction-tuning via Modality-decoupled Gradient Descent
Junda Wu, Yuxin Xiong, Xintong Li +9
Embedding-Informed Adaptive Retrieval-Augmented Generation of Large Language Models
Chengkai Huang, Yu Xia, Rui Wang +4
Personalization of Large Language Models: A Survey
Zhehao Zhang, Ryan A. Rossi, Branislav Kveton +18
From Documents to Dialogue: Building KG-RAG Enhanced AI Assistants
Manisha Mukherjee, Sungchul Kim, Xiang Chen +3
HetGPU: The pursuit of making binary compatibility towards GPUs
Yiwei Yang, Yusheng Zheng, Tong Yu +1
SciCapenter: Supporting Caption Composition for Scientific Figures with Machine-Generated Captions and Ratings
Ting-Yao Hsu, Chieh-Yang Huang, Shih-Hong Huang +5
Skill-R1: Agent Skill Evolution via Reinforcement Learning
Yash Vishe, Rohan Surana, Xunyi Jiang +8
Live Laparoscopic Video Retrieval with Compressed Uncertainty
Tong Yu, Pietro Mascagni, Juan Verde +3
Multi-Task Temporal Convolutional Networks for Joint Recognition of Surgical Phases and Steps in Gastric Bypass Procedures
Sanat Ramesh, Diego Dall'Alba, Cristians Gonzalez +6
Yuan 1.0: Large-Scale Pre-trained Language Model in Zero-Shot and Few-Shot Learning
Shaohua Wu, Xudong Zhao, Tong Yu +8