Publications (46)
The Generalization Ridge: Information Flow in Natural Language Generation
Ruidi Chang, Chunyuan Deng, Hanjie Chen
SportR: A Benchmark for Multimodal Large Language Model Reasoning in Sports
Haotian Xia, Haonan Ge, Junbo Zou +16
The Routing Plateau: Understanding and Breaking the Accuracy Limits of LLM Routers
Yifan Lu, Qiyue Zhang, Shenrun Zhang +4
Agentic Discovery with Active Hypothesis Exploration for Visual Recognition
Jaywon Koo, Jefferson Hernandez, Ruozhen He +3
When Embedding-Based Defenses Fail: Rethinking Safety in LLM-Based Multi-Agent Systems
Lingxi Zhang, Guangtao Zheng, Hanjie Chen
ECG-guided individual identification via PPG
Riling Wei, Hanjie Chen, Kelu Yao +3
GR-SAP: Generative Replay for Safety Alignment Preservation during Fine-Tuning
Zhouxiang Fang, Jiawei Zhou, Hanjie Chen
Generative Personality Simulation via Theory-Informed Structured Interview
Pengda Wang, Huiqi Zou, Han Jiang +5
PRISM: A Dual View of LLM Reasoning through Semantic Flow and Latent Computation
Ruidi Chang, Jiawei Zhou, Hanjie Chen
Learning Distribution-Wise Control in Representation Space for Language Models
Chunyuan Deng, Ruidi Chang, Hanjie Chen
LT2: Linear-Time Looped Transformers
Chunyuan Deng, Yizhe Zhang, Rui-Jie Zhu +4
Learning Variational Word Masks to Improve the Interpretability of Neural Text Classifiers
Hanjie Chen, Yangfeng Ji
DeepSport: A Multimodal Large Language Model for Comprehensive Sports Video Reasoning via Agentic Reinforcement Learning
Junbo Zou, Haotian Xia, Zhen Ye +5
Will the Real Linda Please Stand up...to Large Language Models? Examining the Representativeness Heuristic in LLMs
Pengda Wang, Zilin Xiao, Hanjie Chen +1
SPORTU: A Comprehensive Sports Understanding Benchmark for Multimodal Large Language Models
Haotian Xia, Zhengbang Yang, Junbo Zou +10
Self-training with Two-phase Self-augmentation for Few-shot Dialogue Generation
Wanyu Du, Hanjie Chen, Yangfeng Ji
Explaining Predictive Uncertainty by Looking Back at Model Explanations
Hanjie Chen, Wanyu Du, Yangfeng Ji
Findings of the BlackboxNLP 2025 Shared Task: Localizing Circuits and Causal Variables in Language Models
Dana Arad, Yonatan Belinkov, Hanjie Chen +5
Adversarial Training for Improving Model Robustness? Look at Both Prediction and Interpretation
Hanjie Chen, Yangfeng Ji
Explaining Neural Network Predictions on Sentence Pairs via Learning Word-Group Masks
Hanjie Chen, Song Feng, Jatin Ganhotra +4
Identifying the Source of Vulnerability in Explanation Discrepancy: A Case Study in Neural Text Classification
Ruixuan Tang, Hanjie Chen, Yangfeng Ji
Steering Information Utility in Key-Value Memory for Language Model Post-Training
Chunyuan Deng, Ruidi Chang, Hanjie Chen
Improving Interpretability via Explicit Word Interaction Graph Layer
Arshdeep Sekhon, Hanjie Chen, Aman Shrivastava +3
Political-LLM: Large Language Models in Political Science
Lincan Li, Jiaqi Li, Catherine Chen +44
Beyond Explainable AI (XAI): An Overdue Paradigm Shift and Post-XAI Research Directions
Saleh Afroogh, Syed Ishtiaque Ahmed, Petra Ahrweiler +46
KNIFE: Distilling Reasoning Knowledge From Free-Text Rationales
Aaron Chan, Zhiyuan Zeng, Wyatt Lake +3
COPU: Conformal Prediction for Uncertainty Quantification in Natural Language Generation
Sean Wang, Yicheng Jiang, Yuxin Tang +2
Learning to Reason by Analogy via Retrieval-Augmented Reinforcement Fine-Tuning
Zilin Xiao, Qi Ma, Chun-cheng Jason Chen +4
Spherical Steering: Geometry-Aware Activation Rotation for Language Models
Zejia You, Chunyuan Deng, Hanjie Chen
Pathologies of Pre-trained Language Models in Few-shot Fine-tuning
Hanjie Chen, Guoqing Zheng, Ahmed Hassan Awadallah +1
Language and Multimodal Models in Sports: A Survey of Datasets and Applications
Haotian Xia, Zhengbang Yang, Yun Zhao +7
Improving the Explainability of Neural Sentiment Classifiers via Data Augmentation
Hanjie Chen, Yangfeng Ji
MiCEval: Unveiling Multimodal Chain of Thought's Quality via Image Description and Reasoning Steps
Xiongtao Zhou, Jie He, Lanyu Chen +5
Stop Overthinking: A Survey on Efficient Reasoning for Large Language Models
Yang Sui, Yu-Neng Chuang, Guanchu Wang +9
RORA: Robust Free-Text Rationale Evaluation
Zhengping Jiang, Yining Lu, Hanjie Chen +3
Conformal Certification of Reasoning Trace Prefixes
Matt Y. Cheung, Ashok Veeraraghavan, Hanjie Chen +1
BenchCAD: A Comprehensive, Industry-Standard Benchmark for Programmatic CAD
Haozhe Zhang, Kaichen Liu, Miaomiao Chen +4
Benchmarking Large Language Models on Answering and Explaining Challenging Medical Questions
Hanjie Chen, Zhouxiang Fang, Yash Singla +1
Explainability for Large Language Models: A Survey
Haiyan Zhao, Hanjie Chen, Fan Yang +6
Generating Hierarchical Explanations on Text Classification via Feature Interaction Detection
Hanjie Chen, Guangtao Zheng, Yangfeng Ji
From Babbling to Fluency: Evaluating the Evolution of Language Models in Terms of Human Language Acquisition
Qiyuan Yang, Pengda Wang, Luke D. Plonsky +2
Language Models are Symbolic Learners in Arithmetic
Chunyuan Deng, Zhiqi Li, Roy Xie +2
Perturbing Inputs for Fragile Interpretations in Deep Natural Language Processing
Sanchit Sinha, Hanjie Chen, Arshdeep Sekhon +2
REV: Information-Theoretic Evaluation of Free-Text Rationales
Hanjie Chen, Faeze Brahman, Xiang Ren +3
Rethinking Diverse Human Preference Learning through Principal Component Analysis
Feng Luo, Rui Yang, Hao Sun +5
SAFR: Neuron Redistribution for Interpretability
Ruidi Chang, Chunyuan Deng, Hanjie Chen