Publications (109)
Empirical Analysis of Decoding Biases in Masked Diffusion Models
Pengcheng Huang, Tianming Liu, Zhenghao Liu +5
Text Matching Improves Sequential Recommendation by Reducing Popularity Biases
Zhenghao Liu, Sen Mei, Chenyan Xiong +5
Enhancing Legal Case Retrieval via Scaling High-quality Synthetic Query-Candidate Pairs
Cheng Gao, Chaojun Xiao, Zhenghao Liu +3
CMT in TREC-COVID Round 2: Mitigating the Generalization Gaps from Web to Special Domain Search
Chenyan Xiong, Zhenghao Liu, Si Sun +7
Enhancing the Patent Matching Capability of Large Language Models via the Memory Graph
Qiushi Xiong, Zhipeng Xu, Zhenghao Liu +6
DocRED: A Large-Scale Document-Level Relation Extraction Dataset
Yuan Yao, Deming Ye, Peng Li +7
UNIKIE-BENCH: Benchmarking Large Multimodal Models for Key Information Extraction in Visual Documents
Yifan Ji, Zhipeng Xu, Zhenghao Liu +7
HiEviDR-Bench: A Benchmark for Hierarchical Evidence Aggregation in Deep Research
Yubo Sun, Chunyi Peng, Yukun Yan +6
ClueAnchor: Clue-Anchored Knowledge Reasoning Exploration and Optimization for Retrieval-Augmented Generation
Hao Chen, Yukun Yan, Sen Mei +9
More Robust Dense Retrieval with Contrastive Dual Learning
Yizhi Li, Zhenghao Liu, Chenyan Xiong +1
ReCUT: Balancing Reasoning Length and Accuracy in LLMs via Stepwise Trails and Preference Optimization
Zhensheng Jin, Xinze Li, Yifan Ji +7
Say More with Less: Understanding Prompt Learning Behaviors through Gist Compression
Xinze Li, Zhenghao Liu, Chenyan Xiong +4
MatPlotAgent: Method and Evaluation for LLM-Based Agentic Scientific Data Visualization
Zhiyu Yang, Zihan Zhou, Shuo Wang +10
Legal$Î$: Enhancing Legal Reasoning in LLMs via Reinforcement Learning with Chain-of-Thought Guided Information Gain
Xin Dai, Buqiang Xu, Zhenghao Liu +5
A*-Thought: Efficient Reasoning via Bidirectional Compression for Low-Resource Settings
Xiaoang Xu, Shuo Wang, Xu Han +6
Memory Shot for Long-Term Dialogue
Chunyi Peng, Haidong Xin, Xuanshuo Sheng +7
RAGEval: Scenario Specific RAG Evaluation Dataset Generation Framework
Kunlun Zhu, Yifan Luo, Dingling Xu +10
Polar or nonpolar? That is not the question for perovskite solar cells
Boyuan Huang, Zhenghao Liu, Changwei Wu +4
Fine-grained Fact Verification with Kernel Graph Attention Network
Zhenghao Liu, Chenyan Xiong, Maosong Sun +1
Entity-Duet Neural Ranking: Understanding the Role of Knowledge Graph Semantics in Neural Information Retrieval
Zhenghao Liu, Chenyan Xiong, Maosong Sun +1
KBAlign: Efficient Self Adaptation on Specific Knowledge Bases
Zheni Zeng, Yuxuan Chen, Shi Yu +7
COAST: Enhancing the Code Debugging Ability of LLMs through Communicative Agent Based Data Synthesis
Weiqing Yang, Hanbin Wang, Zhenghao Liu +7
Coreferential Reasoning Learning for Language Representation
Deming Ye, Yankai Lin, Jiaju Du +4
RAG-DDR: Optimizing Retrieval-Augmented Generation Using Differentiable Data Rewards
Xinze Li, Sen Mei, Zhenghao Liu +9
Long-Chain Reasoning Distillation via Adaptive Prefix Alignment
Zhenghao Liu, Zhuoyang Wu, Xinze Li +6
Advancing LLM Reasoning Generalists with Preference Trees
Lifan Yuan, Ganqu Cui, Hanbin Wang +12
Toward Cross-Lingual Definition Generation for Language Learners
Cunliang Kong, Liner Yang, Tianzuo Zhang +4
Building A Coding Assistant via the Retrieval-Augmented Language Model
Xinze Li, Hanbin Wang, Zhenghao Liu +6
LexRel: Benchmarking Legal Relation Extraction for Chinese Civil Cases
Yida Cai, Ranjuexiao Hu, Huiyuan Xie +6
LexChain: Modeling Legal Reasoning Chains for Chinese Tort Case Analysis
Huiyuan Xie, Chenyang Li, Huining Zhu +4
TIAGE: A Benchmark for Topic-Shift Aware Dialog Modeling
Huiyuan Xie, Zhenghao Liu, Chenyan Xiong +2
Know More, Know Clearer: A Meta-Cognitive Framework for Knowledge Augmentation in Large Language Models
Hao Chen, Ye He, Yuchun Fan +5
ExpandR: Teaching Dense Retrievers Beyond Queries with LLM Guidance
Sijia Yao, Pengcheng Huang, Zhenghao Liu +4
Universal Vision-Language Dense Retrieval: Learning A Unified Representation Space for Multi-Modal Retrieval
Zhenghao Liu, Chenyan Xiong, Yuanhuiyi Lv +2
HIPPO: Enhancing the Table Understanding Capability of LLMs through Hybrid-Modal Preference Optimization
Haolan Wang, Zhenghao Liu, Xinze Li +7
Enhancing Dense Retrievers' Robustness with Group-level Reweighting
Peixuan Han, Zhenghao Liu, Zhiyuan Liu +1
RankCoT: Refining Knowledge for Retrieval-Augmented Generation through Ranking Chain-of-Thoughts
Mingyan Wu, Zhenghao Liu, Yukun Yan +5
Few-Shot Text Ranking with Meta Adapted Synthetic Weak Supervision
Si Sun, Yingzhuo Qian, Zhenghao Liu +5
Modeling User Viewing Flow Using Large Language Models for Article Recommendation
Zhenghao Liu, Zulong Chen, Moufeng Zhang +6
AgentCPM-Report: Interleaving Drafting and Deepening for Open-Ended Deep Research
Yishan Li, Wentong Chen, Yukun Yan +12
Toolink: Linking Toolkit Creation and Using through Chain-of-Solving on Open-Source Model
Cheng Qian, Chenyan Xiong, Zhenghao Liu +1
VisRAG: Vision-based Retrieval-augmented Generation on Multi-modality Documents
Shi Yu, Chaoyue Tang, Bokai Xu +8
ThinkNote: Enhancing Knowledge Integration and Utilization of Large Language Models via Constructivist Cognition Modeling
Zhipeng Xu, Zhenghao Liu, Yukun Yan +7
MetaMem: Evolving Meta-Memory for Knowledge Utilization through Self-Reflective Symbolic Optimization
Haidong Xin, Xinze Li, Zhenghao Liu +6
PathRAG: Pruning Graph-based Retrieval Augmented Generation with Relational Paths
Boyu Chen, Zirui Guo, Zidan Yang +5
INTERVENOR: Prompting the Coding Ability of Large Language Models with the Interactive Chain of Repair
Hanbin Wang, Zhenghao Liu, Shuo Wang +4
ReAlign: Optimizing the Visual Document Retriever with Reasoning-Guided Fine-Grained Alignment
Hao Yang, Yifan Ji, Zhipeng Xu +6
Tau-BNO: Brain Neural Operator for Tau Transport Model
Nuutti Barron, Heng Rao, Urmi Saha +6
MemoryCard: Topic-Aware Multi-Modal Clue Compression for Long-Video Question Answering
Qing Yang, Pengcheng Huang, Xinze Li +6
REFACT: Adaptive Fact Restatement for Compact and Faithful Chain-of-Thought Reasoning
Zhensheng Jin, Xin Dai, Zhenghao Liu +5
Finding What Matters: Anchoring Context Knowledge with Evolving Indices for Iterative Retrieval
Mingyan Wu, Zhenghao Liu, Xinze Li +7
UltraLink: An Open-Source Knowledge-Enhanced Multilingual Supervised Fine-tuning Dataset
Haoyu Wang, Shuo Wang, Yukun Yan +9
SHIFT: Gate-Modulated Activation Steering for Knowledge Conflict Mitigation in Retrieval-Augmented Generation
Ruochang Li, Pengcheng Huang, Zhenghao Liu +5
SEEK: Steering LLM Reasoning for RAG via Internal Reasoning Sketches
Xinze Li, Yuqing Lan, Zhenghao Liu +7
PR-CAD: Progressive Refinement for Unified Controllable and Faithful Text-to-CAD Generation with Large Language Models
Jiyuan An, Jiachen Zhao, Fan Chen +6
UltraRAG: A Modular and Automated Toolkit for Adaptive Retrieval-Augmented Generation
Yuxuan Chen, Dewen Guo, Sen Mei +12
Generalized Graph Prompt: Toward a Unification of Pre-Training and Downstream Tasks on Graphs
Xingtong Yu, Zhenghao Liu, Yuan Fang +3
Multi-Paragraph Reasoning with Knowledge-enhanced Graph Neural Network
Deming Ye, Yankai Lin, Zhenghao Liu +2
KG-Infused RAG: Augmenting Corpus-Based RAG with External Knowledge Graphs
Dingjun Wu, Yukun Yan, Zhenghao Liu +2
DeepNote: Note-Centric Deep Retrieval-Augmented Generation
Ruobing Wang, Qingfei Zhao, Yukun Yan +9
ParamMute: Suppressing Knowledge-Critical FFNs for Faithful Retrieval-Augmented Generation
Pengcheng Huang, Zhenghao Liu, Yukun Yan +8
Teaching LLMs to Learn Tool Trialing and Execution through Environment Interaction
Xingjie Gao, Pengcheng Huang, Zhenghao Liu +6
Scientific Knowledge-driven Decoding Constraints Improving the Reliability of LLMs
Maotian Ma, Zheni Zeng, Zhenghao Liu +1
Node-Time Conditional Prompt Learning In Dynamic Graphs
Xingtong Yu, Zhenghao Liu, Xinming Zhang +1
OMGEval: An Open Multilingual Generative Evaluation Benchmark for Large Language Models
Yang Liu, Meng Xu, Shuo Wang +7
HippoSpark: An On-Demand Experience System for LLM Reasoning
Jingyao Liu, Danling Meng, Chen Huang +5
MCTS: A Multi-Reference Chinese Text Simplification Dataset
Ruining Chong, Luming Lu, Liner Yang +6
CHGNN: A Semi-Supervised Contrastive Hypergraph Learning Network
Yumeng Song, Yu Gu, Tianyi Li +4
LISRec: Modeling User Preferences with Learned Item Shortcuts for Sequential Recommendation
Haidong Xin, Zhenghao Liu, Sen Mei +7
NaviRAG: Towards Active Knowledge Navigation for Retrieval-Augmented Generation
Jihao Dai, Dingjun Wu, Yuxuan Chen +4
IROTE: Human-like Traits Elicitation of Large Language Model via In-Context Self-Reflective Optimization
Yuzhuo Bai, Shitong Duan, Muhua Huang +7
CheckRLM: Effective Knowledge-Thought Coherence Checking in Retrieval-Augmented Reasoning
Dingling Xu, Ruobing Wang, Qingfei Zhao +8
Multi-Evidence based Fact Verification via A Confidential Graph Neural Network
Yuqing Lan, Zhenghao Liu, Yu Gu +4
Layout-Aware Parsing Meets Efficient LLMs: A Unified, Scalable Framework for Resume Information Extraction and Evaluation
Fanwei Zhu, Jinke Yu, Zulong Chen +6
Selective Weak Supervision for Neural Information Retrieval
Kaitao Zhang, Chenyan Xiong, Zhenghao Liu +1
Lang2Act: Fine-Grained Visual Reasoning through Self-Emergent Linguistic Toolchains
Yuqi Xiong, Chunyi Peng, Zhipeng Xu +6
Dimension Reduction for Efficient Dense Retrieval via Conditional Autoencoder
Zhenghao Liu, Han Zhang, Chenyan Xiong +3
VisRAG2.0: Mitigating Visual Hallucinations via Evidence-Guided Multi-Image Reasoning in Visual Retrieval-Augmented Generation
Yubo Sun, Chunyi Peng, Yukun Yan +6
Learning Refined Document Representations for Dense Retrieval via Deliberate Thinking
Yifan Ji, Zhipeng Xu, Zhenghao Liu +7
Benchmarking Retrieval-Augmented Generation in Multi-Modal Contexts
Zhenghao Liu, Xingsheng Zhu, Tianshuo Zhou +5
Revealing the Attention Floating Mechanism in Masked Diffusion Models
Xin Dai, Pengcheng Huang, Zhenghao Liu +6
Fusion-in-T5: Unifying Document Ranking Signals for Improved Information Retrieval
Shi Yu, Chenghao Fan, Chenyan Xiong +3
Mixture-of-Retrieval Experts for Reasoning-Guided Multimodal Knowledge Exploitation
Chunyi Peng, Zhipeng Xu, Zhenghao Liu +7
A Roadmap for Big Model
Sha Yuan, Hanyu Zhao, Shuai Zhao +97
Enhancing Long-Chain Reasoning Distillation through Error-Aware Self-Reflection
Zhuoyang Wu, Xinze Li, Zhenghao Liu +7
YACLC: A Chinese Learner Corpus with Multidimensional Annotation
Yingying Wang, Cunliang Kong, Liner Yang +8
Neural Quality Estimation with Multiple Hypotheses for Grammatical Error Correction
Zhenghao Liu, Xiaoyuan Yi, Maosong Sun +2
CC-OCR V2: Benchmarking Large Multimodal Models for Literacy in Real-world Document Processing
Zhipeng Xu, Junhao Ji, Zulong Chen +10
PersLLM: A Personified Training Approach for Large Language Models
Zheni Zeng, Jiayi Chen, Huimin Chen +5
P^3 Ranker: Mitigating the Gaps between Pre-training and Ranking Fine-tuning with Prompt-based Learning and Pre-finetuning
Xiaomeng Hu, Shi Yu, Chenyan Xiong +3
Judge as A Judge: Improving the Evaluation of Retrieval-Augmented Generation through the Judge-Consistency of Large Language Models
Shuliang Liu, Xinze Li, Zhenghao Liu +6
Inverted Channel Belts and Floodplain Clays to the East of Tempe Terra, Mars: Implications for Persistent Fluvial Activity on Early Mars
Zhenghao Liu, Yang Liu, Lu Pan +4
Chinese Short-Form Creative Content Generation via Explanation-Oriented Multi-Objective Optimization
Shanlin Zhou, Xinpeng Wang, Jianxun Lian +4
RLAIF-SPA: Structured AI Feedback for Semantic-Prosodic Alignment in Speech Synthesis
Qing Yang, Zhenghao Liu, Yangfan Du +2
KARE-RAG: Knowledge-Aware Refinement and Enhancement for RAG
Yongjian Li, HaoCheng Chu, Yukun Yan +7
Grounded Conversation Generation as Guided Traverses in Commonsense Knowledge Graphs
Houyu Zhang, Zhenghao Liu, Chenyan Xiong +1
Chunks as Arms: Multi-Armed Bandit-Guided Sampling for Long-Context LLM Preference Optimization
Shaohua Duan, Pengcheng Huang, Xinze Li +7
OpenMatch: An Open Source Library for Neu-IR Research
Zhenghao Liu, Kaitao Zhang, Chenyan Xiong +2
Explore Entity Embedding Effectiveness in Entity Retrieval
Zhenghao Liu, Chenyan Xiong, Maosong Sun +1
From Text to CQL: Bridging Natural Language and Corpus Search Engine
Luming Lu, Jiyuan An, Yujie Wang +8