NewEvery arXiv paper, its researchers & institutions — mapped.
papers

Publications (109)

cs.AI2026

Empirical Analysis of Decoding Biases in Masked Diffusion Models

Pengcheng Huang, Tianming Liu, Zhenghao Liu +5

cs.IR2023

Text Matching Improves Sequential Recommendation by Reducing Popularity Biases

Zhenghao Liu, Sen Mei, Chenyan Xiong +5

cs.IR2024

Enhancing Legal Case Retrieval via Scaling High-quality Synthetic Query-Candidate Pairs

Cheng Gao, Chaojun Xiao, Zhenghao Liu +3

cs.IR2020

CMT in TREC-COVID Round 2: Mitigating the Generalization Gaps from Web to Special Domain Search

Chenyan Xiong, Zhenghao Liu, Si Sun +7

cs.IR2025

Enhancing the Patent Matching Capability of Large Language Models via the Memory Graph

Qiushi Xiong, Zhipeng Xu, Zhenghao Liu +6

cs.CL2019

DocRED: A Large-Scale Document-Level Relation Extraction Dataset

Yuan Yao, Deming Ye, Peng Li +7

cs.CV2026

UNIKIE-BENCH: Benchmarking Large Multimodal Models for Key Information Extraction in Visual Documents

Yifan Ji, Zhipeng Xu, Zhenghao Liu +7

cs.IR2026

HiEviDR-Bench: A Benchmark for Hierarchical Evidence Aggregation in Deep Research

Yubo Sun, Chunyi Peng, Yukun Yan +6

cs.CL2025

ClueAnchor: Clue-Anchored Knowledge Reasoning Exploration and Optimization for Retrieval-Augmented Generation

Hao Chen, Yukun Yan, Sen Mei +9

cs.IR2021

More Robust Dense Retrieval with Contrastive Dual Learning

Yizhi Li, Zhenghao Liu, Chenyan Xiong +1

cs.CL2025

ReCUT: Balancing Reasoning Length and Accuracy in LLMs via Stepwise Trails and Preference Optimization

Zhensheng Jin, Xinze Li, Yifan Ji +7

cs.CL2024

Say More with Less: Understanding Prompt Learning Behaviors through Gist Compression

Xinze Li, Zhenghao Liu, Chenyan Xiong +4

cs.CL2024

MatPlotAgent: Method and Evaluation for LLM-Based Agentic Scientific Data Visualization

Zhiyu Yang, Zihan Zhou, Shuo Wang +10

cs.CL2026

Legal$Δ$: Enhancing Legal Reasoning in LLMs via Reinforcement Learning with Chain-of-Thought Guided Information Gain

Xin Dai, Buqiang Xu, Zhenghao Liu +5

cs.CL2025

A*-Thought: Efficient Reasoning via Bidirectional Compression for Low-Resource Settings

Xiaoang Xu, Shuo Wang, Xu Han +6

cs.IR2026

Memory Shot for Long-Term Dialogue

Chunyi Peng, Haidong Xin, Xuanshuo Sheng +7

cs.CL2025

RAGEval: Scenario Specific RAG Evaluation Dataset Generation Framework

Kunlun Zhu, Yifan Luo, Dingling Xu +10

physics.app-ph2021

Polar or nonpolar? That is not the question for perovskite solar cells

Boyuan Huang, Zhenghao Liu, Changwei Wu +4

cs.CL2021

Fine-grained Fact Verification with Kernel Graph Attention Network

Zhenghao Liu, Chenyan Xiong, Maosong Sun +1

cs.IR2018

Entity-Duet Neural Ranking: Understanding the Role of Knowledge Graph Semantics in Neural Information Retrieval

Zhenghao Liu, Chenyan Xiong, Maosong Sun +1

cs.CL2025

KBAlign: Efficient Self Adaptation on Specific Knowledge Bases

Zheni Zeng, Yuxuan Chen, Shi Yu +7

cs.SE2025

COAST: Enhancing the Code Debugging Ability of LLMs through Communicative Agent Based Data Synthesis

Weiqing Yang, Hanbin Wang, Zhenghao Liu +7

cs.CL2020

Coreferential Reasoning Learning for Language Representation

Deming Ye, Yankai Lin, Jiaju Du +4

cs.CL2025

RAG-DDR: Optimizing Retrieval-Augmented Generation Using Differentiable Data Rewards

Xinze Li, Sen Mei, Zhenghao Liu +9

cs.CL2026

Long-Chain Reasoning Distillation via Adaptive Prefix Alignment

Zhenghao Liu, Zhuoyang Wu, Xinze Li +6

cs.AI2024

Advancing LLM Reasoning Generalists with Preference Trees

Lifan Yuan, Ganqu Cui, Hanbin Wang +12

cs.CL2020

Toward Cross-Lingual Definition Generation for Language Learners

Cunliang Kong, Liner Yang, Tianzuo Zhang +4

cs.CL2024

Building A Coding Assistant via the Retrieval-Augmented Language Model

Xinze Li, Hanbin Wang, Zhenghao Liu +6

cs.CL2026

LexRel: Benchmarking Legal Relation Extraction for Chinese Civil Cases

Yida Cai, Ranjuexiao Hu, Huiyuan Xie +6

cs.CL2025

LexChain: Modeling Legal Reasoning Chains for Chinese Tort Case Analysis

Huiyuan Xie, Chenyang Li, Huining Zhu +4

cs.CL2021

TIAGE: A Benchmark for Topic-Shift Aware Dialog Modeling

Huiyuan Xie, Zhenghao Liu, Chenyan Xiong +2

cs.CL2026

Know More, Know Clearer: A Meta-Cognitive Framework for Knowledge Augmentation in Large Language Models

Hao Chen, Ye He, Yuchun Fan +5

cs.IR2025

ExpandR: Teaching Dense Retrievers Beyond Queries with LLM Guidance

Sijia Yao, Pengcheng Huang, Zhenghao Liu +4

cs.IR2023

Universal Vision-Language Dense Retrieval: Learning A Unified Representation Space for Multi-Modal Retrieval

Zhenghao Liu, Chenyan Xiong, Yuanhuiyi Lv +2

cs.CL2026

HIPPO: Enhancing the Table Understanding Capability of LLMs through Hybrid-Modal Preference Optimization

Haolan Wang, Zhenghao Liu, Xinze Li +7

cs.IR2024

Enhancing Dense Retrievers' Robustness with Group-level Reweighting

Peixuan Han, Zhenghao Liu, Zhiyuan Liu +1

cs.CL2025

RankCoT: Refining Knowledge for Retrieval-Augmented Generation through Ranking Chain-of-Thoughts

Mingyan Wu, Zhenghao Liu, Yukun Yan +5

cs.IR2021

Few-Shot Text Ranking with Meta Adapted Synthetic Weak Supervision

Si Sun, Yingzhuo Qian, Zhenghao Liu +5

cs.IR2024

Modeling User Viewing Flow Using Large Language Models for Article Recommendation

Zhenghao Liu, Zulong Chen, Moufeng Zhang +6

cs.AI2026

AgentCPM-Report: Interleaving Drafting and Deepening for Open-Ended Deep Research

Yishan Li, Wentong Chen, Yukun Yan +12

cs.CL2024

Toolink: Linking Toolkit Creation and Using through Chain-of-Solving on Open-Source Model

Cheng Qian, Chenyan Xiong, Zhenghao Liu +1

cs.IR2025

VisRAG: Vision-based Retrieval-augmented Generation on Multi-modality Documents

Shi Yu, Chaoyue Tang, Bokai Xu +8

cs.CL2026

ThinkNote: Enhancing Knowledge Integration and Utilization of Large Language Models via Constructivist Cognition Modeling

Zhipeng Xu, Zhenghao Liu, Yukun Yan +7

cs.CL2026

MetaMem: Evolving Meta-Memory for Knowledge Utilization through Self-Reflective Symbolic Optimization

Haidong Xin, Xinze Li, Zhenghao Liu +6

cs.CL2025

PathRAG: Pruning Graph-based Retrieval Augmented Generation with Relational Paths

Boyu Chen, Zirui Guo, Zidan Yang +5

cs.SE2024

INTERVENOR: Prompting the Coding Ability of Large Language Models with the Interactive Chain of Repair

Hanbin Wang, Zhenghao Liu, Shuo Wang +4

cs.IR2026

ReAlign: Optimizing the Visual Document Retriever with Reasoning-Guided Fine-Grained Alignment

Hao Yang, Yifan Ji, Zhipeng Xu +6

cs.CE2026

Tau-BNO: Brain Neural Operator for Tau Transport Model

Nuutti Barron, Heng Rao, Urmi Saha +6

cs.CV2026

MemoryCard: Topic-Aware Multi-Modal Clue Compression for Long-Video Question Answering

Qing Yang, Pengcheng Huang, Xinze Li +6

cs.CL2026

REFACT: Adaptive Fact Restatement for Compact and Faithful Chain-of-Thought Reasoning

Zhensheng Jin, Xin Dai, Zhenghao Liu +5

cs.CL2026

Finding What Matters: Anchoring Context Knowledge with Evolving Indices for Iterative Retrieval

Mingyan Wu, Zhenghao Liu, Xinze Li +7

cs.CL2024

UltraLink: An Open-Source Knowledge-Enhanced Multilingual Supervised Fine-tuning Dataset

Haoyu Wang, Shuo Wang, Yukun Yan +9

cs.CL2026

SHIFT: Gate-Modulated Activation Steering for Knowledge Conflict Mitigation in Retrieval-Augmented Generation

Ruochang Li, Pengcheng Huang, Zhenghao Liu +5

cs.CL2026

SEEK: Steering LLM Reasoning for RAG via Internal Reasoning Sketches

Xinze Li, Yuqing Lan, Zhenghao Liu +7

cs.CL2026

PR-CAD: Progressive Refinement for Unified Controllable and Faithful Text-to-CAD Generation with Large Language Models

Jiyuan An, Jiachen Zhao, Fan Chen +6

cs.IR2025

UltraRAG: A Modular and Automated Toolkit for Adaptive Retrieval-Augmented Generation

Yuxuan Chen, Dewen Guo, Sen Mei +12

cs.LG2024

Generalized Graph Prompt: Toward a Unification of Pre-Training and Downstream Tasks on Graphs

Xingtong Yu, Zhenghao Liu, Yuan Fang +3

cs.CL2019

Multi-Paragraph Reasoning with Knowledge-enhanced Graph Neural Network

Deming Ye, Yankai Lin, Zhenghao Liu +2

cs.CL2025

KG-Infused RAG: Augmenting Corpus-Based RAG with External Knowledge Graphs

Dingjun Wu, Yukun Yan, Zhenghao Liu +2

cs.CL2025

DeepNote: Note-Centric Deep Retrieval-Augmented Generation

Ruobing Wang, Qingfei Zhao, Yukun Yan +9

cs.CL2026

ParamMute: Suppressing Knowledge-Critical FFNs for Faithful Retrieval-Augmented Generation

Pengcheng Huang, Zhenghao Liu, Yukun Yan +8

cs.SE2026

Teaching LLMs to Learn Tool Trialing and Execution through Environment Interaction

Xingjie Gao, Pengcheng Huang, Zhenghao Liu +6

cs.CL2026

Scientific Knowledge-driven Decoding Constraints Improving the Reliability of LLMs

Maotian Ma, Zheni Zeng, Zhenghao Liu +1

cs.LG2025

Node-Time Conditional Prompt Learning In Dynamic Graphs

Xingtong Yu, Zhenghao Liu, Xinming Zhang +1

cs.CL2026

OMGEval: An Open Multilingual Generative Evaluation Benchmark for Large Language Models

Yang Liu, Meng Xu, Shuo Wang +7

cs.AI2026

HippoSpark: An On-Demand Experience System for LLM Reasoning

Jingyao Liu, Danling Meng, Chen Huang +5

cs.CL2024

MCTS: A Multi-Reference Chinese Text Simplification Dataset

Ruining Chong, Luming Lu, Liner Yang +6

cs.LG2024

CHGNN: A Semi-Supervised Contrastive Hypergraph Learning Network

Yumeng Song, Yu Gu, Tianyi Li +4

cs.IR2025

LISRec: Modeling User Preferences with Learned Item Shortcuts for Sequential Recommendation

Haidong Xin, Zhenghao Liu, Sen Mei +7

cs.CL2026

NaviRAG: Towards Active Knowledge Navigation for Retrieval-Augmented Generation

Jihao Dai, Dingjun Wu, Yuxuan Chen +4

cs.CL2025

IROTE: Human-like Traits Elicitation of Large Language Model via In-Context Self-Reflective Optimization

Yuzhuo Bai, Shitong Duan, Muhua Huang +7

cs.CL2026

CheckRLM: Effective Knowledge-Thought Coherence Checking in Retrieval-Augmented Reasoning

Dingling Xu, Ruobing Wang, Qingfei Zhao +8

cs.LG2024

Multi-Evidence based Fact Verification via A Confidential Graph Neural Network

Yuqing Lan, Zhenghao Liu, Yu Gu +4

cs.CL2025

Layout-Aware Parsing Meets Efficient LLMs: A Unified, Scalable Framework for Resume Information Extraction and Evaluation

Fanwei Zhu, Jinke Yu, Zulong Chen +6

cs.IR2020

Selective Weak Supervision for Neural Information Retrieval

Kaitao Zhang, Chenyan Xiong, Zhenghao Liu +1

cs.AI2026

Lang2Act: Fine-Grained Visual Reasoning through Self-Emergent Linguistic Toolchains

Yuqi Xiong, Chunyi Peng, Zhipeng Xu +6

cs.IR2022

Dimension Reduction for Efficient Dense Retrieval via Conditional Autoencoder

Zhenghao Liu, Han Zhang, Chenyan Xiong +3

cs.CL2025

VisRAG2.0: Mitigating Visual Hallucinations via Evidence-Guided Multi-Image Reasoning in Visual Retrieval-Augmented Generation

Yubo Sun, Chunyi Peng, Yukun Yan +6

cs.IR2025

Learning Refined Document Representations for Dense Retrieval via Deliberate Thinking

Yifan Ji, Zhipeng Xu, Zhenghao Liu +7

cs.AI2025

Benchmarking Retrieval-Augmented Generation in Multi-Modal Contexts

Zhenghao Liu, Xingsheng Zhu, Tianshuo Zhou +5

cs.LG2026

Revealing the Attention Floating Mechanism in Masked Diffusion Models

Xin Dai, Pengcheng Huang, Zhenghao Liu +6

cs.IR2024

Fusion-in-T5: Unifying Document Ranking Signals for Improved Information Retrieval

Shi Yu, Chenghao Fan, Chenyan Xiong +3

cs.CL2026

Mixture-of-Retrieval Experts for Reasoning-Guided Multimodal Knowledge Exploitation

Chunyi Peng, Zhipeng Xu, Zhenghao Liu +7

cs.LG2022

A Roadmap for Big Model

Sha Yuan, Hanyu Zhao, Shuai Zhao +97

cs.CL2025

Enhancing Long-Chain Reasoning Distillation through Error-Aware Self-Reflection

Zhuoyang Wu, Xinze Li, Zhenghao Liu +7

cs.CL2021

YACLC: A Chinese Learner Corpus with Multidimensional Annotation

Yingying Wang, Cunliang Kong, Liner Yang +8

cs.CL2021

Neural Quality Estimation with Multiple Hypotheses for Grammatical Error Correction

Zhenghao Liu, Xiaoyuan Yi, Maosong Sun +2

cs.CL2026

CC-OCR V2: Benchmarking Large Multimodal Models for Literacy in Real-world Document Processing

Zhipeng Xu, Junhao Ji, Zulong Chen +10

cs.CL2025

PersLLM: A Personified Training Approach for Large Language Models

Zheni Zeng, Jiayi Chen, Huimin Chen +5

cs.IR2022

P^3 Ranker: Mitigating the Gaps between Pre-training and Ranking Fine-tuning with Prompt-based Learning and Pre-finetuning

Xiaomeng Hu, Shi Yu, Chenyan Xiong +3

cs.CL2025

Judge as A Judge: Improving the Evaluation of Retrieval-Augmented Generation through the Judge-Consistency of Large Language Models

Shuliang Liu, Xinze Li, Zhenghao Liu +6

astro-ph.EP2020

Inverted Channel Belts and Floodplain Clays to the East of Tempe Terra, Mars: Implications for Persistent Fluvial Activity on Early Mars

Zhenghao Liu, Yang Liu, Lu Pan +4

cs.CL2026

Chinese Short-Form Creative Content Generation via Explanation-Oriented Multi-Objective Optimization

Shanlin Zhou, Xinpeng Wang, Jianxun Lian +4

cs.CL2026

RLAIF-SPA: Structured AI Feedback for Semantic-Prosodic Alignment in Speech Synthesis

Qing Yang, Zhenghao Liu, Yangfan Du +2

cs.CL2025

KARE-RAG: Knowledge-Aware Refinement and Enhancement for RAG

Yongjian Li, HaoCheng Chu, Yukun Yan +7

cs.CL2020

Grounded Conversation Generation as Guided Traverses in Commonsense Knowledge Graphs

Houyu Zhang, Zhenghao Liu, Chenyan Xiong +1

cs.CL2026

Chunks as Arms: Multi-Armed Bandit-Guided Sampling for Long-Context LLM Preference Optimization

Shaohua Duan, Pengcheng Huang, Xinze Li +7

cs.IR2021

OpenMatch: An Open Source Library for Neu-IR Research

Zhenghao Liu, Kaitao Zhang, Chenyan Xiong +2

cs.IR2019

Explore Entity Embedding Effectiveness in Entity Retrieval

Zhenghao Liu, Chenyan Xiong, Maosong Sun +1

cs.CL2024

From Text to CQL: Bridging Natural Language and Corpus Search Engine

Luming Lu, Jiyuan An, Yujie Wang +8