NewEvery arXiv paper, its researchers & institutions — mapped.
papers

Publications (73)

cs.CV2025

HAIC: Improving Human Action Understanding and Generation with Better Captions for Multi-modal Large Language Models

Xiao Wang, Jingyun Hua, Weihong Lin +5

cs.CL2026

When Importance Sampling Misallocates Credit: Asymmetric Ratios for Outcome-Supervised RL

Jiakang Wang, Runze Liu, Qingpeng Cai +7

cs.CL2024

Parrot: Enhancing Multi-Turn Instruction Following for Large Language Models

Yuchong Sun, Che Liu, Kun Zhou +6

cs.CL2021

ASAP: A Chinese Review Dataset Towards Aspect Category Sentiment Analysis and Rating Prediction

Jiahao Bu, Lei Ren, Shuang Zheng +4

cs.AI2025

SheetAgent: Towards A Generalist Agent for Spreadsheet Reasoning and Manipulation via Large Language Models

Yibin Chen, Yifu Yuan, Zeyu Zhang +6

cs.CL2025

Data Metabolism: An Efficient Data Design Schema For Vision Language Model

Jingyuan Zhang, Hongzhi Zhang, Zhou Haonan +7

cs.CL2025

Capybara-OMNI: An Efficient Paradigm for Building Omni-Modal Language Models

Xingguang Ji, Jiakang Wang, Hongzhi Zhang +6

cs.LG2026

CE-GPPO: Coordinating Entropy via Gradient-Preserving Clipping Policy Optimization in Reinforcement Learning

Zhenpeng Su, Leiyu Pan, Minxuan Lv +5

cs.IR2018

Cross-domain novelty seeking trait mining for sequential recommendation

Fuzhen Zhuang, Yingmin Zhou, Fuzheng Zhang +3

cs.CL2019

Earlier Attention? Aspect-Aware LSTM for Aspect-Based Sentiment Analysis

Bowen Xing, Lejian Liao, Dandan Song +4

cs.CL2025

DynTok: Dynamic Compression of Visual Tokens for Efficient and Effective Video Understanding

Hongzhi Zhang, Jingyuan Zhang, Xingguang Ji +2

cs.CL2024

Just Ask One More Time! Self-Agreement Improves Reasoning of Language Models in (Almost) All Scenarios

Lei Lin, Jiayi Fu, Pengli Liu +7

cs.LG2025

Agentic Reinforced Policy Optimization

Guanting Dong, Hangyu Mao, Kai Ma +11

cs.IR2024

DMQR-RAG: Diverse Multi-Query Rewriting for RAG

Zhicong Li, Jiahao Wang, Zhishu Jiang +7

cs.AI2024

Research on the Spatial Data Intelligent Foundation Model

Shaohua Wang, Xing Xie, Yong Li +28

cs.CL2025

Mixture of Decoding: An Attention-Inspired Adaptive Decoding Strategy to Mitigate Hallucinations in Large Vision-Language Models

Xinlong Chen, Yuanxing Zhang, Qiang Liu +3

cs.AI2025

Leanabell-Prover: Posttraining Scaling in Formal Reasoning

Jingyuan Zhang, Qi Wang, Xingguang Ji +6

cs.AI2024

Towards Comprehensive Preference Data Collection for Reward Modeling

Yulan Hu, Qingyang Li, Sheng Ouyang +6

cs.LG2019

Transcribing Content from Structural Images with Spotlight Mechanism

Yu Yin, Zhenya Huang, Enhong Chen +4

cs.CL2024

Small Agent Can Also Rock! Empowering Small Language Models as Hallucination Detector

Xiaoxue Cheng, Junyi Li, Wayne Xin Zhao +5

cs.AI2022

Points-of-Interest Relationship Inference with Spatial-enriched Graph Neural Networks

Yile Chen, Xiucheng Li, Gao Cong +5

cs.LG2024

Video-Text Dataset Construction from Multi-AI Feedback: Promoting Weak-to-Strong Preference Learning for Video Large Language Models

Hao Yi, Qingyang Li, Yulan Hu +3

cs.AI2025

Leanabell-Prover-V2: Verifier-integrated Reasoning for Formal Theorem Proving via Reinforcement Learning

Xingguang Ji, Yahui Liu, Qi Wang +7

cs.AI2025

Routing to the Right Expertise: A Trustworthy Judge for Instruction-based Image Editing

Chenxi Sun, Hongzhi Zhang, Qi Wang +1

cs.CV2025

PlanMoGPT: Flow-Enhanced Progressive Planning for Text to Motion Synthesis

Chuhao Jin, Haosen Li, Bingzi Zhang +7

cs.LG2018

xDeepFM: Combining Explicit and Implicit Feature Interactions for Recommender Systems

Jianxun Lian, Xiaohuan Zhou, Fuzheng Zhang +3

cs.IR2020

S^3-Rec: Self-Supervised Learning for Sequential Recommendation with Mutual Information Maximization

Kun Zhou, Hui Wang, Wayne Xin Zhao +5

cs.CL2024

Enhancing Role-playing Systems through Aggressive Queries: Evaluation and Improvement

Yihong Tang, Jiao Ou, Che Liu +3

cs.CL2025

RLEP: Reinforcement Learning with Experience Replay for LLM Reasoning

Hongzhi Zhang, Jia Fu, Jingyuan Zhang +4

cs.CL2021

Virtual Data Augmentation: A Robust and General Framework for Fine-tuning Pre-trained Models

Kun Zhou, Wayne Xin Zhao, Sirui Wang +3

cs.CV2025

TEMPLE: Incentivizing Temporal Understanding of Video Large Language Models via Progressive Pre-SFT Alignment

Shicheng Li, Lei Li, Kun Ouyang +7

cs.CL2024

Improving Large Language Models via Fine-grained Reinforcement Learning with Minimum Editing Constraint

Zhipeng Chen, Kun Zhou, Wayne Xin Zhao +4

cs.AI2025

VidCapBench: A Comprehensive Benchmark of Video Captioning for Controllable Text-to-Video Generation

Xinlong Chen, Yuanxing Zhang, Chongling Rao +7

cs.IR2021

Improving Document Representations by Generating Pseudo Query Embeddings for Dense Retrieval

Hongyin Tang, Xingwu Sun, Beihong Jin +3

cs.SE2025

Klear-CodeTest: Scalable Test Case Generation for Code Reinforcement Learning

Jia Fu, Xinyu Yang, Hongzhi Zhang +5

cs.CL2024

ERABAL: Enhancing Role-Playing Agents through Boundary-Aware Learning

Yihong Tang, Jiao Ou, Che Liu +3

cs.LG2024

Graph Ranking Contrastive Learning: A Extremely Simple yet Efficient Method

Yulan Hu, Sheng Ouyang, Jingyu Liu +6

cs.CL2024

Inductive-Deductive Strategy Reuse for Multi-Turn Instructional Dialogues

Jiao Ou, Jiayu Wu, Che Liu +3

cs.CL2026

Stabilizing Knowledge, Promoting Reasoning: Dual-Token Constraints for RLVR

Jiakang Wang, Runze Liu, Fuzheng Zhang +3

cs.CL2023

KwaiYiiMath: Technical Report

Jiayi Fu, Lei Lin, Xiaoyang Gao +18

cs.CL2021

ConSERT: A Contrastive Framework for Self-Supervised Sentence Representation Transfer

Yuanmeng Yan, Rumei Li, Sirui Wang +3

cs.CV2025

AR-GRPO: Training Autoregressive Image Generation Models via Reinforcement Learning

Shihao Yuan, Yahui Liu, Yang Yue +5

cs.LG2025

DualRAG: A Dual-Process Approach to Integrate Reasoning and Retrieval for Multi-Hop Question Answering

Rong Cheng, Jinyi Liu, Yan Zheng +6

cs.CV2025

TUNA: Comprehensive Fine-grained Temporal Understanding Evaluation on Dense Dynamic Videos

Fanheng Kong, Jingyuan Zhang, Hongzhi Zhang +7

cs.IR2021

Popularity Bias Is Not Always Evil: Disentangling Benign and Harmful Bias for Recommendation

Zihao Zhao, Jiawei Chen, Sheng Zhou +4

cs.CL2024

DialogBench: Evaluating LLMs as Human-like Dialogue Systems

Jiao Ou, Junda Lu, Che Liu +4

cs.CL2024

Decoding at the Speed of Thought: Harnessing Parallel Decoding of Lexical Units for LLMs

Chenxi Sun, Hongzhi Zhang, Zijia Lin +8

cs.IR2018

RippleNet: Propagating User Preferences on the Knowledge Graph for Recommender Systems

Hongwei Wang, Fuzheng Zhang, Jialin Wang +4

cs.AI2024

Chain-of-Specificity: An Iteratively Refining Method for Eliciting Knowledge from Large Language Models

Kaiwen Wei, Jingyuan Zhang, Hongzhi Zhang +4

cs.AI2025

What Makes a Good Reasoning Chain? Uncovering Structural Patterns in Long Chain-of-Thought Reasoning

Gangwei Jiang, Yahui Liu, Zhaoyi Li +5

cs.CL2020

Query-aware Tip Generation for Vertical Search

Yang Yang, Junmei Hao, Canjia Li +7

stat.ML2018

DKN: Deep Knowledge-Aware Network for News Recommendation

Hongwei Wang, Fuzheng Zhang, Xing Xie +1

cs.LG2024

TSO: Self-Training with Scaled Preference Optimization

Kaihui Chen, Hao Yi, Qingyang Li +4

cs.LG2019

Knowledge-aware Graph Neural Networks with Label Smoothness Regularization for Recommender Systems

Hongwei Wang, Fuzheng Zhang, Mengdi Zhang +4

cs.IR2019

Multi-Task Feature Learning for Knowledge Graph Enhanced Recommendation

Hongwei Wang, Fuzheng Zhang, Miao Zhao +3

cs.CL2023

CoT-MAE v2: Contextual Masked Auto-Encoder with Multi-view Modeling for Passage Retrieval

Xing Wu, Guangyuan Ma, Peng Wang +4

cs.AI2025

Klear-AgentForge: Forging Agentic Intelligence through Posttraining Scaling

Qi Wang, Hongzhi Zhang, Jia Fu +12

stat.ML2017

SHINE: Signed Heterogeneous Information Network Embedding for Sentiment Link Prediction

Hongwei Wang, Fuzheng Zhang, Min Hou +3

cs.AI2025

SPPD: Self-training with Process Preference Learning Using Dynamic Value Margin

Hao Yi, Qingyang Li, Yulan Hu +3

cs.AI2021

DisenKGAT: Knowledge Graph Embedding with Disentangled Graph Attention Network

Junkang Wu, Wentao Shi, Xuezhi Cao +5

cs.CL2025

From Chaos to Order: The Atomic Reasoner Framework for Fine-grained Reasoning in Large Language Models

Jinyi Liu, Yan Zheng, Rong Cheng +8

cs.CV2024

Video DataFlywheel: Resolving the Impossible Data Trinity in Video-Language Understanding

Xiao Wang, Jianlong Wu, Zijia Lin +3

cs.CV2025

Clapper: Compact Learning and Video Representation in VLMs

Lingyu Kong, Hongzhi Zhang, Jingyuan Zhang +4

cs.LG2017

GraphGAN: Graph Representation Learning with Generative Adversarial Nets

Hongwei Wang, Jia Wang, Jialin Wang +5

cs.LG2026

Klear-Reasoner: Advancing Reasoning Capability via Gradient-Preserving Clipping Policy Optimization

Zhenpeng Su, Leiyu Pan, Xue Bai +8

cs.CV2025

Evaluating Multimodal Large Language Models on Video Captioning via Monte Carlo Tree Search

Linhao Yu, Xinguang Ji, Yahui Liu +7

cs.LG2025

Towards Reward Fairness in RLHF: From a Resource Allocation Perspective

Sheng Ouyang, Yulan Hu, Ge Chen +3

cs.LG2025

Attention as a Compass: Efficient Exploration for Process-Supervised RL in Reasoning Models

Runze Liu, Jiakang Wang, Yuling Shi +11

cs.CL2024

Breaking the Stage Barrier: A Novel Single-Stage Approach to Long Context Extension for Large Language Models

Haoran Lian, Junmin Chen, Wei Huang +8

cs.IR2020

Leveraging Historical Interaction Data for Improving Conversational Recommender System

Kun Zhou, Wayne Xin Zhao, Hui Wang +4

cs.CV2025

Modality Curation: Building Universal Embeddings for Advanced Multimodal Information Retrieval

Fanheng Kong, Jingyuan Zhang, Yahui Liu +8

cs.CV2025

Mavors: Multi-granularity Video Representation for Multimodal Large Language Model

Yang Shi, Jiaheng Liu, Yushuo Guan +12

cs.LG2025

Agentic Entropy-Balanced Policy Optimization

Guanting Dong, Licheng Bao, Zhongyuan Wang +11