Publications (73)
HAIC: Improving Human Action Understanding and Generation with Better Captions for Multi-modal Large Language Models
Xiao Wang, Jingyun Hua, Weihong Lin +5
When Importance Sampling Misallocates Credit: Asymmetric Ratios for Outcome-Supervised RL
Jiakang Wang, Runze Liu, Qingpeng Cai +7
Parrot: Enhancing Multi-Turn Instruction Following for Large Language Models
Yuchong Sun, Che Liu, Kun Zhou +6
ASAP: A Chinese Review Dataset Towards Aspect Category Sentiment Analysis and Rating Prediction
Jiahao Bu, Lei Ren, Shuang Zheng +4
SheetAgent: Towards A Generalist Agent for Spreadsheet Reasoning and Manipulation via Large Language Models
Yibin Chen, Yifu Yuan, Zeyu Zhang +6
Data Metabolism: An Efficient Data Design Schema For Vision Language Model
Jingyuan Zhang, Hongzhi Zhang, Zhou Haonan +7
Capybara-OMNI: An Efficient Paradigm for Building Omni-Modal Language Models
Xingguang Ji, Jiakang Wang, Hongzhi Zhang +6
CE-GPPO: Coordinating Entropy via Gradient-Preserving Clipping Policy Optimization in Reinforcement Learning
Zhenpeng Su, Leiyu Pan, Minxuan Lv +5
Cross-domain novelty seeking trait mining for sequential recommendation
Fuzhen Zhuang, Yingmin Zhou, Fuzheng Zhang +3
Earlier Attention? Aspect-Aware LSTM for Aspect-Based Sentiment Analysis
Bowen Xing, Lejian Liao, Dandan Song +4
DynTok: Dynamic Compression of Visual Tokens for Efficient and Effective Video Understanding
Hongzhi Zhang, Jingyuan Zhang, Xingguang Ji +2
Just Ask One More Time! Self-Agreement Improves Reasoning of Language Models in (Almost) All Scenarios
Lei Lin, Jiayi Fu, Pengli Liu +7
Agentic Reinforced Policy Optimization
Guanting Dong, Hangyu Mao, Kai Ma +11
DMQR-RAG: Diverse Multi-Query Rewriting for RAG
Zhicong Li, Jiahao Wang, Zhishu Jiang +7
Research on the Spatial Data Intelligent Foundation Model
Shaohua Wang, Xing Xie, Yong Li +28
Mixture of Decoding: An Attention-Inspired Adaptive Decoding Strategy to Mitigate Hallucinations in Large Vision-Language Models
Xinlong Chen, Yuanxing Zhang, Qiang Liu +3
Leanabell-Prover: Posttraining Scaling in Formal Reasoning
Jingyuan Zhang, Qi Wang, Xingguang Ji +6
Towards Comprehensive Preference Data Collection for Reward Modeling
Yulan Hu, Qingyang Li, Sheng Ouyang +6
Transcribing Content from Structural Images with Spotlight Mechanism
Yu Yin, Zhenya Huang, Enhong Chen +4
Small Agent Can Also Rock! Empowering Small Language Models as Hallucination Detector
Xiaoxue Cheng, Junyi Li, Wayne Xin Zhao +5
Points-of-Interest Relationship Inference with Spatial-enriched Graph Neural Networks
Yile Chen, Xiucheng Li, Gao Cong +5
Video-Text Dataset Construction from Multi-AI Feedback: Promoting Weak-to-Strong Preference Learning for Video Large Language Models
Hao Yi, Qingyang Li, Yulan Hu +3
Leanabell-Prover-V2: Verifier-integrated Reasoning for Formal Theorem Proving via Reinforcement Learning
Xingguang Ji, Yahui Liu, Qi Wang +7
Routing to the Right Expertise: A Trustworthy Judge for Instruction-based Image Editing
Chenxi Sun, Hongzhi Zhang, Qi Wang +1
PlanMoGPT: Flow-Enhanced Progressive Planning for Text to Motion Synthesis
Chuhao Jin, Haosen Li, Bingzi Zhang +7
xDeepFM: Combining Explicit and Implicit Feature Interactions for Recommender Systems
Jianxun Lian, Xiaohuan Zhou, Fuzheng Zhang +3
S^3-Rec: Self-Supervised Learning for Sequential Recommendation with Mutual Information Maximization
Kun Zhou, Hui Wang, Wayne Xin Zhao +5
Enhancing Role-playing Systems through Aggressive Queries: Evaluation and Improvement
Yihong Tang, Jiao Ou, Che Liu +3
RLEP: Reinforcement Learning with Experience Replay for LLM Reasoning
Hongzhi Zhang, Jia Fu, Jingyuan Zhang +4
Virtual Data Augmentation: A Robust and General Framework for Fine-tuning Pre-trained Models
Kun Zhou, Wayne Xin Zhao, Sirui Wang +3
TEMPLE: Incentivizing Temporal Understanding of Video Large Language Models via Progressive Pre-SFT Alignment
Shicheng Li, Lei Li, Kun Ouyang +7
Improving Large Language Models via Fine-grained Reinforcement Learning with Minimum Editing Constraint
Zhipeng Chen, Kun Zhou, Wayne Xin Zhao +4
VidCapBench: A Comprehensive Benchmark of Video Captioning for Controllable Text-to-Video Generation
Xinlong Chen, Yuanxing Zhang, Chongling Rao +7
Improving Document Representations by Generating Pseudo Query Embeddings for Dense Retrieval
Hongyin Tang, Xingwu Sun, Beihong Jin +3
Klear-CodeTest: Scalable Test Case Generation for Code Reinforcement Learning
Jia Fu, Xinyu Yang, Hongzhi Zhang +5
ERABAL: Enhancing Role-Playing Agents through Boundary-Aware Learning
Yihong Tang, Jiao Ou, Che Liu +3
Graph Ranking Contrastive Learning: A Extremely Simple yet Efficient Method
Yulan Hu, Sheng Ouyang, Jingyu Liu +6
Inductive-Deductive Strategy Reuse for Multi-Turn Instructional Dialogues
Jiao Ou, Jiayu Wu, Che Liu +3
Stabilizing Knowledge, Promoting Reasoning: Dual-Token Constraints for RLVR
Jiakang Wang, Runze Liu, Fuzheng Zhang +3
KwaiYiiMath: Technical Report
Jiayi Fu, Lei Lin, Xiaoyang Gao +18
ConSERT: A Contrastive Framework for Self-Supervised Sentence Representation Transfer
Yuanmeng Yan, Rumei Li, Sirui Wang +3
AR-GRPO: Training Autoregressive Image Generation Models via Reinforcement Learning
Shihao Yuan, Yahui Liu, Yang Yue +5
DualRAG: A Dual-Process Approach to Integrate Reasoning and Retrieval for Multi-Hop Question Answering
Rong Cheng, Jinyi Liu, Yan Zheng +6
TUNA: Comprehensive Fine-grained Temporal Understanding Evaluation on Dense Dynamic Videos
Fanheng Kong, Jingyuan Zhang, Hongzhi Zhang +7
Popularity Bias Is Not Always Evil: Disentangling Benign and Harmful Bias for Recommendation
Zihao Zhao, Jiawei Chen, Sheng Zhou +4
DialogBench: Evaluating LLMs as Human-like Dialogue Systems
Jiao Ou, Junda Lu, Che Liu +4
Decoding at the Speed of Thought: Harnessing Parallel Decoding of Lexical Units for LLMs
Chenxi Sun, Hongzhi Zhang, Zijia Lin +8
RippleNet: Propagating User Preferences on the Knowledge Graph for Recommender Systems
Hongwei Wang, Fuzheng Zhang, Jialin Wang +4
Chain-of-Specificity: An Iteratively Refining Method for Eliciting Knowledge from Large Language Models
Kaiwen Wei, Jingyuan Zhang, Hongzhi Zhang +4
What Makes a Good Reasoning Chain? Uncovering Structural Patterns in Long Chain-of-Thought Reasoning
Gangwei Jiang, Yahui Liu, Zhaoyi Li +5
Query-aware Tip Generation for Vertical Search
Yang Yang, Junmei Hao, Canjia Li +7
DKN: Deep Knowledge-Aware Network for News Recommendation
Hongwei Wang, Fuzheng Zhang, Xing Xie +1
TSO: Self-Training with Scaled Preference Optimization
Kaihui Chen, Hao Yi, Qingyang Li +4
Knowledge-aware Graph Neural Networks with Label Smoothness Regularization for Recommender Systems
Hongwei Wang, Fuzheng Zhang, Mengdi Zhang +4
Multi-Task Feature Learning for Knowledge Graph Enhanced Recommendation
Hongwei Wang, Fuzheng Zhang, Miao Zhao +3
CoT-MAE v2: Contextual Masked Auto-Encoder with Multi-view Modeling for Passage Retrieval
Xing Wu, Guangyuan Ma, Peng Wang +4
Klear-AgentForge: Forging Agentic Intelligence through Posttraining Scaling
Qi Wang, Hongzhi Zhang, Jia Fu +12
SHINE: Signed Heterogeneous Information Network Embedding for Sentiment Link Prediction
Hongwei Wang, Fuzheng Zhang, Min Hou +3
SPPD: Self-training with Process Preference Learning Using Dynamic Value Margin
Hao Yi, Qingyang Li, Yulan Hu +3
DisenKGAT: Knowledge Graph Embedding with Disentangled Graph Attention Network
Junkang Wu, Wentao Shi, Xuezhi Cao +5
From Chaos to Order: The Atomic Reasoner Framework for Fine-grained Reasoning in Large Language Models
Jinyi Liu, Yan Zheng, Rong Cheng +8
Video DataFlywheel: Resolving the Impossible Data Trinity in Video-Language Understanding
Xiao Wang, Jianlong Wu, Zijia Lin +3
Clapper: Compact Learning and Video Representation in VLMs
Lingyu Kong, Hongzhi Zhang, Jingyuan Zhang +4
GraphGAN: Graph Representation Learning with Generative Adversarial Nets
Hongwei Wang, Jia Wang, Jialin Wang +5
Klear-Reasoner: Advancing Reasoning Capability via Gradient-Preserving Clipping Policy Optimization
Zhenpeng Su, Leiyu Pan, Xue Bai +8
Evaluating Multimodal Large Language Models on Video Captioning via Monte Carlo Tree Search
Linhao Yu, Xinguang Ji, Yahui Liu +7
Towards Reward Fairness in RLHF: From a Resource Allocation Perspective
Sheng Ouyang, Yulan Hu, Ge Chen +3
Attention as a Compass: Efficient Exploration for Process-Supervised RL in Reasoning Models
Runze Liu, Jiakang Wang, Yuling Shi +11
Breaking the Stage Barrier: A Novel Single-Stage Approach to Long Context Extension for Large Language Models
Haoran Lian, Junmin Chen, Wei Huang +8
Leveraging Historical Interaction Data for Improving Conversational Recommender System
Kun Zhou, Wayne Xin Zhao, Hui Wang +4
Modality Curation: Building Universal Embeddings for Advanced Multimodal Information Retrieval
Fanheng Kong, Jingyuan Zhang, Yahui Liu +8
Mavors: Multi-granularity Video Representation for Multimodal Large Language Model
Yang Shi, Jiaheng Liu, Yushuo Guan +12
Agentic Entropy-Balanced Policy Optimization
Guanting Dong, Licheng Bao, Zhongyuan Wang +11