NewEvery arXiv paper, its researchers & institutions — mapped.
papers

Publications (27)

cs.LG2024

TSO: Self-Training with Scaled Preference Optimization

Kaihui Chen, Hao Yi, Qingyang Li +4

cs.MM2026

Beyond Forced Modality Balance: Intrinsic Information Budgets for Multimodal Learning

Zechang Xiong, Da Li, Kexin Tang +3

cs.AI2025

Coarse-to-Fine Process Reward Modeling for Mathematical Reasoning

Yulan Hu, Sheng Ouyang, Jinman Zhao +1

cs.AI2026

TRACE: Distilling Where It Matters via Token-Routed Self On-Policy Alignment

Jiaxuan Wang, Xuan Ouyang, Zhiyu Chen +4

cs.AI2026

No More Stale Feedback: Co-Evolving Critics for Open-World Agent Learning

Zhicong Li, Lingjie Jiang, Yulan Hu +7

cs.AI2024

Towards Comprehensive Preference Data Collection for Reward Modeling

Yulan Hu, Qingyang Li, Sheng Ouyang +6

cs.AI2026

Multi-Stakeholder LLM Alignment: Decomposing Estimation from Aggregation

Lulu Zheng, Wenjin Yang, Xiangwen Zhang +4

cs.AI2025

SPPD: Self-training with Process Preference Learning Using Dynamic Value Margin

Hao Yi, Qingyang Li, Yulan Hu +3

cs.CV2026

Adaptive Spectrum-Aware Feature Disentangled Network for Small Object Detection

Yang Guo, Zihan Yang, Feifei Kou +3

cs.LG2024

Preserving Node Distinctness in Graph Autoencoders via Similarity Distillation

Ge Chen, Yulan Hu, Sheng Ouyang +2

cs.LG2024

Graph Ranking Contrastive Learning: A Extremely Simple yet Efficient Method

Yulan Hu, Sheng Ouyang, Jingyu Liu +6

cs.CL2026

GroupTravelBench: Benchmarking LLM Agents on Multi-Person Travel Planning

Xiang Cheng, Yulan Hu, Lulu Zheng +3

cs.LG2026

Dense Supervision, Sparse Updates: On the Sparsity and Geometry of On-Policy Distillation

Guo Yu, Wenlin Liu, Yulan Hu +3

cs.LG2024

Video-Text Dataset Construction from Multi-AI Feedback: Promoting Weak-to-Strong Preference Learning for Video Large Language Models

Hao Yi, Qingyang Li, Yulan Hu +3

cs.AI2026

Learn More with Less: Uncertainty Consistency Guided Query Selection for RLVR

Hao Yi, Yulan Hu, Xin Li +3

cs.AI2021

Green CWS: Extreme Distillation and Efficient Decode Method Towards Industrial Application

Yulan Hu, Yong Liu

cs.LG2024

Refining Latent Representations: A Generative SSL Approach for Heterogeneous Graph Learning

Yulan Hu, Zhirui Yang, Sheng Ouyang +1

cs.LG2025

Towards Reward Fairness in RLHF: From a Resource Allocation Perspective

Sheng Ouyang, Yulan Hu, Ge Chen +3

cs.LG2026

MapTab: A Diagnostic Benchmark for Long-Horizon Multi-Criteria Multimodal Reasoning on Heterogeneous Topological Graphs

Ziqiao Shang, Lingyue Ge, Ling-Yue Ge +12

cs.LG2024

VIGraph: Generative Self-supervised Learning for Class-Imbalanced Node Classification

Yulan Hu, Sheng Ouyang, Zhirui Yang +1

cs.AI2026

Beyond Itinerary Planning-A Real-World Benchmark for Multi-Turn and Tool-Using Travel Tasks

Xiang Cheng, Yulan Hu, Xiangwen Zhang +5

cs.LG2024

Exploring Task Unification in Graph Representation Learning via Generative Approach

Yulan Hu, Sheng Ouyang, Zhirui Yang +4

cs.CL2026

Can LVLMs Uncover the Truth Behind Visual Illusions? An Analysis of Perceptual and Reasoning Capabilities

Liangjie Zhao, Jiaqing Lyu, Kexin Tang +5

The paper introduces IllusionReasoning, a benchmark that uses visual illusion images to jointly assess perception and reasoning abilities of large vision‑language models, revealing…

#visual illusions#vision-language models#reasoning evaluation#benchmark
cs.AI2026

AMAP Agentic Planning Technical Report

AMAP AI Agent Team, Yulan Hu, Xiangwen Zhang +22

cs.AI2024

GUNDAM: Aligning Large Language Models with Graph Understanding

Sheng Ouyang, Yulan Hu, Ge Chen +1

cs.AI2026

Aligning Agents via Planning: A Benchmark for Trajectory-Level Reward Modeling

Jiaxuan Wang, Yulan Hu, Wenjin Yang +3

cs.CL2025

Role-Play Paradox in Large Language Models: Reasoning Performance Gains and Ethical Dilemmas

Jinman Zhao, Zifan Qian, Linbo Cao +5