NewEvery arXiv paper, its researchers & institutions — mapped.
papers

Publications (277)

cs.CV2025

ConText: Driving In-context Learning for Text Removal and Segmentation

Fei Zhang, Pei Zhang, Baosong Yang +3

cs.CV2024

Reprogramming Distillation for Medical Foundation Models

Yuhang Zhou, Siyuan Du, Haolin Li +3

cs.CV2023

Exploring Effective Mask Sampling Modeling for Neural Image Compression

Lin Liu, Mingming Zhao, Shanxin Yuan +5

cs.CV2024

Domain-Inspired Sharpness-Aware Minimization Under Domain Shifts

Ruipeng Zhang, Ziqing Fan, Jiangchao Yao +2

cs.CV2025

Universal Video Temporal Grounding with Generative Multi-modal Large Language Models

Zeqian Li, Shangzhe Di, Zhonghua Zhai +3

cs.CL2025

RARE: Retrieval-Augmented Reasoning Modeling

Zhengren Wang, Jiayang Yu, Dongsheng Ma +8

cs.CV2024

Advancing Myopia To Holism: Fully Contrastive Language-Image Pre-training

Haicheng Wang, Chen Ju, Weixiong Lin +9

cs.CV2024

ReMamber: Referring Image Segmentation with Mamba Twister

Yuhuan Yang, Chaofan Ma, Jiangchao Yao +3

cs.CV2026

Improving Human Image Animation via Semantic Representation Alignment

Chang Liu, Mengting Chen, Yixuan Huang +5

cs.CL2026

AgentEHR: Advancing Autonomous Clinical Decision-Making via Retrospective Summarization

Yusheng Liao, Chuan Xuan, Yutong Cai +4

cs.LG2021

Cooperative Learning for Noisy Supervision

Hao Wu, Jiangchao Yao, Ya Zhang +1

cs.AI2025

Active Sampling for Node Attribute Completion on Graphs

Benyuan Liu, Xu Chen, Yanfeng Wang +3

cs.AI2025

SciMaster: Towards General-Purpose Scientific AI Agents, Part I. X-Master as Foundation: Can We Lead on Humanity's Last Exam?

Jingyi Chai, Shuo Tang, Rui Ye +8

cs.CV2026

POINTS-Seeker: An Open Recipe for Multimodal Search Agents with Visual Memory Management

Yikun Liu, Yuan Liu, Le Tian +6

cs.CV2025

RadIR: A Scalable Framework for Multi-Grained Medical Image Retrieval via Radiology Report Mining

Tengfei Zhang, Ziheng Zhao, Chaoyi Wu +4

cs.CV2024

UniChest: Conquer-and-Divide Pre-training for Multi-Source Chest X-Ray Classification

Tianjie Dai, Ruipeng Zhang, Feng Hong +3

cs.CV2023

Uncovering Prototypical Knowledge for Weakly Open-Vocabulary Semantic Segmentation

Fei Zhang, Tianfei Zhou, Boyang Li +6

cs.CL2025

When Seeing Is not Enough: Revealing the Limits of Active Reasoning in MLLMs

Hongcheng Liu, Pingjie Wang, Yuhao Wang +3

cs.LG2024

Reconstruct the Pruned Model without Any Retraining

Pingjie Wang, Ziqing Fan, Shengchao Hu +3

cs.CV2021

MS-KD: Multi-Organ Segmentation with Multiple Binary-Labeled Datasets

Shixiang Feng, Yuhang Zhou, Xiaoman Zhang +2

cs.AI2026

GenTac: Generative Modeling and Forecasting of Soccer Tactics

Jiayuan Rao, Tianlin Gui, Haoning Wu +2

cs.CV2019

Iteratively-Refined Interactive 3D Medical Image Segmentation with Multi-Agent Reinforcement Learning

Xuan Liao, Wenhao Li, Qisen Xu +5

cs.CV2023

PMC-CLIP: Contrastive Language-Image Pre-training using Biomedical Documents

Weixiong Lin, Ziheng Zhao, Xiaoman Zhang +4

cs.LG2022

FedSkip: Combatting Statistical Heterogeneity with Federated Skip Aggregation

Ziqing Fan, Yanfeng Wang, Jiangchao Yao +3

cs.LG2023

Combating Representation Learning Disparity with Geometric Harmonization

Zhihan Zhou, Jiangchao Yao, Feng Hong +3

cs.AI2026

Miner:Mining Intrinsic Mastery for Data-Efficient RL in Large Reasoning Models

Shuyang Jiang, Yuhao Wang, Ya Zhang +2

cs.CV2022

Distilling Vision-Language Pre-training to Collaborate with Weakly-Supervised Temporal Action Localization

Chen Ju, Kunhao Zheng, Jinxiang Liu +5

cs.CV2024

Few-Shot Anomaly Detection via Category-Agnostic Registration Learning

Chaoqin Huang, Haoyan Guan, Aofan Jiang +4

cs.CV2024

Multi-Modal Prototypes for Open-World Semantic Segmentation

Yuhuan Yang, Chaofan Ma, Chen Ju +4

cs.CV2024

Audio-Visual Segmentation via Unlabeled Frame Exploitation

Jinxiang Liu, Yikun Liu, Fei Zhang +3

cs.CV2022

Low-Light Video Enhancement with Synthetic Event Guidance

Lin Liu, Junfeng An, Jianzhuang Liu +6

cs.CV2026

Demographic-Aware Self-Supervised Anomaly Detection Pretraining for Equitable Rare Cardiac Diagnosis

Chaoqin Huang, Zi Zeng, Aofan Jiang +6

cs.CL2023

MedBench: A Large-Scale Chinese Benchmark for Evaluating Medical Large Language Models

Yan Cai, Linlin Wang, Ye Wang +4

cs.CV2022

Contrastive Learning with Boosted Memorization

Zhihan Zhou, Jiangchao Yao, Yanfeng Wang +2

cs.MM2023

Redundancy-Adaptive Multimodal Learning for Imperfect Data

Mengxi Chen, Jiangchao Yao, Linyu Xing +3

cs.CL2026

HeteroRAG: A Heterogeneous Retrieval-Augmented Generation Framework for Medical Vision Language Tasks

Zhe Chen, Yusheng Liao, Zhiyuan Zhu +4

cs.CV2024

LoRKD: Low-Rank Knowledge Decomposition for Medical Foundation Models

Haolin Li, Yuhang Zhou, Ziheng Zhao +5

cs.CL2024

Decoding Linguistic Representations of Human Brain

Yu Wang, Heyang Liu, Yuhao Wang +6

cs.AI2026

MCP-Persona: Benchmarking LLM Agents on Real-World Personal Applications via Environment Simulation

Wenhao Wang, Peizhi Niu, Gongyi Zou +9

cs.CV2023

TBP-Former: Learning Temporal Bird's-Eye-View Pyramid for Joint Perception and Prediction in Vision-Centric Autonomous Driving

Shaoheng Fang, Zi Wang, Yiqi Zhong +3

cs.CV2026

Innovator-VL: A Multimodal Large Language Model for Scientific Discovery

Zichen Wen, Boxue Yang, Shuang Chen +30

cs.CV2024

MegaFusion: Extend Diffusion Models towards Higher-resolution Image Generation without Further Tuning

Haoning Wu, Shaocheng Shen, Qiang Hu +3

cs.CL2025

Wide-In, Narrow-Out: Revokable Decoding for Efficient and Effective DLLMs

Feng Hong, Geng Yu, Yushi Ye +5

cs.CV2025

COST: Contrastive One-Stage Transformer for Vision-Language Small Object Tracking

Chunhui Zhang, Li Liu, Jialin Gao +5

cs.CV2024

PMC-VQA: Visual Instruction Tuning for Medical Visual Question Answering

Xiaoman Zhang, Chaoyi Wu, Ziheng Zhao +4

cs.LG2024

Q-value Regularized Transformer for Offline Reinforcement Learning

Shengchao Hu, Ziqing Fan, Chaoqin Huang +4

cs.CV2023

DiffusionSeg: Adapting Diffusion Towards Unsupervised Object Discovery

Chaofan Ma, Yuhuan Yang, Chen Ju +5

cs.CL2024

Self-Alignment of Large Language Models via Monopolylogue-based Social Scene Simulation

Xianghe Pang, Shuo Tang, Rui Ye +4

cs.CR2024

Physical Backdoor Attack can Jeopardize Driving with Vision-Large-Language Models

Zhenyang Ni, Rui Ye, Yuxi Wei +3

cs.CV2017

Deep Hashing with Triplet Quantization Loss

Yuefu Zhou, Shanshan Huang, Ya Zhang +1

cs.CV2024

Self-Localized Collaborative Perception

Zhenyang Ni, Zixing Lei, Yifan Lu +4

cs.CV2020

ChoreoNet: Towards Music to Dance Synthesis with Choreographic Action Unit

Zijie Ye, Haozhe Wu, Jia Jia +4

cs.CV2026

SoccerNet 2026 Challenges Results

Anthony Cioppa, Silvio Giancola, Håkan Ardö +102

cs.CL2024

Towards an End-to-End Framework for Invasive Brain Signal Decoding with Large Language Models

Sheng Feng, Heyang Liu, Yu Wang +1

cs.CL2025

WanJuanSiLu: A High-Quality Open-Source Webtext Dataset for Low-Resource Languages

Jia Yu, Fei Yuan, Rui Min +20

cs.CV2025

Ethical-Lens: Curbing Malicious Usages of Open-Source Text-to-Image Models

Yuzhu Cai, Sheng Yin, Yuxi Wei +5

cs.CV2025

Multi-Agent System for Comprehensive Soccer Understanding

Jiayuan Rao, Zifeng Li, Haoning Wu +3

cs.CV2023

Can GPT-4V(ision) Serve Medical Applications? Case Studies on GPT-4V for Multimodal Medical Diagnosis

Chaoyi Wu, Jiayu Lei, Qiaoyu Zheng +8

cs.LG2025

Dual-granularity Sinkhorn Distillation for Enhanced Learning from Long-tailed Noisy Data

Feng Hong, Yu Huang, Zihua Zhao +5

cs.CL2026

An Agentic System for Rare Disease Diagnosis with Traceable Reasoning

Weike Zhao, Chaoyi Wu, Yanjie Fan +10

cs.LG2023

FedDisco: Federated Learning with Discrepancy-Aware Collaboration

Rui Ye, Mingkai Xu, Jianyu Wang +3

cs.LG2024

Federated Learning under Partially Class-Disjoint Data via Manifold Reshaping

Ziqing Fan, Jiangchao Yao, Ruipeng Zhang +3

cs.CV2018

Domain-Invariant Adversarial Learning for Unsupervised Domain Adaption

Yexun Zhang, Ya Zhang, Yanfeng Wang +1

cs.CL2024

Drawing the Line: Enhancing Trustworthiness of MLLMs Through the Power of Refusal

Yuhao Wang, Zhiyuan Zhu, Heyang Liu +4

cs.CL2024

Automatic Interactive Evaluation for Large Language Models with State Aware Patient Simulator

Yusheng Liao, Yutong Meng, Yuhao Wang +3

cs.CL2026

VocalBench: Benchmarking the Vocal Conversational Abilities for Speech Interaction Models

Heyang Liu, Yuhao Wang, Ziyang Cheng +7

cs.CL2024

Towards Building Multilingual Language Model for Medicine

Pengcheng Qiu, Chaoyi Wu, Xiaoman Zhang +5

cs.CL2025

CS3-Bench: Evaluating and Enhancing Speech-to-Speech LLMs for Mandarin-English Code-Switching

Heyang Liu, Yuhao Wang, Ziyang Cheng +4

cs.CV2019

Symbiotic Graph Neural Networks for 3D Skeleton-based Human Action Recognition and Motion Prediction

Maosen Li, Siheng Chen, Xu Chen +3

cs.CV2023

EqMotion: Equivariant Multi-agent Motion Prediction with Invariant Interaction Reasoning

Chenxin Xu, Robby T. Tan, Yuhong Tan +4

cs.LG2024

Hypergraph Transformer for Semi-Supervised Classification

Zexi Liu, Bohan Tang, Ziyuan Ye +3

eess.IV2025

Rethinking Whole-Body CT Image Interpretation: An Abnormality-Centric Approach

Ziheng Zhao, Lisong Dai, Ya Zhang +2

cs.LG2026

AceGRPO: Adaptive Curriculum Enhanced Group Relative Policy Optimization for Autonomous Machine Learning Engineering

Yuzhu Cai, Zexi Liu, Xinyu Zhu +3

cs.CV2024

LamRA: Large Multimodal Model as Your Advanced Retrieval Assistant

Yikun Liu, Pingan Chen, Jiayin Cai +5

cs.CV2024

Multi-Sentence Grounding for Long-term Instructional Video

Zeqian Li, Qirui Chen, Tengda Han +3

cs.LG2025

Innovator: Scientific Continued Pretraining with Fine-grained MoE Upcycling

Ning Liao, Xiaoxing Wang, Zehao Lin +18

cs.CL2025

Quantifying the Reasoning Abilities of LLMs on Real-world Clinical Cases

Pengcheng Qiu, Chaoyi Wu, Shuyu Liu +7

cs.CV2023

Bag of Tricks for Long-Tailed Multi-Label Classification on Chest X-Rays

Feng Hong, Tianjie Dai, Jiangchao Yao +2

cs.CL2025

VocalBench-DF: A Benchmark for Evaluating Speech LLM Robustness to Disfluency

Hongcheng Liu, Yixuan Hou, Heyang Liu +3

cs.CL2026

GLM-OCR Technical Report

Shuaiqi Duan, Yadong Xue, Weihan Wang +20

cs.CV2025

MoMa: Modulating Mamba for Adapting Image Foundation Models to Video Recognition

Yuhuan Yang, Chaofan Ma, Zhenjie Mao +3

cs.LG2023

Fake It Till Make It: Federated Learning with Consensus-Oriented Generation

Rui Ye, Yaxin Du, Zhenyang Ni +2

cs.SD2026

SpotSound: Enhancing Large Audio-Language Models with Fine-Grained Temporal Grounding

Luoyi Sun, Xiao Zhou, Zeqian Li +3

cs.CV2024

MatchTime: Towards Automatic Soccer Game Commentary Generation

Jiayuan Rao, Haoning Wu, Chang Liu +2

cs.CV2024

DENOISER: Rethinking the Robustness for Open-Vocabulary Action Recognition

Haozhe Cheng, Cheng Ju, Haicheng Wang +5

cs.CL2020

Learning Contextualized Sentence Representations for Document-Level Neural Machine Translation

Pei Zhang, Xu Zhang, Wei Chen +3

cs.LG2024

Diversified Batch Selection for Training Acceleration

Feng Hong, Yueming Lyu, Jiangchao Yao +3

cs.LG2024

Federated Learning with Bilateral Curation for Partially Class-Disjoint Data

Ziqing Fan, Ruipeng Zhang, Jiangchao Yao +3

cs.CL2023

Knowledge-aware Bayesian Co-attention for Multimodal Emotion Recognition

Zihan Zhao, Yu Wang, Yanfeng Wang

cs.CV2023

Knowledge-enhanced Visual-Language Pre-training on Chest Radiology Images

Xiaoman Zhang, Chaoyi Wu, Ya Zhang +2

cs.LG2023

Unrolled Graph Learning for Multi-Agent Collaboration

Enpei Zhang, Shuo Tang, Xiaowen Dong +2

eess.AS2022

Nextformer: A ConvNeXt Augmented Conformer For End-To-End Speech Recognition

Yongjun Jiang, Jian Yu, Wenwen Yang +2

cs.CV2023

Boost Video Frame Interpolation via Motion Adaptation

Haoning Wu, Xiaoyun Zhang, Weidi Xie +2

cs.CV2024

JointRF: End-to-End Joint Optimization for Dynamic Neural Radiance Field Representation and Compression

Zihan Zheng, Houqiang Zhong, Qiang Hu +4

cs.CV2023

Towards Generalist Foundation Model for Radiology by Leveraging Web-scale 2D&3D Medical Data

Chaoyi Wu, Xiaoman Zhang, Ya Zhang +2

eess.IV2024

VRVVC: Variable-Rate NeRF-Based Volumetric Video Compression

Qiang Hu, Houqiang Zhong, Zihan Zheng +5

cs.CV2024

Awesome Multi-modal Object Tracking

Chunhui Zhang, Li Liu, Hao Wen +2

cs.CV2024

FedRSU: Federated Learning for Scene Flow Estimation on Roadside Units

Shaoheng Fang, Rui Ye, Wenhao Wang +5

cs.CL2024

Leveraging Diverse Modeling Contexts with Collaborating Learning for Neural Machine Translation

Yusheng Liao, Yanfeng Wang, Yu Wang

cs.CL2024

Leveraging Unstructured Text Data for Federated Instruction Tuning of Large Language Models

Rui Ye, Rui Ge, Yuchi Fengting +3