NewEvery arXiv paper, its researchers & institutions — mapped.
papers

Publications (141)

cs.CV2026

Structure-Detail Decoupled Autoregressive Generation for Fast and High-Fidelity Virtual Try-On

Lu Yang, Xiaonan Hu, Yanan Li +3

The paper introduces STAR-VTON, a two‑stage autoregressive framework for virtual try‑on that generates garment structure in a latent space and then refines fine‑grained details in…

#virtual try-on#autoregressive generation#latent-space synthesis#pixel-space refinement
cs.CV2025

Video Individual Counting With Implicit One-to-Many Matching

Xuhui Zhu, Jing Xu, Bingjie Wang +2

eess.IV2025

MedTVT-R1: A Multimodal LLM Empowering Medical Reasoning and Diagnosis

Yuting Zhang, Kaishen Yuan, Hao Lu +3

cs.CV2022

Infusing Definiteness into Randomness: Rethinking Composition Styles for Deep Image Matting

Zixuan Ye, Yutong Dai, Chaoyi Hong +2

cs.CV2026

NSVQ: Mitigating Codebook Collapse by Stabilizing Encoder Drift in Vector Quantization

Hao Lu, Yongxin Guo, Onur Koyun +3

cs.CV2025

UniUGP: Unifying Understanding, Generation, and Planing For End-to-end Autonomous Driving

Hao Lu, Ziyang Liu, Guangfeng Jiang +4

cs.CV2023

Fast Full-frame Video Stabilization with Iterative Optimization

Weiyue Zhao, Xin Li, Zhan Peng +4

cs.CV2020

Learning Affinity-Aware Upsampling for Deep Image Matting

Yutong Dai, Hao Lu, Chunhua Shen

cs.CE2025

Mixed-precision numerics in scientific applications: survey and perspectives

Aditya Kashi, Hao Lu, Wesley Brewer +4

cs.CV2025

First Place Solution to the MLCAS 2025 GWFSS Challenge: The Devil is in the Detail and Minority

Songliang Cao, Tianqi Hu, Hao Lu

cs.CV2024

Hawk: Learning to Understand Open-World Video Anomalies

Jiaqi Tang, Hao Lu, Ruizheng Wu +7

cs.CV2026

Motion Forcing: A Decoupled Framework for Robust Video Generation in Motion Dynamics

Tianshuo Xu, Zhifei Chen, Leyi Wu +2

cs.CV2026

Self-supervised Automatic Matting

Xiaonan Hu, Zhiyuan Lu, Jingdong Zhao +1

cs.CV2024

FADE: A Task-Agnostic Upsampling Operator for Encoder-Decoder Architectures

Hao Lu, Wenze Liu, Hongtao Fu +1

cs.CV2024

Bi-TTA: Bidirectional Test-Time Adapter for Remote Physiological Measurement

Haodong Li, Hao Lu, Ying-Cong Chen

eess.SY2023

When Mining Electric Locomotives Meet Reinforcement Learning

Ying Li, Zhencai Zhu, Xiaoqiang Li +2

cs.AI2026

Agentic Time Machine as an Infrastructure for Future-Event Forecasting

Jingyi Chai, Bingyang Zheng, Xiangrui Liu +5

cs.CV2026

Optimizing Occupancy Sensor Placement in Smart Environments

Hao Lu, Richard J. Radke

cs.AI2026

Empirical-MCTS: Continuous Agent Evolution via Dual-Experience Monte Carlo Tree Search

Hao Lu, Haoyuan Huang, Yulin Zhou +2

astro-ph.HE2018

Crust breaking and the limiting rotational frequency of neutron stars

F. J. Fattoyev, C. J. Horowitz, Hao Lu

cs.AI2026

AutoMine Solution for AV2 2026 Scenario Mining Challenge

Songliang Cao, Jiele Zhao, Yuru Wang +10

cs.CV2024

Vision Transformer Off-the-Shelf: A Surprising Baseline for Few-Shot Class-Agnostic Counting

Zhicheng Wang, Liwen Xiao, Zhiguo Cao +1

cs.RO2026

MatterDoor: Sampling Zero-shot Spatio-semantic Priors using Generative Models

Subhransu S. Bhattacharjee, Hao Lu, Dylan Campbell +1

cs.DC2025

Scaling the memory wall using mixed-precision -- HPG-MxP on an exascale machine

Aditya Kashi, Nicholson Koukpaizan, Hao Lu +3

cs.CV2023

Learning Second-Order Attentive Context for Efficient Correspondence Pruning

Xinyi Ye, Weiyue Zhao, Hao Lu +1

cs.CV2022

Robust Object Detection With Inaccurate Bounding Boxes

Chengxin Liu, Kewei Wang, Hao Lu +2

math.OC2010

Approximation of distributed delays

Hao Lu, Michael Di Loreto, Damien Eberard +1

cs.CV2025

TasselNetV4: A vision foundation model for cross-scene, cross-scale, and cross-species plant counting

Xiaonan Hu, Xuebing Li, Jinyu Xu +8

cs.CV2020

The 1st Challenge on Remote Physiological Signal Sensing (RePSS)

Xiaobai Li, Hu Han, Hao Lu +5

cs.CV2022

DoF-NeRF: Depth-of-Field Meets Neural Radiance Fields

Zijin Wu, Xingyi Li, Juewen Peng +3

cs.CV2026

CamPilot: Improving Camera Control in Video Diffusion Model with Efficient Camera Reward Feedback

Wenhang Ge, Guibao Shen, Jiawei Feng +5

cs.LG2023

An interpretable deep learning method for bearing fault diagnosis

Hao Lu, Austin M. Bray, Chao Hu +2

cs.CV2023

ESTextSpotter: Towards Better Scene Text Spotting with Explicit Synergy in Transformer

Mingxin Huang, Jiaxin Zhang, Dezhi Peng +5

cs.CV2026

DepthCropSeg++: Scaling a Crop Segmentation Foundation Model With Depth-Labeled Data

Jiafei Zhang, Songliang Cao, Binghui Xu +6

cs.CV2025

FitControler: Toward Fit-Aware Virtual Try-On

Lu Yang, Yicheng Liu, Yanan Li +2

cs.CV2025

Efficient Portrait Matte Creation With Layer Diffusion and Connectivity Priors

Zhiyuan Lu, Hao Lu, Hua Huang

cs.CV2025

SeMi: When Imbalanced Semi-Supervised Learning Meets Mining Hard Examples

Yin Wang, Zixuan Wang, Hao Lu +7

cs.RO2025

Occ-LLM: Enhancing Autonomous Driving with Occupancy-Based Large Language Models

Tianshuo Xu, Hao Lu, Xu Yan +3

cs.CV2023

On Point Affiliation in Feature Upsampling

Wenze Liu, Hao Lu, Yuliang Liu +1

cs.CV2022

MPIB: An MPI-Based Bokeh Rendering Framework for Realistic Partial Occlusion Effects

Juewen Peng, Jianming Zhang, Xianrui Luo +3

cs.RO2023

Sector Bounds for Vertical Cable Force Error in Cable-Suspended Load Transportation System

Lidan Xu, Hao Lu, JianLiang Wang +2

cs.CV2019

Indices Matter: Learning to Index for Deep Image Matting

Hao Lu, Yutong Dai, Chunhua Shen +1

cs.CV2023

Point-and-Shoot All-in-Focus Photo Synthesis from Smartphone Camera Pair

Xianrui Luo, Juewen Peng, Weiyue Zhao +3

cs.CV2025

Advancing Generalizable Remote Physiological Measurement through the Integration of Explicit and Implicit Prior Knowledge

Yuting Zhang, Hao Lu, Xin Liu +2

cs.CV2026

Plant Taxonomy Meets Plant Counting: A Fine-Grained, Taxonomic Dataset for Counting Hundreds of Plant Species

Jinyu Xu, Tianqi Hu, Xiaonan Hu +4

cs.LG2026

LPO: Towards Accurate GUI Agent Interaction via Location Preference Optimization

Jiaqi Tang, Yu Xia, Yi-Feng Wu +9

cs.CV2024

Resolve Domain Conflicts for Generalizable Remote Physiological Measurement

Weiyu Sun, Xinyu Zhang, Hao Lu +5

astro-ph.GA2023

The Stellar Abundances and Galactic Evolution Survey (SAGES) -- -- I. General Description and the First Data Release (DR1)

Zhou Fan, Gang Zhao, Wei Wang +35

cs.CL2025

Hunyuan-TurboS: Advancing Large Language Models through Mamba-Transformer Synergy and Adaptive Chain-of-Thought

Tencent Hunyuan Team, Ao Liu, Botong Zhou +248

cs.CV2024

Scaling Multi-Camera 3D Object Detection through Weak-to-Strong Eliciting

Hao Lu, Jiaqi Tang, Xinli Xu +6

cs.CV2024

DrivingRecon: Large 4D Gaussian Reconstruction Model For Autonomous Driving

Hao Lu, Tianshuo Xu, Wenzhao Zheng +6

cs.CV2025

SEE: See Everything Every Time -- Adaptive Brightness Adjustment for Broad Light Range Images via Events

Yunfan Lu, Xiaogang Xu, Hao Lu +8

eess.IV2025

Global Rice Multi-Class Segmentation Dataset (RiceSEG): A Comprehensive and Diverse High-Resolution RGB-Annotated Images for the Development and Benchmarking of Rice Segmentation Algorithms

Junchi Zhou, Haozhou Wang, Yoichiro Kato +21

cs.CV2026

Momentum Memory for Knowledge Distillation in Computational Pathology

Yongxin Guo, Hao Lu, Onur C. Koyun +3

physics.ins-det2025

Polarizing 3He via Metastability Exchange Optical Pumping Using a 1.2 mbar Sealed Cell at Magnetic Fields up to 5 T

Pushpa Pandey, Hao Lu, James Maxwell +5

cs.RO2026

Virtues of Ordered Chaos: Planning with Topple Actions in Tabletop Stack Rearrangement

Hao Lu, Rahul Shome

cs.CV2026

MetaView: Monocular Novel View Synthesis with Scale-Aware Implicit Geometry Priors

Yufei Cai, Xuesong Niu, Hao Lu +3

MetaView is a diffusion-based framework that generates novel views from a single image by combining implicit geometry priors with metric depth cues, enabling large viewpoint change…

#novel view synthesis#monocular depth estimation#diffusion models#implicit geometry
cs.CV2026

Crowded Video Individual Counting Informed by Social Grouping and Spatial-Temporal Displacement Priors

Hao Lu, Xuhui Zhu, Wenjing Zhang +2

cond-mat.mtrl-sci2021

Effect of Interfacial Dipole on Heterogeneous Ice Nucleation

Hao Lu, Quanming Xu, Jianyang Wu +2

cs.CV2025

OCRBench v2: An Improved Benchmark for Evaluating Large Multimodal Models on Visual Text Localization and Reasoning

Ling Fu, Zhebin Kuang, Jiajun Song +21

cs.CV2022

Design What You Desire: Icon Generation from Orthogonal Application and Theme Labels

Yinpeng Chen, Zhiyu Pan, Min Shi +3

stat.ML2022

Bootstrapping Fitted Q-Evaluation for Off-Policy Inference

Botao Hao, Xiang Ji, Yaqi Duan +3

cs.CV2024

GPT as Psychologist? Preliminary Evaluations for GPT-4V on Visual Affective Computing

Hao Lu, Xuesong Niu, Jiyao Wang +12

cs.CV2022

SAPA: Similarity-Aware Point Affiliation for Feature Upsampling

Hao Lu, Wenze Liu, Zixuan Ye +3

cs.CV2022

Represent, Compare, and Learn: A Similarity-Aware Framework for Class-Agnostic Counting

Min Shi, Hao Lu, Chen Feng +2

cs.CV2017

TasselNet: Counting maize tassels in the wild via local counts regression network

Hao Lu, Zhiguo Cao, Yang Xiao +2

cs.IR2026

OneMall: One Architecture, More Scenarios -- End-to-End Generative Recommender Family at Kuaishou E-Commerce

Kun Zhang, Jingming Zhang, Wei Cheng +29

cs.CV2023

Point-Query Quadtree for Crowd Counting, Localization, and More

Chengxin Liu, Hao Lu, Zhiguo Cao +1

cs.CV2023

rPPG-MAE: Self-supervised Pre-training with Masked Autoencoders for Remote Physiological Measurement

Xin Liu, Yuting Zhang, Zitong Yu +3

cs.CV2024

The RoboDrive Challenge: Drive Anytime Anywhere in Any Condition

Lingdong Kong, Shaoyuan Xie, Hanjiang Hu +88

cs.MM2025

LongCat-Flash-Omni Technical Report

Meituan LongCat Team, Bairui Wang, Bayan +129

cs.CL2018

PreCo: A Large-scale Dataset in Preschool Vocabulary for Coreference Resolution

Hong Chen, Zhenhua Fan, Hao Lu +2

cs.CV2025

MonoSplat: Generalizable 3D Gaussian Splatting from Monocular Depth Foundation Models

Yifan Liu, Keyu Fan, Weihao Yu +3

cs.CV2026

U-TTT: Towards Generalizable PET Image Denoising via Test-Time Training

Zhiwen Yang, Jiayin Li, Hao Lu +3

cs.CV2025

Sage Deer: A Super-Aligned Driving Generalist Is Your Copilot

Hao Lu, Jiaqi Tang, Jiyao Wang +14

cs.CV2022

FADE: Fusing the Assets of Decoder and Encoder for Task-Agnostic Upsampling

Hao Lu, Wenze Liu, Hongtao Fu +1

cs.CV2026

EVA: Efficient Reinforcement Learning for End-to-End Video Agent

Yaolun Zhang, Ruohui Wang, Jiahao Wang +6

cs.CV2025

FoMo4Wheat: Toward reliable crop vision foundation models with globally curated data

Bing Han, Chen Zhu, Dong Han +22

cs.AI2024

Research on the Spatial Data Intelligent Foundation Model

Shaohua Wang, Xing Xie, Yong Li +28

cs.IT2023

Adaptive Regularized Zero-Forcing Beamforming in Massive MIMO with Multi-Antenna Users

Evgeny Bobrov, Boris Chinyaev, Viktor Kuznetsov +5

astro-ph.EP2017

Transiting Exoplanet Monitoring Project (TEMP). III. On the Relocation of the Kepler-9~b Transit

Songhu Wang, Dong-Hong Wu, Brett C. Addison +24

cs.CV2023

Box-DETR: Understanding and Boxing Conditional Spatial Queries

Wenze Liu, Hao Lu, Yuliang Liu +1

cs.CV2026

Dynamic Pyramid Network for Efficient Multimodal Large Language Model

Hao Ai, Kunyi Wang, Zezhou Wang +7

cs.CV2025

Period-LLM: Extending the Periodic Capability of Multimodal Large Language Model

Yuting Zhang, Hao Lu, Qingyong Hu +4

cs.RO2026

Optimal Knock-Pick Planning for Tightly Packed Tabletop Blocks With Parallel Grippers

Hao Lu, Rahul Shome

cs.CL2025

MM-BrowseComp: A Comprehensive Benchmark for Multimodal Browsing Agents

Shilong Li, Xingyuan Bu, Wenjie Wang +21

cs.CY2024

An AI-Enabled Framework Within Reach for Enhancing Healthcare Sustainability and Fairness

Bin Huang, Changchen Zhao, Zimeng Liu +6

cs.CV2024

In-Context Matting

He Guo, Zixuan Ye, Zhiguo Cao +1

cs.LG2023

Federated Learning with Uncertainty-Based Client Clustering for Fleet-Wide Fault Diagnosis

Hao Lu, Adam Thelen, Olga Fink +2

cs.CV2026

Motion Dreamer: Boundary Conditional Motion Reasoning for Physically Coherent Video Generation

Tianshuo Xu, Zhifei Chen, Leyi Wu +5

cs.CV2025

TATTOO: Training-free AesTheTic-aware Outfit recOmmendation

Yuntian Wu, Xiaonan Hu, Ziqi Zhou +1

cs.LG2024

Learning the boundary-to-domain mapping using Lifting Product Fourier Neural Operators for partial differential equations

Aditya Kashi, Arka Daw, Muralikrishnan Gopalakrishnan Meena +1

cs.CV2026

SPROUT: A Scalable Diffusion Foundation Model for Agricultural Vision

Shuai Xiang, Wei Guo, James Burridge +4

cs.CV2024

PhysMLE: Generalizable and Priors-Inclusive Multi-task Remote Physiological Measurement

Jiyao Wang, Hao Lu, Ange Wang +4

q-bio.GN2024

Machine Learning-Based Analysis of Ebola Virus' Impact on Gene Expression in Nonhuman Primates

Mostafa Rezapour, Muhammad Khalid Khan Niazi, Hao Lu +2

cs.CV2024

An Incremental Unified Framework for Small Defect Inspection

Jiaqi Tang, Hao Lu, Xiaogang Xu +7

cs.CV2023

Benefit from public unlabeled data: A Frangi filtering-based pretraining network for 3D cerebrovascular segmentation

Gen Shi, Hao Lu, Hui Hui +1

cs.CV2024

VimTS: A Unified Video and Image Text Spotter for Enhancing the Cross-domain Generalization

Yuliang Liu, Mingxin Huang, Hao Yan +6

cs.SI2017

Smoke Screener or Straight Shooter: Detecting Elite Sybil Attacks in User-Review Social Networks

Haizhong Zheng, Minhui Xue, Hao Lu +4

cs.CL2025

MCTSr-Zero: Self-Reflective Psychological Counseling Dialogues Generation via Principles and Adaptive Exploration

Hao Lu, Yanchi Gu, Haoyuan Huang +3