papers

Publications (113)

cs.CV2025

EndoMamba: An Efficient Foundation Model for Endoscopic Videos via Hierarchical Pre-training

Qingyao Tian, Huai Liao, Xinyan Huang +4

cs.CV2025

Advancing Dense Endoscopic Reconstruction with Gaussian Splatting-driven Surface Normal-aware Tracking and Mapping

Yiming Huang, Beilei Cui, Long Bai +5

cs.LG2026

Reinforcement Fine-Tuning Naturally Mitigates Forgetting in Continual Post-Training

Song Lai, Haohan Zhao, Rong Feng +9

eess.IV2025

Progressive Curriculum Learning with Scale-Enhanced U-Net for Continuous Airway Segmentation

Bingyu Yang, Qingyao Tian, Huai Liao +4

cs.RO2020

Design of a Low-cost Miniature Robot to Assist the COVID-19 Nasopharyngeal Swab Sampling

Shuangyi Wang, Kehao Wang, Hongbin Liu +1

cs.CV2025

SurgLLM: A Versatile Large Multimodal Model with Spatial Focus and Temporal Awareness for Surgical Video Understanding

Zhen Chen, Xingjian Luo, Kun Yuan +6

cs.CV2024

BronchoTrack: Airway Lumen Tracking for Branch-Level Bronchoscopic Localization

Qingyao Tian, Huai Liao, Xinyan Huang +5

physics.ins-det2016

Development of an ADC Radiation Tolerance Characterization System for the Upgrade of the ATLAS LAr Calorimeter

Hongbin Liu, Hucheng Chen, Kai Chen +4

cs.DC2026

Scalable Training of Mixture-of-Experts Models with Megatron Core

Zijie Yan, Hongxiao Bai, Xin Yao +42

cs.RO2026

Action-Conditioned World Model for Goal Plane Probe Guidance in Robotic Ultrasound

Siqi Fan, Mingcong Chen, Ran Liu +5

quant-ph2020

Towards quantum computing for high-energy excited states in molecular systems: quantum phase estimations of core-level states

Nicholas P. Bauman, Hongbin Liu, Eric J. Bylaska +9

cs.CV2026

LP-LLM: End-to-End Real-World Degraded License Plate Text Recognition via Large Multimodal Models

Haoyan Gong, Hongbin Liu

quant-ph2024

End-to-End Quantum Simulation of a Chemical System

Wim van Dam, Hongbin Liu, Guang Hao Low +6

cs.CR2024

Refusing Safe Prompts for Multi-modal Large Language Models

Zedian Shao, Hongbin Liu, Yuepeng Hu +1

cs.CV2025

Tracing Back the Malicious Clients in Poisoning Attacks to Federated Learning

Yuqi Jia, Minghong Fang, Hongbin Liu +2

cs.AI2025

The Docking Game: Loop Self-Play for Fast, Dynamic, and Accurate Prediction of Flexible Protein-Ligand Binding

Youzhi Zhang, Yufei Li, Gaofeng Meng +2

cs.CV2017

Knock-Knock: Acoustic Object Recognition by using Stacked Denoising Autoencoders

Shan Luo, Leqi Zhu, Kaspar Althoefer +1

cs.CR2025

Enhancing Prompt Injection Attacks to LLMs via Poisoning Alignment

Zedian Shao, Hongbin Liu, Jaden Mu +1

cs.CV2023

SurgPLAN: Surgical Phase Localization Network for Phase Recognition

Xingjian Luo, You Pang, Zhen Chen +4

cs.RO2024

BronchoCopilot: Towards Autonomous Robotic Bronchoscopy via Multimodal Reinforcement Learning

Jianbo Zhao, Hao Chen, Qingyao Tian +3

physics.ins-det2018

Charge collection characterisation with the Transient Current Technique of the ams H35DEMO CMOS detector after proton irradiation

John Anders, Mathieu Benoit, Saverio Braccini +26

cs.RO2017

Robotic Tactile Perception of Object Properties: A Review

Shan Luo, Joao Bimbo, Ravinder Dahiya +1

cs.RO2020

Design and integration of a parallel, soft robotic end-effector for extracorporeal ultrasound

Lukas Lindenroth, Richard James Housden, Shuangyi Wang +3

eess.IV2024

EndoUIC: Promptable Diffusion Transformer for Unified Illumination Correction in Capsule Endoscopy

Long Bai, Tong Chen, Qiaozhi Tan +10

cs.CV2024

DaFoEs: Mixing Datasets towards the generalization of vision-state deep-learning Force Estimation in Minimally Invasive Robotic Surgery

Mikel De Iturrate Reyzabal, Mingcong Chen, Wei Huang +2

cs.RO2021

Towards intrinsic force sensing and control in parallel soft robots

Lukas Lindenroth, Danail Stoyanov, Kawal Rhode +1

cs.AI2025

SAMP-HDRL: Segmented Allocation with Momentum-Adjusted Utility for Multi-agent Portfolio Management via Hierarchical Deep Reinforcement Learning

Xiaotian Ren, Nuerxiati Abudurexiti, Zhengyong Jiang +3

physics.ins-det2026

Integration and characterization of Readout Electronics System for dN/dx Measurement with Drift Chamber Prototype

Dongcheng Cai, Qicai Li, Mingyi Dong +10

cs.CV2024

A Dataset and Model for Realistic License Plate Deblurring

Haoyan Gong, Yuzheng Feng, Zhenrong Zhang +4

cs.CV2026

Reward-Guided Semantic Evolution for Test-time Adaptive Object Detection

Lihua Zhou, Mao Ye, Xiatian Zhu +7

cs.CV2025

Endo-4DGX: Robust Endoscopic Scene Reconstruction and Illumination Correction with Gaussian Splatting

Yiming Huang, Long Bai, Beilei Cui +7

eess.IV2024

Force Sensing Guided Artery-Vein Segmentation via Sequential Ultrasound Images

Yimeng Geng, Gaofeng Meng, Mingcong Chen +4

cs.RO2017

Iterative Closest Labeled Point for Tactile Object Shape Recognition

Shan Luo, Wenxuan Mou, Kaspar Althoefer +1

cs.RO2024

Transforming Surgical Interventions with Embodied Intelligence for Ultrasound Robotics

Huan Xu, Jinlin Wu, Guanglin Cao +3

physics.ins-det2023

Mass testing of the JUNO experiment 20-inch PMTs readout electronics

Alberto Coppi, Beatrice Jelmini, Marco Bellato +129

cs.RO2018

iCLAP: Shape Recognition by Combining Proprioception and Touch Sensing

Shan Luo, Wenxuan Mou, Kaspar Althoefer +1

cs.CV2025

SurgPLAN++: Universal Surgical Phase Localization Network for Online and Offline Inference

Zhen Chen, Xingjian Luo, Jinlin Wu +5

cs.CV2026

Leave My Images Alone: Preventing Multi-Modal Large Language Models from Analyzing Images via Visual Prompt Injection

Zedian Shao, Hongbin Liu, Yuepeng Hu +1

cs.CV2026

BREATH-VL: Vision-Language-Guided 6-DoF Bronchoscopy Localization via Semantic-Geometric Fusion

Qingyao Tian, Bingyu Yang, Huai Liao +4

physics.ins-det2020

Performance of CMOS pixel sensor prototypes in ams H35 and aH18 technology for the ATLAS ITk upgrade

Moritz Kiehn, Francesco Armando Di Bello, Mathieu Benoit +27

cs.RO2025

USPilot: An Embodied Robotic Assistant Ultrasound System with Large Language Model Enhanced Graph Planner

Mingcong Chen, Siqi Fan, Guanglin Cao +2

cs.CV2025

CellMamba: Adaptive Mamba for Accurate and Efficient Cell Detection

Ruochen Liu, Yi Tian, Jiahao Wang +3

cs.CV2024

SurgeMOD: Translating image-space tissue motions into vision-based surgical forces

Mikel De Iturrate Reyzabal, Dionysios Malas, Shuai Wang +2

cs.CV2024

Automatically Generating Visual Hallucination Test Cases for Multimodal Large Language Models

Zhongye Liu, Hongbin Liu, Yuepeng Hu +2

cs.CR2024

Differentially Private Parameter-Efficient Fine-tuning for Large ASR Models

Hongbin Liu, Lun Wang, Om Thakkar +2

cs.CR2022

Almost Tight L0-norm Certified Robustness of Top-k Predictions against Adversarial Perturbations

Jinyuan Jia, Binghui Wang, Xiaoyu Cao +2

cs.LG2026

Denser Better: Limits of On-Policy Self-Distillation for Continual Post-Training

Meng Wang, Haohan Zhao, Wenzhuo Liu +7

cs.CV2025

Bayesian Test-time Adaptation for Object Recognition and Detection with Vision-language Models

Lihua Zhou, Mao Ye, Shuaifeng Li +7

cs.CR2021

PointGuard: Provably Robust 3D Point Cloud Classification

Hongbin Liu, Jinyuan Jia, Neil Zhenqiang Gong

cs.CV2024

ASI-Seg: Audio-Driven Surgical Instrument Segmentation with Surgeon Intention Understanding

Zhen Chen, Zongming Zhang, Wenwu Guo +5

cs.CL2026

Steering LLMs for Culturally Localized Generation

Simran Khanuja, Hongbin Liu, Shujian Zhang +4

cs.CV2025

EndoChat: Grounded Multimodal Large Language Model for Endoscopic Surgery

Guankun Wang, Long Bai, Junyi Wang +13

cs.CV2024

On the Federated Learning Framework for Cooperative Perception

Zhenrong Zhang, Jianan Liu, Xi Zhou +4

cs.RO2024

Enhancing Surgical Robots with Embodied Intelligence for Autonomous Ultrasound Scanning

Huan Xu, Jinlin Wu, Guanglin Cao +3

physics.comp-ph2024

Classification of electronic structures and state preparation for quantum computation of reaction chemistry

Maximilian Mörchen, Guang Hao Low, Thomas Weymuth +3

physics.chem-ph2024

Acceleration without Disruption: DFT Software as a Service

Fusong Ju, Xinran Wei, Lin Huang +13

cs.CV2024

VS-Assistant: Versatile Surgery Assistant on the Demand of Surgeons

Zhen Chen, Xingjian Luo, Jinlin Wu +5

cs.CV2025

Harnessing Foundation Models for Robust and Generalizable 6-DOF Bronchoscopy Localization

Qingyao Tian, Huai Liao, Xinyan Huang +2

cs.RO2019

Robotic-assisted Ultrasound for Fetal Imaging: Evolution from Single-arm to Dual-arm System

Shuangyi Wang, James Housden, Yohan Noh +20

cs.CV2025

Bayesian Test-Time Adaptation for Vision-Language Models

Lihua Zhou, Mao Ye, Shuaifeng Li +5

cs.CR2022

Pre-trained Encoders in Self-Supervised Learning Improve Secure and Privacy-preserving Supervised Learning

Hongbin Liu, Wenjie Qu, Jinyuan Jia +1

eess.IV2025

MM2CT: MR-to-CT translation for multi-modal image fusion with mamba

Chaohui Gong, Zhiying Wu, Zisheng Huang +3

cs.CR2023

10 Security and Privacy Problems in Large Foundation Models

Jinyuan Jia, Hongbin Liu, Neil Zhenqiang Gong

cs.RO2024

Design and Visual Servoing Control of a Hybrid Dual-Segment Flexible Neurosurgical Robot for Intraventricular Biopsy

Jian Chen, Mingcong Chen, Qingxiang Zhao +8

cs.CV2024

CathAction: A Benchmark for Endovascular Intervention Understanding

Baoru Huang, Tuan Vo, Chayun Kongtongvattana +35

physics.ins-det2026

Development of Readout Electronics for a High-Speed Event-Driven Neutron Imaging Detector Based on Timepix4

Qicai Li, Hongbin Liu, Dongcheng Cai +9

cs.CV2025

PADReg: Physics-Aware Deformable Registration Guided by Contact Force for Ultrasound Sequences

Yimeng Geng, Mingyang Zhao, Fan Xu +3

cs.CR2023

PoisonedEncoder: Poisoning the Unlabeled Pre-training Data in Contrastive Learning

Hongbin Liu, Jinyuan Jia, Neil Zhenqiang Gong

cs.CV2025

EndoMatcher: Generalizable Endoscopic Image Matcher via Multi-Domain Pre-training for Robot-Assisted Surgery

Bingyu Yang, Qingyao Tian, Yimeng Geng +4

cs.CV2026

Multimodal Causal-Driven Representation Learning for Generalizable Medical Image Segmentation

Xusheng Liang, Lihua Zhou, Nianxin Li +8

cs.CV2023

PWISeg: Point-based Weakly-supervised Instance Segmentation for Surgical Instruments

Zhen Sun, Huan Xu, Jinlin Wu +3

cs.CV2020

Bounding Boxes Are All We Need: Street View Image Classification via Context Encoding of Detected Buildings

Kun Zhao, Yongkun Liu, Siyuan Hao +3

cs.CV2026

Bridging the Intention-Expression Gap: Aligning Multi-Dimensional Preferences via Hierarchical Relevance Feedback in Text-to-Image Diffusion

Wenxi Wang, Hongbin Liu, Mingqian Li +2

cs.CV2026

SurgMotion: A Video-Native Foundation Model for Universal Understanding of Surgical Videos

Jinlin Wu, Felix Holm, Chuxi Chen +17

cs.CV2025

EndoOmni: Zero-Shot Cross-Dataset Depth Estimation in Endoscopy by Robust Self-Learning from Noisy Labels

Qingyao Tian, Zhen Chen, Huai Liao +4

physics.ins-det2022

Validation and integration tests of the JUNO 20-inch PMTs readout electronics

Vanessa Cerrone, Katharina von Sturm, Marco Bellato +127

cs.CR2022

StolenEncoder: Stealing Pre-trained Encoders in Self-supervised Learning

Yupei Liu, Jinyuan Jia, Hongbin Liu +1

cs.RO2017

Localizing the Object Contact through Matching Tactile Features with Visual Map

Shan Luo, Wenxuan Mou, Kaspar Althoefer +1

eess.IV2024

Enhancing Bronchoscopy Depth Estimation through Synthetic-to-Real Domain Adaptation

Qingyao Tian, Huai Liao, Xinyan Huang +2

quant-ph2021

Sensing applied pressure by triggering electronic quantum many-body excitations in an optical waveguide

Federica De Chiara, Hovan Lee, Cedric Weber +1

cs.SD2024

Can DeepFake Speech be Reliably Detected?

Hongbin Liu, Youzheng Chen, Arun Narayanan +3

cs.CV2024

Visual Hallucinations of Multi-modal Large Language Models

Wen Huang, Hongbin Liu, Minxin Guo +1

cs.CV2025

NeuroABench: A Multimodal Evaluation Benchmark for Neurosurgical Anatomy Identification

Ziyang Song, Zelin Zang, Xiaofan Ye +7

physics.ins-det2026

CTPX1: A Highly Integrated and High-Throughput Data-Driven Camera Based on Timepix4

Qicai Li, Hongbin Liu, Xingfen Jiang +10

cs.CV2025

Anatomy-R1: Enhancing Anatomy Reasoning in Multimodal Large Language Models via Anatomical Similarity Curriculum and Group Diversity Augmentation

Ziyang Song, Zelin Zang, Zuyao Chen +6

cs.CR2024

Mudjacking: Patching Backdoor Vulnerabilities in Foundation Models

Hongbin Liu, Michael K. Reiter, Neil Zhenqiang Gong

cs.CV2024

SurgTrack: CAD-Free 3D Tracking of Real-world Surgical Instruments

Wenwu Guo, Jinlin Wu, Zhen Chen +4

cs.CV2025

Surgical-LVLM: Learning to Adapt Large Vision-Language Model for Grounded Visual Question Answering in Robotic Surgery

Guankun Wang, Long Bai, Wan Jun Nah +7

cs.CR2021

EncoderMI: Membership Inference against Pre-trained Encoders in Contrastive Learning

Hongbin Liu, Jinyuan Jia, Wenjie Qu +1

eess.IV2024

Weakly Supervised YOLO Network for Surgical Instrument Localization in Endoscopic Videos

Rongfeng Wei, Jinlin Wu, Xuexue Bai +4

cs.CV2025

LEGO: Learning and Graph-Optimized Modular Tracker for Online Multi-Object Tracking with Point Clouds

Zhenrong Zhang, Jianan Liu, Yuxuan Xia +3

cs.CL2025

Gemini 2.5: Pushing the Frontier with Advanced Reasoning, Multimodality, Long Context, and Next Generation Agentic Capabilities

Gheorghe Comanici, Eric Bieber, Mike Schaekermann +3431

physics.ins-det2023

Implementation and performances of the IPbus protocol for the JUNO Large-PMT readout electronics

Riccardo Triozzi, Andrea Serafini, Marco Bellato +129

cs.CV2024

PANS: Probabilistic Airway Navigation System for Real-time Robust Bronchoscope Localization

Qingyao Tian, Zhen Chen, Huai Liao +4

cs.LG2024

AudioMarkBench: Benchmarking Robustness of Audio Watermarking

Hongbin Liu, Moyang Guo, Zhengyuan Jiang +2

quant-ph2021

Prospects of Quantum Computing for Molecular Sciences

Hongbin Liu, Guang Hao Low, Damian S. Steiger +3

cs.CR2023

PointCert: Point Cloud Classification with Deterministic Certified Robustness Guarantees

Jinghuai Zhang, Jinyuan Jia, Hongbin Liu +1

eess.IV2026

Learning-based Hierarchical Tracheal Anatomy Understanding from Sparse Surgical Demonstration Annotations for Ultrasound Robots

Hiu Ching Cheung, Wenchao Yue, Zhengran Han +4

cs.CV2025

F2PASeg: Feature Fusion for Pituitary Anatomy Segmentation in Endoscopic Surgery

Lumin Chen, Zhiying Wu, Tianye Lei +6

cs.CV2026

SurgVidLM: Towards Multi-grained Surgical Video Understanding with Large Language Model

Guankun Wang, Junyi Wang, Wenjin Mo +11