works on

From the 1 of 13 linked papers with an AI index.

collaborators

13 papers

cs.AI2026

AgentCompass: A Unified Evaluation Infrastructure for Agent Capabilities

Kai Chen, Zichen Ding, Jiaye Ge +22

The paper presents AgentCompass, an open‑source infrastructure that standardizes and simplifies the evaluation of large‑language‑model based autonomous agents by separating benchma…

eess.IV2026

Clinical Priors Guided Lung Disease Detection in 3D CT Scans

Kejin Lu, Jianfa Bai, Qingqiu Li +5

Accurate classification of lung diseases from chest CT scans plays an important role in computer-aided diagnosis systems. However, medical imaging datasets often suffer from severe…

eess.IV2026

Vision-Language Model Based Multi-Expert Fusion for CT Image Classification

Jianfa Bai, Kejin Lu, Runtian Yuan +5

Robust detection of COVID-19 from chest CT remains challenging in multi-institutional settings due to substantial source shift, source imbalance, and hidden test-source identities.…

cs.MA2025

How Brittle is Agent Safety? Rethinking Agent Risk under Intent Concealment and Task Complexity

Zihan Ma, Dongsheng Zhu, Shudong Liu +6

Current safety evaluations for LLM-driven agents primarily focus on atomic harms, failing to address sophisticated threats where malicious intent is concealed or diluted within com…

eess.IV2025

Advancing Lung Disease Diagnosis in 3D CT Scans

Qingqiu Li, Runtian Yuan, Junlin Hou +4

To enable more accurate diagnosis of lung disease in chest CT scans, we propose a straightforward yet effective model. Firstly, we analyze the characteristics of 3D CT scans and re…

eess.IV2025

Multi-Source COVID-19 Detection via Variance Risk Extrapolation

Runtian Yuan, Qingqiu Li, Junlin Hou +4

We present our solution for the Multi-Source COVID-19 Detection Challenge, which aims to classify chest CT scans into COVID and Non-COVID categories across data collected from four…