From the 1 of 13 linked papers with an AI index.
13 papers
AgentCompass: A Unified Evaluation Infrastructure for Agent Capabilities
Kai Chen, Zichen Ding, Jiaye Ge +22
The paper presents AgentCompass, an open‑source infrastructure that standardizes and simplifies the evaluation of large‑language‑model based autonomous agents by separating benchma…
Clinical Priors Guided Lung Disease Detection in 3D CT Scans
Kejin Lu, Jianfa Bai, Qingqiu Li +5
Accurate classification of lung diseases from chest CT scans plays an important role in computer-aided diagnosis systems. However, medical imaging datasets often suffer from severe…
Vision-Language Model Based Multi-Expert Fusion for CT Image Classification
Jianfa Bai, Kejin Lu, Runtian Yuan +5
Robust detection of COVID-19 from chest CT remains challenging in multi-institutional settings due to substantial source shift, source imbalance, and hidden test-source identities.…
How Brittle is Agent Safety? Rethinking Agent Risk under Intent Concealment and Task Complexity
Zihan Ma, Dongsheng Zhu, Shudong Liu +6
Current safety evaluations for LLM-driven agents primarily focus on atomic harms, failing to address sophisticated threats where malicious intent is concealed or diluted within com…
Advancing Lung Disease Diagnosis in 3D CT Scans
Qingqiu Li, Runtian Yuan, Junlin Hou +4
To enable more accurate diagnosis of lung disease in chest CT scans, we propose a straightforward yet effective model. Firstly, we analyze the characteristics of 3D CT scans and re…
Multi-Source COVID-19 Detection via Variance Risk Extrapolation
Runtian Yuan, Qingqiu Li, Junlin Hou +4
We present our solution for the Multi-Source COVID-19 Detection Challenge, which aims to classify chest CT scans into COVID and Non-COVID categories across data collected from four…