2 papers
cs.RO2025
SRT-H: A Hierarchical Framework for Autonomous Surgery via Language Conditioned Imitation Learning
Ji Woong Kim, Juo-Tung Chen, Pascal Hansen +11
Research on autonomous surgery has largely focused on simple task automation in controlled environments. However, real-world surgical applications demand dexterous manipulation ove…
cs.HC2025
AgentClinic: a multimodal agent benchmark to evaluate AI in simulated clinical environments
Samuel Schmidgall, Rojin Ziaei, Carl Harris +3
Evaluating large language models (LLM) in clinical scenarios is crucial to assessing their potential clinical utility. Existing benchmarks rely heavily on static question-answering…