Showing cs.AIShow all
2 papers · 1 filter
cs.AI2026
Ryze: Evidence-Enriched Data Synthesis from Biomedical Papers
Yeqi Huang, Yue Chen, Yanwei Ye +2
General-purpose VLMs remain unreliable for biomedical research because valid answers in scientific papers depend on evidence split across figures, tables, charts, captions, and ref…
cs.AI2026
Do Agents Know What They Can't Do? Evaluating Feasibility Awareness in Tool-Using Agents
Liang Cheng, Mingsheng Cai, Jiuming Jiang +1
Tool-using agents often incur substantial computational cost due to long reasoning chains and iterative tool usage. In practical scenarios, many tasks become infeasible under const…