3 papers
cs.AI2026
Knowing How to Edit: Reliable Evaluation Signals for Diagnosing and Optimizing Prompts at Query Level
Ke Chen, Yifeng Wang, Hassan Almosapeeh +1
Prompt optimization has become a central mechanism for eliciting strong performance from LLMs, and recent work has made substantial progress by proposing diverse prompt evaluation…
q-bio.GN2025
Discovery of Disease Relationships via Transcriptomic Signature Analysis Powered by Agentic AI
Ke Chen, Haohan Wang
Modern disease classification often overlooks molecular commonalities hidden beneath divergent clinical presentations. This study introduces a transcriptomics-driven framework for…
cs.AI2025
Prompt Stability Matters: Evaluating and Optimizing Auto-Generated Prompt in General-Purpose Systems
Ke Chen, Yufei Zhou, Xitong Zhang +1
Automatic prompt generation plays a crucial role in enabling general-purpose multi-agent systems to perform diverse tasks autonomously. Existing methods typically evaluate prompts…