2 papers
cs.AI2025
Utilizing Large Language Models for Zero-Shot Medical Ontology Extension from Clinical Notes
Guanchen Wu, Yuzhang Xie, Huanwei Wu +4
Integrating novel medical concepts and relationships into existing ontologies can significantly enhance their coverage and utility for both biomedical research and clinical applica…
cs.LG2025
RiskPO: Risk-based Policy Optimization via Verifiable Reward for LLM Post-Training
Tao Ren, Jinyang Jiang, Hui Yang +10
Reinforcement learning with verifiable reward has recently emerged as a central paradigm for post-training large language models (LLMs); however, prevailing mean-based methods, suc…