2 papers
cs.CL2026
Position Bias in Ordinal Classification: A Systematic Evaluation
Yu Wang, Jeffrey Zhou, Menglin Liu +1
Large language models are increasingly used for ordinal classification, yet semantically equivalent changes to prompt organization can alter their predictions. We conduct systemati…
cs.CR2026
JailbreakOPT: Tool-Assisted Iterative Jailbreak Prompt Optimization
Ge Shi, Jun Yin, Donglin Xie +3
Jailbreak attacks expose persistent safety weaknesses in large language models (LLMs), but existing stateless single-turn methods face a trade-off: hand-crafted prompts are express…