Showing cs.CLShow all
2 papers · 1 filter
cs.CL2026
Syntactic Framing Fragility: An Audit of Robustness in LLM Ethical Decisions
Katherine Elkins, Jon Chun
Large language models exhibit systematic negation sensitivity, yet no operational framework exists to measure this vulnerability at deployment scale, especially in high-stakes deci…
cs.CL2026
CEI: A Benchmark for Evaluating Pragmatic Reasoning in Language Models
Jon Chun, Hannah Sussman, Adrian Mangine +13
Pragmatic reasoning, inferring intended meaning beyond literal semantics, underpins everyday communication yet remains difficult for large language models. We present the Contextua…