2 papers
cs.CL2026
When Do LLM Agents Treat Surface Noise Differently from Semantic Noise? A 68-Cell Measurement Study with a Held-Out Trace-Level Validation
Liyun Zhang, Jiayi Guo
We document an empirical phenomenon in chain-of-thought and ReAct agents driven by ten large language models from seven architecture families: meaning-bearing perturbations (e.g.,…
cs.CV2026
DyCoRM: Dynamic Criterion-Aware Reward Modeling for Text-to-Image Generation
Jiaying Qian, Ziheng Jia, Qian Zhang +5
With the continued advancement of text-to-image (T2I) generation, producing high-quality images is becoming increasingly attainable; consequently, user demands are shifting toward…