Showing cs.AIShow all
2 papers · 1 filter
cs.AI2026
Grounding Multi-Hop Reasoning in Structural Causal Models via Group Relative Policy Optimization
Yunhan Bu, Quan Zhang, Huaping Zhang +9
Multi-Hop Fact Verification requires complex reasoning across disparate evidence, posing significant challenges for Large Language Models , which may suffer from hallucinations and…
cs.AI2026
Improving Multimodal Reasoning via Worst Dimension Optimization
Haocheng Lv, Huaping Zhang, Qiuchi Li +2
Multimodal reasoning requires a path that retains integrity over a wide range of constraints, from visual grounding to logic consistency. However, the current Process Reward Models…