2 papers
cs.CV2026
DA-SegFormer: Damage-Aware Semantic Segmentation for Fine-Grained Disaster Assessment
Kevin Zhu, William Tang, Raphael Hay Tene +3
Rapid and accurate damage assessment following natural disasters is critical for effective emergency response. However, identifying fine-grained damage levels (e.g., distinguishing…
cs.AI2025
JudgeBench: A Benchmark for Evaluating LLM-based Judges
Sijun Tan, Siyuan Zhuang, Kyle Montgomery +5
LLM-based judges have emerged as a scalable alternative to human evaluation and are increasingly used to assess, compare, and improve models. However, the reliability of LLM-based…