1 paper · 1 filter
Wei-Hsiang Lin, Sheng-Lun Wei, Hen-Hsen Huang +1
LLM-as-Judge frameworks are increasingly popular for AI evaluation, yet research findings on the relationship between models' generation and judgment abilities remain inconsistent.…