1 paper
Yusuke Yamauchi, Taro Yano, Masafumi Oyamada
As large language models (LLMs) continue to advance, reliable evaluation methods are essential particularly for open-ended, instruction-following tasks. LLM-as-a-Judge enables auto…