1 paper
Xiao Xiao, Yu Su, Sijing Zhang +3
Large language models (LLMs) exhibit probabilistic output characteristics, yet conventional evaluation frameworks rely on deterministic scalar metrics. This study introduces a Baye…