1 paper · 1 filter
Philip Zhong, Don Wang, Jason Zhang
Industrial teams often deploy large language model features before stable regression or model selection evaluation exists. We present a reusable evaluation system for AI meeting su…