1 paper
Valentin Rodionov, Shamil Assylbekov
Large language models are being proposed as agents in scientific workflows, in domains where no downstream verifier exists. Such deployment assumes the model can distinguish reliab…