1 paper
Shin-nosuke Ishikawa, Seiya Ikeda, Hirotsugu Ohba
Large language models (LLMs) are generally constrained from expressing feelings through human-preference alignment in post-training processes. This policy is designed using a top-d…