1 paper
Kailas Vodrahalli, Wei Wei, James Zou
Recent advances in generative AI have been driven by alignment techniques such as reinforcement learning from human feedback (RLHF). RLHF and related techniques typically involve c…