1 paper · 1 filter
Kundan Krishna, Joseph Y Cheng, Charles Maalouf +1
Existing paradigms for ensuring AI safety, such as guardrail models and alignment training, often compromise either inference efficiency or development flexibility. We introduce Di…