Showing cs.LGShow all
2 papers · 1 filter
cs.LG2026
Subliminal Signals in Preference Labels
Isotta Magistrali, Frédéric Berdoz, Sam Dauncey +1
As AI systems approach superhuman capabilities, scalable oversight increasingly relies on LLM-as-a-judge frameworks where models evaluate and guide each other's training. A core as…
cs.LG2025
Steering Pretrained Drafters during Speculative Decoding
Frédéric Berdoz, Peer Rheinboldt, Roger Wattenhofer
Speculative decoding accelerates language model inference by separating generation into fast drafting and parallel verification. Its main limitation is drafter-verifier misalignmen…