1 paper · 1 filter
Anton Razzhigaev, Matvey Mikhalchuk, Elizaveta Goncharova +4
This paper reveals a novel linear characteristic exclusive to transformer decoders, including models such as GPT, LLaMA, OPT, BLOOM and others. We analyze embedding transformations…