1 paper
Menghui Zhang, Aoying Zheng, Guoxiao Liu +4
Trusted Execution Environment (TEE)-shielded partitioning of Large Language Models (LLMs) accelerates on-device inference by offloading obfuscated linear layers to an untrusted acc…