Showing cs.CLShow all
2 papers · 1 filter
cs.CL2026
GPUTOK: GPU Accelerated Byte Level BPE Tokenization
Venu Gopal Kadamba, Kanishkha Jaisankar
As large language models move toward million-token context windows, CPU tokenizers become a major slowdown because they process text one step at a time while powerful GPUs sit unus…
cs.CL2024
Exploring Embedding Priors in Prompt-Tuning for Improved Interpretability and Control
Sergey Sedov, Sumanth Bharadwaj Hachalli Karanam, Venu Gopal Kadamba
Prompt-Tuning is an efficient method for adapting pre-trained language models to new tasks with minimal computational overhead by modifying prompt embeddings. In this work, we inve…