Showing cs.CLShow all
2 papers · 1 filter
cs.CL2026
MineDraft: A Framework for Batch Parallel Speculative Decoding
Zhenwei Tang, Arun Verma, Zijian Zhou +4
Speculative decoding (SD) accelerates large language model inference by using a smaller draft model to propose draft tokens that are subsequently verified by a larger target model.…
cs.CL2023
Fine-tuning Language Models with Generative Adversarial Reward Modelling
Zhang Ze Yu, Lau Jia Jaw, Zhang Hui +1
Reinforcement Learning with Human Feedback (RLHF) has been demonstrated to significantly enhance the performance of large language models (LLMs) by aligning their outputs with desi…