2 papers
cs.AR2026
SPECTRA: Adaptive Execution of Speculative Decoding on a Runtime-Reconfigurable Tiled Architecture
Gabriele Tombesi, William Baisi, Je Yang +5
LLM inference on edge devices is constrained by computational and memory resources, making efficient autoregressive decoding challenging. Speculative decoding alleviates this bottl…
cs.AR2026
NoTB: Oracle-Free Triage of LLM-Generated RTL via Cross-Model Formal Consensus
Elisavet Lydia Alvanaki, Je Yang, Biruk Seyoum +1
Large language models (LLMs) are increasingly used to generate register-transfer-level (RTL) designs from natural-language specifications. However, assessing functional correctness…