2 papers
cs.CL2026
MiA-Signature: Approximating Global Activation for Long-Context Understanding
Yuqing Li, Jiangnan Li, Mo Yu +3
A growing body of work in cognitive science suggests that reportable conscious access is associated with \emph{global ignition} over distributed memory systems, while such activati…
cs.CL2024
Improving Mathematical Reasoning Capabilities of Small Language Models via Feedback-Driven Distillation
Xunyu Zhu, Jian Li, Can Ma +1
Large Language Models (LLMs) demonstrate exceptional reasoning capabilities, often achieving state-of-the-art performance in various tasks. However, their substantial computational…