2 papers
cs.AI2026
SokoBench: Evaluating Long-Horizon Planning and Reasoning in Large Language Models
Sebastiano Monti, Carlo Nicolini, Gianni Pellegrini +2
Although the capabilities of large language models have been increasingly tested on complex reasoning tasks, their long-horizon planning abilities have not yet been extensively inv…
cs.CL2025
Hyperdimensional Probe: Decoding LLM Representations via Vector Symbolic Architectures
Marco Bronzini, Carlo Nicolini, Bruno Lepri +2
Despite their capabilities, Large Language Models (LLMs) remain opaque with limited understanding of their internal representations. Current interpretability methods either focus o…