3 papers
cs.LG2026
Transcoders Trace Visual Grounding and Hallucinations in Vision-Language Models
Dimitrios Damianos, Leon Voukoutis, Georgios Skyrianos +2
Generative Vision-Language Models (VLMs) perform well on multimodal reasoning, but how visual inputs are transformed to text remains poorly understood. Existing interpretability wo…
cs.CL2025
VOX-KRIKRI: Unifying Speech and Language through Continuous Fusion
Dimitrios Damianos, Leon Voukoutis, Georgios Paraskevopoulos +1
We present a multimodal fusion framework that bridges pre-trained decoder-based large language models (LLM) and acoustic encoder-decoder architectures such as Whisper, with the aim…
cs.CL2025
Krikri: Advancing Open Large Language Models for Greek
Dimitris Roussis, Leon Voukoutis, Georgios Paraskevopoulos +6
We introduce Llama-Krikri-8B, a cutting-edge Large Language Model tailored for the Greek language, built on Meta's Llama 3.1-8B. Llama-Krikri-8B has been extensively trained on hig…