3 papers
cs.CL2026
Biomedical Reference Generation Remains Unreliable across 26 Large Language Models
Maxim Topaz, Zhihong Zhang, Nir Roguin +3
Background. Large language models are increasingly used to help write biomedical text but may fabricate references to nonexistent work. How often large language models do so is not…
cs.CL2025
Pretraining Finnish ModernBERTs
Akseli Reunamo, Laura-Maria Peltonen, Hans Moen +1
This paper reports on pretraining ModernBERT encoder models in six different sizes, ranging from 51M to 475M parameters, with a focus on limited multilingualism, emphasizing langua…
cs.CY2024
Implementing a Nordic-Baltic Federated Health Data Network: a case report
Taridzo Chomutare, Aleksandar Babic, Laura-Maria Peltonen +14
Background: Centralized collection and processing of healthcare data across national borders pose significant challenges, including privacy concerns, data heterogeneity and legal b…