3 papers
cs.CL2026
OCRTurk: A Comprehensive OCR Benchmark for Turkish
Deniz Yılmaz, Evren Ayberk Munis, ÃaÄrı Toraman +4
Document parsing is now widely used in applications, such as large-scale document digitization, retrieval-augmented generation, and domain-specific pipelines in healthcare and educ…
cs.CL2026
RAGTurk: Best Practices for Retrieval Augmented Generation in Turkish
Süha KaÄan Köse, Mehmet Can Baytekin, Burak AktaÅ +5
Retrieval-Augmented Generation (RAG) enhances LLM factuality, yet design guidance remains English-centric, limiting insights for morphologically rich languages like Turkish. We add…
cs.CL2025
FIBER: A Multilingual Evaluation Resource for Factual Inference Bias
Evren Ayberk Munis, Deniz Yılmaz, Arianna Muti +1
Large language models are widely used across domains, yet there are concerns about their factual reliability and biases. Factual knowledge probing offers a systematic means to eval…