2 papers
cs.CL2025
Doğal Dil İşlemede Tokenizasyon Standartları ve Ölçümü: Türkçe Üzerinden Büyük Dil Modellerinin Karşılaştırmalı Analizi
M. Ali Bayram, Ali Arda Fincan, Ahmet Semih Gümüş +3
Tokenization is a fundamental preprocessing step in Natural Language Processing (NLP), significantly impacting the capability of large language models (LLMs) to capture linguistic…
cs.CL2025
Büyük Dil Modelleri için TR-MMLU Benchmarkı: Performans Değerlendirmesi, Zorluklar ve İyileştirme Fırsatları
M. Ali Bayram, Ali Arda Fincan, Ahmet Semih Gümüş +3
Language models have made significant advancements in understanding and generating human language, achieving remarkable success in various applications. However, evaluating these m…