Showing cs.CLShow all
2 papers · 1 filter
cs.CL2026
Cross-Lingual Probing and Community-Grounded Analysis of Gender Bias in Low-Resource Bengali
Md Asgor Hossain Reaj, Rajan Das Gupta, Jui Saha Pritha +4
Large Language Models (LLMs) have achieved significant success in recent years; yet, issues of intrinsic gender bias persist, especially in non-English languages. Although current…
cs.CL2025
Evaluating Subword Tokenization Techniques for Bengali: A Benchmark Study with BengaliBPE
Firoj Ahmmed Patwary, Abdullah Al Noman
Tokenization is an important first step in Natural Language Processing (NLP) pipelines because it decides how models learn and represent linguistic information. However, current su…